Ling 3.1 Flash는 전작 대비 지능에서 큰 향상을 이루며, 특히 에이전트 능력에서 두드러진 개선을 보이며 Artificial Analysis Intelligence Index에서 41점을 기록했습니다
@AntLingAGI가 총 560B 파라미터, 활성 25B 파라미터, 1M 토큰 컨텍스트 윈도우를 갖춘 추론 모델 Ling 3.1 Flash를 공개했습니다. 이 모델은 Artificial Analysis Intelligence Index v4.3에서 41점을 기록해, 8월에 출시된 Ling 3.0 Flash의 20점에서 상승했습니다. Ling 3.1 Flash는 오픈 웨이트로 제공될 예정이며, Ant Group이 곧 웨이트를 공개할 예정입니다.
주요 결과:
➤ Ling 3.1 Flash는 전작 대비 에이전트 능력이 향상되었습니다. GDPval-AA v2 Elo 1,622점과 AA-Briefcase Elo 1,400점을 기록하며 GLM-5.3-Flash, Gemini 3.8 Flash (high), DeepSeek V4.1 Flash (Max) 같은 동급 모델들과 경쟁합니다. Ling 3.1 Flash는 AutomationBench-AA(62%)와 Terminal-Bench v4.0(33%)에서도 눈에 띄는 향상을 보였습니다.
➤ Ling 3.1 Flash는 AA-Omniscience에서 +2점을 기록했으며, 이는 Ling 3.0 Flash(-18) 대비 22점 개선입니다. 전작과 비교해 정확도는 18%에서 29%로 상승했고 환각률은 유사한 시도율(56%에서 58%)에서 44%에서 38%로 하락했으며, 이는 향상이 더 많이 보류하기보다 주로 더 많이 알고 있기 때문임을 보여줍니다. 참고로 DeepSeek V4.1 Flash (Max)의 환각률은 97%입니다.
➤ Ling 3.1 Flash는 전작보다 큰 모델로 가격도 그에 맞게 책정되었지만 토큰 효율은 더 높습니다. 총 560B, 활성 25B 파라미터로 Ling 3.0 Flash의 124B 및 5.1B에서 증가했으며, 가격은 1M 입력/출력 토큰당 $0.30 / $0.90로 $0.075 / $0.22에서 인상되었습니다. Intelligence Index를 실행하는 데 218M 출력 토큰을 사용했으며, 이는 Ling 3.0 Flash(261M)보다 16% 적은 수치입니다.
➤ Ling 3.1 Flash는 일부 경쟁 모델보다 작업당 비용이 높지만 여전히 가장 매력적인 사분면에 위치합니다. Ling 3.1 Flash의 작업당 비용은 $0.99로, GLM-5.3-Flash($0.42)와 DeepSeek V4.1 Flash (Max, $0.32)를 크게 상회하지만 $1.24인 Gemini 3.8 Flash (High)보다는 낮습니다.
추가 모델 세부 정보:
➤ 크기: 총 560B 파라미터, 활성 25B
➤ 컨텍스트 윈도우: 1M 토큰
➤ 가격: 1M 입력 토큰당 $0.30, 1M 출력 토큰당 $0.90, 캐시된 입력은 1M당 $0.06 (80% 할인)
➤ 이용 가능성: Novita AI를 통해 이용 가능하며, 웨이트는 곧 공개될 예정입니다

