계속 지켜보는 주제추적 중
관찰 기간3일차
관찰 기록2건
연결된 출처9
변화 속도+43
알리바바는 8월 3일 2조 4000억 파라미터 규모의 Qwen 3.8-맥스를 정식 출시했다[2]. 알리바바는 해당 모델이 자사 역사상 가장 크고 유능하며, 미국의 프런티어 랩인 앤스로픽과 오픈AI의 최상위 시스템에 필적하는 성능을 가졌다고 주장한다[1]. 7월 중순부터 8월 초까지 3주 사이 중국 AI 진영에서는 세 건의 발표가 있었다[2]. 문샷AI가 2조 8000억 파라미터 규모의 키미 K3를 출시 후 열흘 뒤 가중치를 공개했고, 딥시크는 7월 31일 V4 플래시를 갱신했다[2]. 한편 ICML 제출 논문에 따르면 거대언어모델은 발신원을 태그가 아닌 문장 스타일로 식별한다[3]. 이 구조적 결함을 이용해 가짜 '사고의 연쇄'를 작성하면 항공기 해킹이나 코카인 제조법 등의 정보를 추출할 수 있으며, 이는 훈련으로도 해결되지 않는다[3].
Qwen은 코딩과 협업에 최적화된 거대언어모델인 Qwen3.8-Max를 공개했다 [1][2]. 한편, 2,890만 개의 파라미터를 가진 거대언어모델을 8달러 상당의 마이크로컨트롤러에서 구동하는 사례가 있다 [4]. RAG 구축 과정에서는 문서를 청크 단위로 나누고 임베딩하여 상위 항목을 검색하는 방식에서 어려움이 발생한다 [3]. GraphRAG가 벡터 RAG보다 성능이 우수한 경우가 존재한다 [3].