텐센트 혼위안, 770B 파라미터와 1M 컨텍스트의 Hy4 preview 공개
텐센트 혼위안이 총 770B 파라미터, 활성 파라미터 4.9B, 1M 컨텍스트를 지원하는 Hy4 preview를 공개했다. 여러 플랫폼에 모델을 배포하고 게임 엔진과 MCP를 연결하는 에이전트 활용 방향도 제시했다.
더 보기텐센트 혼위안이 총 770B 파라미터, 활성 파라미터 4.9B, 1M 컨텍스트를 지원하는 Hy4 preview를 공개했다. 여러 플랫폼에 모델을 배포하고 게임 엔진과 MCP를 연결하는 에이전트 활용 방향도 제시했다.
더 보기알리바바 다모아카데미와 중국 의과대학 부속 성징병원 등이 조영 CT에서 작은 간 악성 병변을 찾는 AI 모델 DAMO LiON을 개발했습니다. 2개월간 진행된 실제 임상시험에서 기존 판독에서 놓친 악성 종양 15건의 발견을 지원했습니다.
더 보기OpenRouter에 무료로 공개된 Ox Alpha가 빠르게 주목받고 있지만 개발·운영 주체는 익명으로 남아 있다. Z.ai의 GLM이나 미공개 Microsoft MAI일 수 있다는 관측이 나왔지만 확인된 사실은 없다.
더 보기Motif 3는 총 3140억 파라미터, 토큰당 132억 활성 파라미터를 가진 decoder-only MoE 언어 모델이다. GDLA와 다단계 후학습을 결합해 추론, 코딩, 장문맥 성능을 높이려 한다.
더 보기DeepSeek-V4-Flash 공식 API가 공개 베타로 제공되기 시작했다. 모델 구조와 규모는 유지하면서 후훈련을 다시 진행해 Agent 및 코딩 관련 벤치마크 성능을 끌어올린 점이 핵심이다.
더 보기Kimi K3는 총 2.8T 파라미터를 가진 MoE 모델로, 토큰당 1040억 파라미터를 활성화하며 네이티브 비전과 100만 토큰 컨텍스트를 지원한다. 논문은 이 모델을 장기 코딩, 에이전트 실행, 지식, 추론, 비전 과제에 대응하는 개방형 프런티어 모델로 제시한다.
더 보기앤트 바이링이 차세대 네이티브 혼합 추론 모델 Ling-3.0-Flash를 공개했다. 총 124B 파라미터 중 단일 계산에서 5.1B만 활성화하며, Agent 작업과 긴 문맥 처리, 낮은 추론 비용을 핵심 방향으로 내세운다.
더 보기Anthropic의 Claude Opus 5가 공식 출시됐다. 여러 고난도 평가와 개발자 실험에서 Fable 5에 근접하거나 앞서는 모습을 보였고, 가격은 약 절반 수준으로 제시됐다.
더 보기Anthropic이 새로운 중량급 모델 Opus 5를 출시했다. Fable 5보다 작지만 더 저렴하고 제한이 적으며, 일부 발표 벤치마크에서는 Fable 5를 앞선 것으로 소개됐다.
더 보기Anthropic이 Claude Opus 5를 출시하며 Claude Fable 5에 가까운 지능을 약 절반의 비용으로 제공하는 일상형 고성능 모델로 소개했다. 코딩, 자동화, 지식 업무, 과학 분석에서의 향상이 핵심 메시지다.
더 보기문샷 AI가 Kimi K3를 공개했다. 2.8조 파라미터, MoE 구조, 100만 token 컨텍스트, 네이티브 멀티모달, 전체 가중치 공개 계획이 이번 발표의 핵심이다.
더 보기OvisOCR2는 문서 페이지 이미지를 자연스러운 읽기 순서의 Markdown으로 직접 변환하는 0.8B 모델입니다. 텍스트, 수식, 표, 시각 영역을 함께 다루며 기존 파이프라인 방식에 도전합니다.
더 보기TechCrunch가 Financial Times 보도를 인용한 내용에 따르면, Moonshot AI의 차기 Kimi K3는 중국 최대 규모의 오픈 웨이트 AI 모델이 될 수 있으며 Anthropic Opus 4.8과의 격차를 좁힐 것으로 예상된다.
더 보기arXiv 논문은 1시간 외환 바의 다음 수익률 분포를 예측하기 위한 decoder-only Transformer, VAIOM을 제안한다. 금융 관측값은 입력에서 연속 벡터로 유지하고, 출력에서는 이산화된 수익률 버킷을 예측한다.
더 보기