AMD, Taalas 인수로 ‘모델 가중치 내장’ AI 칩 전략 강화
AMD가 토론토 기반 AI 칩 스타트업 Taalas를 인수한다고 발표했다. Taalas는 모델 가중치를 HBM 같은 외부 메모리가 아니라 실리콘에 직접 넣어 추론 효율을 높이려는 접근법을 내세운다.
더 보기Claude API 중계소 가이드, 검출 원리, LLM API 실측 노하우
총 791개의 아티클
AMD가 토론토 기반 AI 칩 스타트업 Taalas를 인수한다고 발표했다. Taalas는 모델 가중치를 HBM 같은 외부 메모리가 아니라 실리콘에 직접 넣어 추론 효율을 높이려는 접근법을 내세운다.
더 보기알리바바가 음성 인식, 음성 합성, 오디오 콘텐츠 제작, 실시간 음성 에이전트를 통합한 CosyVoice Studio를 공개했다. 핵심은 단순 전사나 합성이 아니라 음성 흐름 전반에 의미 이해를 결합했다는 점이다.
더 보기Prime Intellect가 프로그래밍 Agent Harness인 Prime Agent를 오픈소스로 공개했다. Opus 5와 결합한 구성은 ARC-AGI 3에서 95.5% RHAE Best@1을 기록해 ARC 보고서의 인간 전문가 기준선을 근소하게 넘어섰다고 전해졌다.
더 보기Rust 프로젝트는 rust-lang/rust 모노레포의 코드 기여를 위한 LLM 사용 정책을 채택했다. AI 도구를 일괄 금지하기보다 기여자가 직접 작성하지 않은 코드를 분명히 밝히는 데 초점을 맞춘다.
더 보기유수테크가 IPO 공모가와 전략 배정 결과를 공개했다. DeepSeek는 93만3399주를 배정받았으며, 주당 150.8위안 기준 인수 금액은 약 1억4100만 위안이고 락업 기간은 36개월이다.
더 보기알리바바의 영상 생성 모델 Wan 3.0이 공개 베타에 들어갔다. 가장 눈에 띄는 변화는 doc, ppt, pdf 같은 문서 파일을 직접 입력할 수 있다는 점으로, 영상 생성이 표현 도구에서 업무 도구로 확장되고 있다는 신호다.
더 보기앤트그룹이 멀티 에이전트 협업 인프라 Avernet을 오픈소스로 공개하고 커뮤니티 버전을 출시했다. 첫 버전은 에이전트 발견, 합의, 협업, 거버넌스 기능에 초점을 맞춘다.
더 보기vLLM의 Decode Context Parallelism(DCP)은 KV 캐시를 어텐션 헤드가 아니라 시퀀스 차원으로 나눈다. 긴 컨텍스트 에이전트 워크로드에서 GPU 메모리 한계를 낮추고 높은 동시성에서 처리량을 끌어올리기 위한 접근이다.
더 보기OpenAI가 전 애플 디자인 책임자 Jony Ive와 개발 중인 첫 AI 하드웨어가 화면 없는 휴대형 스마트 스피커에 가깝다는 보도가 나왔습니다. 이 기기는 도넛 형태에 하키퍽 정도의 크기로 알려졌습니다.
더 보기AI 생성 음악이 스트리밍 플랫폼에 대량 유입되고 저작권 소송이 이어지는 가운데, Suno가 생성 음원에 보이지 않는 워터마크를 넣고 다운로드 제한을 강화하겠다고 밝혔다. 이는 AI 음악 서비스가 출처 표시와 남용 방지라는 새로운 기준에 맞춰 재정비되는 흐름을 보여준다.
더 보기Anthropic이 Claude 등 자사 모델 구동을 위한 커스텀 실리콘 팀 채용을 확인했다. 다만 회사는 외부 칩도 함께 쓰는 멀티칩 전략을 유지하겠다고 밝혔다.
더 보기이 연구는 개인화 LLM이 근거가 부족한데도 사용자 특성을 추론해 버리는 문제를 대규모로 측정했다. 더 중요한 경고는, 모델이 스스로 내리는 평가는 모델 간 비교에서 믿을 만한 신호가 아닐 수 있다는 점이다.
더 보기이 논문은 단일 모델 제안보다, 통합 멀티모달 사전학습이 실제로 어떻게 작동하는지를 체계적으로 설명한다. 지식 흐름, 모달리티 간 시너지와 경쟁, 조기 통합, 효율적 학습 레시피가 핵심이다.
더 보기비디오 월드 모델은 한 프레임씩 보면 그럴듯하지만, 긴 전개에서는 상태가 점점 어긋납니다. WorldCycle은 가역적 동작 순환을 자기 검증형 학습 신호로 바꿔 “원래 상태로 돌아오는가”를 최적화합니다.
더 보기펜실베이니아주립대 연구진은 LLM 에이전트의 프롬프트 인젝션 위험을 자동으로 레드팀 테스트하는 PIMiner를 제안했다. 핵심은 강화학습 공격 모델에만 의존하지 않고, 새로운 대상 모델에도 옮겨 쓸 수 있는 전략 라이브러리를 만드는 것이다.
더 보기Ego2Robot은 1인칭 인간 조작 영상을 로봇용 학습 데이터로 바꾸는 합성 파이프라인이다. 소규모 태스크 변환을 넘어, 대규모 사전학습에 쓸 수 있는 데이터 자원을 만드는 데 초점을 둔다.
더 보기Video-DeepResearch는 정적 이미지 중심의 멀티모달 에이전트를 연속 비디오 스트림으로 확장한다. 시각 도구를 건너뛰고 텍스트 검색으로 바로 가는 편향과 내부 기억 의존 문제를 함께 겨냥한다.
더 보기이 연구는 3D를 별도 작업들의 묶음이 아니라 하나의 통합 멀티모달 문제로 본다. 핵심은 모델 구조뿐 아니라 대규모 3D 학습 데이터를 어떻게 만들었는가에 있다.
더 보기미래 프레임 없이, 길이도 미리 정하지 않은 상태에서 비디오를 편집하는 것은 쉽지 않습니다. JoyAI-Video-Edit는 자기회귀 확산과 증류 전략을 결합해 실시간성과 원본 보존을 함께 노립니다.
더 보기이 논문은 월드 모델을 물리 상태 예측 장치가 아니라, 에이전트가 계획하고 학습하며 계속 개선되는 데 필요한 상호작용형 정보 프록시로 재정의한다.
더 보기SkillJack은 자기 진화형 에이전트가 상호작용 경험을 재사용 가능한 스킬로 바꾸는 과정을 노리는 공격이다. 악성 행동이 단순한 메모리 오염을 넘어 장기적인 능력으로 굳어질 수 있다는 점을 보여준다.
더 보기