AREX: 검증을 통해 재귀적으로 개선되는 딥 리서치 에이전트
AREX는 복수의 제약을 만족해야 하는 딥 리서치 과제에서 임시 답변을 제약별로 감사하고, 미해결 항목을 다음 조사로 연결하는 자기개선형 에이전트 프레임워크다.
더 보기Claude API 중계소 가이드, 검출 원리, LLM API 실측 노하우
총 795개의 아티클
AREX는 복수의 제약을 만족해야 하는 딥 리서치 과제에서 임시 답변을 제약별로 감사하고, 미해결 항목을 다음 조사로 연결하는 자기개선형 에이전트 프레임워크다.
더 보기WorldWeaver는 스트리밍 자기회귀 확산 비디오 모델에 세계 상태 레지스터를 도입해, 여러 에이전트와 시점 사이에서 동일한 환경 상태를 유지하려는 접근이다.
더 보기ProVisE는 공간 과제가 항상 텍스트나 좌표로 답하기 적합하지 않다는 문제에서 출발한다. 이미지 생성 모델이 픽셀 위에 표시하거나 경로를 그리도록 하고, 이를 기존 벤치마크가 채점할 수 있는 구조화된 예측으로 변환한다.
더 보기NVIDIA Labs가 제안한 NOOA는 AI 에이전트 개발을 Python 객체지향 프로그래밍 모델에 맞춰 단순화하려는 프레임워크다. 메서드는 행동, 필드는 상태, docstring은 프롬프트, 타입 주석은 계약으로 사용된다.
더 보기OpenForgeRL은 Codex, OpenClaw 같은 복잡한 추론 harness를 기존 오픈 RL 훈련 스택과 연결하려는 프레임워크입니다. 경량 프록시와 Kubernetes 기반 rollout 분리를 통해 실제 배포 환경에 가까운 조건에서 Agent를 학습시킵니다.
더 보기새 논문은 단일 턴 벤치마크에서 강한 성능을 보이는 LLM이라도 실제 대화에서 계속 바뀌는 사용자 의도를 안정적으로 추적하지 못할 수 있다고 지적한다. 연구진은 기존 정적 과제를 동적 다중 턴 대화로 바꾸는 평가 프레임워크를 제안했다.
더 보기SANA-Video 2.0은 선형 어텐션의 효율성과 softmax 어텐션의 표현력을 결합한 비디오 확산 Transformer입니다. 논문은 단일 H100에서 최대 720p 비디오 생성을 목표로 하며, 긴 비디오에서 계산 효율의 이점이 커진다고 설명합니다.
더 보기Ritankar Das, Reid Hoffman, Mark Pincus가 공동 창업한 새 AI 연구소 Prentis가 10억 달러 기업가치로 1억 달러 투자 유치를 논의 중인 것으로 전해졌다. 이 회사는 코딩보다 일상적인 컴퓨터 업무 자동화가 더 큰 AI 활용처가 될 수 있다고 보고 있다.
더 보기연구진은 AlphaFold를 활용해 Cas 단백질이 잘못 짝지어진 DNA를 어떻게 허용하는지 분석했다. 이후 핵심 아미노산을 바꿔 표적 편집 활성을 유지하면서 오프타깃 편집을 낮춘 변이를 만들었다.
더 보기The Vergecast는 검색엔진이 웹을 크롤링하고 그 대가로 트래픽을 돌려주던 기존 질서가 AI 요약과 답변형 검색으로 약화되고 있다고 짚었다.
더 보기Meta가 자사 AI 챗봇을 질문 답변과 이미지 생성 중심에서 생산성형 개인 비서로 확장하고 있다. 이번 업데이트에는 캘린더 기반 일일 브리핑, 이벤트 계획, 반복 작업, 진행 중 방향을 조정할 수 있는 리서치 기능이 포함된다.
더 보기Anthropic이 새로운 중량급 모델 Opus 5를 출시했다. Fable 5보다 작지만 더 저렴하고 제한이 적으며, 일부 발표 벤치마크에서는 Fable 5를 앞선 것으로 소개됐다.
더 보기Anthropic이 Claude Opus 5를 출시하며 Claude Fable 5에 가까운 지능을 약 절반의 비용으로 제공하는 일상형 고성능 모델로 소개했다. 코딩, 자동화, 지식 업무, 과학 분석에서의 향상이 핵심 메시지다.
더 보기미국이 중국 AI와 모델 증류 의혹에 대한 대응을 검토하는 가운데, 주요 AI 기업들이 오픈웨이트 모델 전반을 제한해서는 안 된다고 촉구했다. 이번 논쟁은 개방형 AI 생태계와 폐쇄형 프런티어 모델 사업자의 이해관계를 드러낸다.
더 보기트럼프 행정부가 AI 기반 과학 프로젝트에 50억 달러를 투입하는 첫 ‘제네시스 미션’ 보조금을 발표했다. 논란의 핵심은 AI 활용이 아니라, 공공 연구를 정치와 스타트업식 성과주의로 재편하려는 흐름이다.
더 보기투잔 인텔리전스가 베이징대, 펑청연구소와 개발한 UniWorld-View가 페이페이 리 팀 관련 WorldScore 순위에서 1위에 올랐다. 단일 이미지나 단안 영상에서 지정한 카메라 궤적의 새 시점 영상을 생성하는 것이 핵심이다.
더 보기Moonshot의 오픈 모델 Kimi K3는 모델 자체보다 미국 AI 업계의 반응 때문에 더 큰 주목을 받았다. 동시에 OpenAI의 미공개 모델이 Hugging Face 보안 침해와 연결되면서, AI 위험이 지정학적 경쟁만의 문제가 아님을 보여줬다.
더 보기미국 EPA가 일부 대기오염 ‘소규모 배출원’ 허가에서 주민 참여 요건을 주 정부 판단에 맡기는 방안을 검토하고 있다. 가스 발전과 디젤 발전기에 의존하는 AI 데이터센터 확장에 직접적인 영향을 줄 수 있다.
더 보기OpenAI가 ChatGPT 데스크톱 앱에 새로운 ChatGPT Voice를 추가해 사용자가 음성으로 ChatGPT Work, Codex, 컴퓨터 사용 기능을 지시할 수 있게 했다. 이번 업데이트는 음성을 단순한 대화 입력이 아니라 AI 에이전트 작업을 조율하는 인터페이스로 확장한다.
더 보기OSChina 요약에 따르면 2026년 필즈상 수상자로 발표된 Jacob Tsimerman이 AI 안전 연구로 방향을 바꾸고 OpenAI에 합류한다고 밝혔다. 최상위 수학 인재가 AI 안전 분야로 이동한다는 점에서 주목된다.
더 보기OSChina 요약에 따르면 실리콘밸리 스타트업 약 200곳이 백악관에 공동 서한을 보내 중국 오픈소스 AI 모델 접근을 차단하지 말라고 촉구했다. 이번 논쟁은 AI 안보 규제와 스타트업 생태계의 생존 조건이 충돌하는 지점을 보여준다.
더 보기