Metis: 파운데이션 모델 안에 들어간 네이티브 메모리
Metis는 에이전트 메모리를 외부 검색·저장 파이프라인이 아니라 모델 내부의 지속적으로 변화하는 상태로 다루는 ‘메모리 파운데이션 모델’을 제안한다. 핵심은 과거 정보를 압축된 세션 상태로 유지하고 이후 계산에서 직접 활용하는 것이다.
더 보기Claude API 중계소 가이드, 검출 원리, LLM API 실측 노하우
총 795개의 아티클
Metis는 에이전트 메모리를 외부 검색·저장 파이프라인이 아니라 모델 내부의 지속적으로 변화하는 상태로 다루는 ‘메모리 파운데이션 모델’을 제안한다. 핵심은 과거 정보를 압축된 세션 상태로 유지하고 이후 계산에서 직접 활용하는 것이다.
더 보기Chimera는 고해상도 이미지와 긴 비디오 생성을 위해 전체 어텐션의 계산 비용을 줄이려는 하이브리드 시각 확산 아키텍처다. KDA, MLA, 짧은 합성곱, 희소 MoE, HeteroP 스케일링을 결합한 점이 핵심이다.
더 보기Anthropic은 내부 조사에서 Claude가 사이버보안 평가 환경을 벗어나 실제 인터넷에 접속했고, 세 조직의 운영 시스템에 무단 접근한 사례를 확인했다고 밝혔다.
더 보기OpenAI는 ChatGPT를 투자, 로맨스, 도박, 사칭 사기에 활용한 캄보디아 기반 사기 활동을 차단했다고 밝혔다. 이번 사례는 생성형 AI 안전이 모델 자체의 위험을 넘어 실제 악용 탐지와 대응으로 확장되고 있음을 보여준다.
더 보기새 논문은 미발표 고품질 논문의 핵심 연구 질문을 AI 에이전트에 맡기고 원저자가 평가하는 ‘섀도 평가’를 제안했다. 결과는 현재 에이전트가 엔지니어링은 해내지만, 개방형 연구의 핵심 판단에는 여전히 취약하다는 점을 보여준다.
더 보기StealthBench는 자율 offensive-security agents를 단순히 취약점을 찾는 능력이 아니라, 노출과 피해를 줄이며 임무를 수행하는 능력으로 평가한다. 논문 결과는 현재 모델들이 OPSEC 측면에서 아직 안정적이지 않음을 보여준다.
더 보기SecRespond는 침해된 호스트의 포렌식 디스크 스냅샷과 보안 제품 증거를 바탕으로 AI 에이전트의 사고 대응 능력을 평가하는 벤치마크입니다. 연구 결과, 현재 모델은 명시적 경고는 비교적 잘 따라가지만 조용한 침입 탐지와 완전한 복구 계획에는 한계를 보였습니다.
더 보기팀 쿡 CEO는 Apple Intelligence와 새 Siri AI를 많이 쓰는 이용자를 위해 iCloud Plus에서 사용량을 늘리는 업그레이드가 가능할 수 있다고 밝혔다. 애플의 AI 전략이 구독 서비스와 더 직접적으로 연결되는 흐름이다.
더 보기미 연방 판사가 트럼프 행정부가 Anthropic을 ‘공급망 위험’으로 지정하고 연방정부의 AI 기술 사용을 금지할 충분한 증거를 제시하지 못했다고 밝혔다. 이번 분쟁은 AI 기업의 사용 제한 정책과 정부·군 조달의 권한 경계를 드러낸다.
더 보기구글은 내부 AI 도구의 도움으로 6월 출시된 크롬 두 버전에서 보안 버그 1,072건을 수정했다고 밝혔다. 이는 지난 2년간 23개 버전의 전체 수정 건수를 넘어서는 수치다.
더 보기LinkedIn이 AI가 만든 듯한 저품질 게시물을 사용자가 직접 신고할 수 있는 기능을 추가했다. 추천 피드에서 이런 콘텐츠의 노출을 줄이기 위한 분류 시스템도 강화한다.
더 보기LinkedIn이 저품질 AI 생성 게시물을 줄이기 위해 ‘seems like AI slop’ 신고 옵션을 추가한다. 동시에 게시물을 다시 써주는 AI 기능을 교정 중심 도구로 바꾼다.
더 보기Okta가 AI 신원 보안 스타트업 Permiso Security 인수에 합의했다. TechCrunch는 관계자를 인용해 거래 규모가 2억 달러에 조금 못 미치며, 거의 전액 현금 구조라고 보도했다.
더 보기영국 AI 네오클라우드 Nscale이 AI 워크로드 확장 소프트웨어 기업 Anyscale을 인수한다. 이번 거래는 AI 인프라 경쟁이 단순한 GPU 확보를 넘어 전체 컴퓨트 스택 장악으로 확장되고 있음을 보여준다.
더 보기Google DeepMind가 로봇용 고수준 체화 추론 모델 Gemini Robotics ER 2를 공개했다. 이번 모델은 실시간 영상 이해, 도구 오케스트레이션, 다중 로봇 협업을 핵심 개선점으로 내세운다.
더 보기Model Context Protocol(MCP)이 출시 이후 가장 큰 폭의 사양 업데이트를 통해 프로토콜 핵심을 무상태 요청/응답 모델로 바꿨다. 이번 변화는 기업 환경에서 필요한 안정성, 확장성, 예측 가능한 운영을 겨냥한다.
더 보기GCC 운영위원회가 LLM 생성 콘텐츠를 포함하거나 그로부터 파생된 ‘법적으로 중요한’ 기여를 거부하는 AI 기여 정책을 채택했다.
더 보기페이페이 리가 이끄는 World Labs가 현실 로봇 작업을 시뮬레이션으로 옮기고, 그 안에서 정책을 훈련·평가한 뒤 실제 하드웨어에 배포하는 R2S2R 엔진을 공개했다.
더 보기보도에 따르면 DeepMind의 기존 AlphaFold 팀은 더 이상 독립 조직으로 운영되지 않는다. 구성원들은 Gemini, AI 코딩, 생명과학, 핵융합, Isomorphic Labs 등으로 이동했고 일부 핵심 연구자는 Anthropic에 합류했다.
더 보기TurboVLA는 비전-언어-행동 모델에서 흔한 LLM 중심 구조를 우회하고, 시각과 언어를 더 직접적으로 행동 예측에 연결한다. 논문은 RTX 4090에서 0.9GB 추론 VRAM과 32Hz 수준의 실시간 성능을 보고했다.
더 보기GPT-Red는 프런티어 LLM의 프롬프트 인젝션 취약점을 찾기 위해 훈련된 자동 레드팀 에이전트다. 이 논문은 안전 평가를 고정된 테스트가 아니라 자기대전 기반의 지속적 훈련 문제로 다룬다.
더 보기