아티클 & 가이드

Claude API 중계소 가이드, 검출 원리, LLM API 실측 노하우

총 795개의 아티클

CCTest · Blog
Metis: 파운데이션 모델 안에 들어간 네이티브 메모리
메모리·컨텍스트
cctest.ai
메모리·컨텍스트

Metis: 파운데이션 모델 안에 들어간 네이티브 메모리

Metis는 에이전트 메모리를 외부 검색·저장 파이프라인이 아니라 모델 내부의 지속적으로 변화하는 상태로 다루는 ‘메모리 파운데이션 모델’을 제안한다. 핵심은 과거 정보를 압축된 세션 상태로 유지하고 이후 계산에서 직접 활용하는 것이다.

더 보기
CCTest · Blog
OpenAI, 캄보디아 기반 사기 조직 차단 발표: AI 악용 대응의 새 과제
AI 안전
cctest.ai
AI 안전

OpenAI, 캄보디아 기반 사기 조직 차단 발표: AI 악용 대응의 새 과제

OpenAI는 ChatGPT를 투자, 로맨스, 도박, 사칭 사기에 활용한 캄보디아 기반 사기 활동을 차단했다고 밝혔다. 이번 사례는 생성형 AI 안전이 모델 자체의 위험을 넘어 실제 악용 탐지와 대응으로 확장되고 있음을 보여준다.

더 보기
CCTest · Blog
AI 에이전트는 개방형 AI 연구를 수행할 수 있을까? 두 건의 섀도 평가가 준 초기 증거
모델 평가
cctest.ai
모델 평가

AI 에이전트는 개방형 AI 연구를 수행할 수 있을까? 두 건의 섀도 평가가 준 초기 증거

새 논문은 미발표 고품질 논문의 핵심 연구 질문을 AI 에이전트에 맡기고 원저자가 평가하는 ‘섀도 평가’를 제안했다. 결과는 현재 에이전트가 엔지니어링은 해내지만, 개방형 연구의 핵심 판단에는 여전히 취약하다는 점을 보여준다.

더 보기
CCTest · Blog
StealthBench: 자율 보안 에이전트의 ‘은밀한 수행 능력’을 평가하다
모델 평가
cctest.ai
모델 평가

StealthBench: 자율 보안 에이전트의 ‘은밀한 수행 능력’을 평가하다

StealthBench는 자율 offensive-security agents를 단순히 취약점을 찾는 능력이 아니라, 노출과 피해를 줄이며 임무를 수행하는 능력으로 평가한다. 논문 결과는 현재 모델들이 OPSEC 측면에서 아직 안정적이지 않음을 보여준다.

더 보기
CCTest · Blog
SecRespond: 침해 이후 대응 능력으로 AI 에이전트를 평가하다
모델 평가
cctest.ai
모델 평가

SecRespond: 침해 이후 대응 능력으로 AI 에이전트를 평가하다

SecRespond는 침해된 호스트의 포렌식 디스크 스냅샷과 보안 제품 증거를 바탕으로 AI 에이전트의 사고 대응 능력을 평가하는 벤치마크입니다. 연구 결과, 현재 모델은 명시적 경고는 비교적 잘 따라가지만 조용한 침입 탐지와 완전한 복구 계획에는 한계를 보였습니다.

더 보기
CCTest · Blog
미 판사, Anthropic ‘공급망 위험’ 지정 근거 부족 지적
정책·규제
cctest.ai
정책·규제

미 판사, Anthropic ‘공급망 위험’ 지정 근거 부족 지적

미 연방 판사가 트럼프 행정부가 Anthropic을 ‘공급망 위험’으로 지정하고 연방정부의 AI 기술 사용을 금지할 충분한 증거를 제시하지 못했다고 밝혔다. 이번 분쟁은 AI 기업의 사용 제한 정책과 정부·군 조달의 권한 경계를 드러낸다.

더 보기
CCTest · Blog
Nscale의 Anyscale 인수, AI 컴퓨트 경쟁이 소프트웨어층으로 이동한다
비즈니스·투자
cctest.ai
비즈니스·투자

Nscale의 Anyscale 인수, AI 컴퓨트 경쟁이 소프트웨어층으로 이동한다

영국 AI 네오클라우드 Nscale이 AI 워크로드 확장 소프트웨어 기업 Anyscale을 인수한다. 이번 거래는 AI 인프라 경쟁이 단순한 GPU 확보를 넘어 전체 컴퓨트 스택 장악으로 확장되고 있음을 보여준다.

더 보기
CCTest · Blog
Gemini Robotics ER 2, 로봇에 영상 이해와 작업 오케스트레이션을 더하다
로보틱스·피지컬 AI
cctest.ai
로보틱스·피지컬 AI

Gemini Robotics ER 2, 로봇에 영상 이해와 작업 오케스트레이션을 더하다

Google DeepMind가 로봇용 고수준 체화 추론 모델 Gemini Robotics ER 2를 공개했다. 이번 모델은 실시간 영상 이해, 도구 오케스트레이션, 다중 로봇 협업을 핵심 개선점으로 내세운다.

더 보기
CCTest · Blog
MCP, 무상태 코어로 전환…기업용 AI 도구 연동의 확장성 장벽 낮춘다
프레임워크·도구
cctest.ai
프레임워크·도구

MCP, 무상태 코어로 전환…기업용 AI 도구 연동의 확장성 장벽 낮춘다

Model Context Protocol(MCP)이 출시 이후 가장 큰 폭의 사양 업데이트를 통해 프로토콜 핵심을 무상태 요청/응답 모델로 바꿨다. 이번 변화는 기업 환경에서 필요한 안정성, 확장성, 예측 가능한 운영을 겨냥한다.

더 보기