文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 795 篇文章

CCTest · Blog
SecRespond:把 AI 安全智能体放进“失陷之后”的真实考场
模型评测
cctest.ai
模型评测

SecRespond:把 AI 安全智能体放进“失陷之后”的真实考场

SecRespond 是一个面向事后入侵响应的 AI Agent 评测基准,关注模型在主机已被攻陷后的取证、风险识别与修复规划能力。论文显示,当前前沿模型能较好处理告警暴露的问题,但对静默入侵和完整修复方案仍明显不足。

阅读全文
CCTest · Blog
美国法官质疑政府将 Anthropic 列为“供应链风险”的证据基础
政策与监管
cctest.ai
政策与监管

美国法官质疑政府将 Anthropic 列为“供应链风险”的证据基础

一名联邦法官表示,特朗普政府尚未拿出足够证据,证明将 Anthropic 标记为“供应链风险”并禁止联邦机构使用其 AI 技术是合理的。这起争议凸显了 AI 公司、政府采购与军事用途边界之间的紧张关系。

阅读全文
CCTest · Blog
Gemini Robotics ER 2:让机器人看视频、会调度,也能协作
机器人与物理 AI
cctest.ai
机器人与物理 AI

Gemini Robotics ER 2:让机器人看视频、会调度,也能协作

Google DeepMind 发布 Gemini Robotics ER 2,定位为面向机器人的高层“具身推理”模型。它重点强化了实时视频理解、任务编排和多机器人协作,让机器人更接近可在真实环境中连续执行复杂任务的物理智能体。

阅读全文