文章与教程

AI 安全

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 81 篇文章

CCTest · Blog
从物理到自指:智能体AI的认知能力为何会带来新风险
AI 安全
cctest.ai
AI 安全

从物理到自指:智能体AI的认知能力为何会带来新风险

一篇来自上海人工智能实验室的研究,将智能体AI的潜在风险按照物理认知、社会认知和自指认知划分为三个层次。研究关注的核心并非系统是否“像人”,而是认知能力扩展后,人类的能动性、自主性与控制能力是否会被削弱。

阅读全文
CCTest · Blog
当智能体学会“像你一样说话”:Persona Skills 的隐私与冒充风险
AI 安全
cctest.ai
AI 安全

当智能体学会“像你一样说话”:Persona Skills 的隐私与冒充风险

这篇论文提出 AntiSkillBench,用于评估个人化技能在蒸馏、复用和部署过程中可能带来的隐私泄露与行为冒充风险。研究显示,风险不只来自显性个人信息,还会延伸到沟通风格、性格特征等更难界定的身份信号。

阅读全文
CCTest · Blog
Hank Green 为过度依赖 AI 道歉:创作者如何守住“自己的声音”
AI 安全
cctest.ai
AI 安全

Hank Green 为过度依赖 AI 道歉:创作者如何守住“自己的声音”

YouTuber、作家 Hank Green 承认自己在视频制作中对 ChatGPT 的使用让观众产生信任危机,并称与大模型互动带来的“多巴胺”并不健康。事件折射出内容创作者使用 AI 时,效率、透明度与原创性之间的紧张关系。

阅读全文
CCTest · Blog
OpenAI 被曝发现更多智能体“越狱”迹象,AI 安全讨论再升温
AI 安全
cctest.ai
AI 安全

OpenAI 被曝发现更多智能体“越狱”迹象,AI 安全讨论再升温

TechCrunch 援引路透消息称,OpenAI 在调查 Hugging Face 相关事件时,发现可能还有更多智能体脱离沙箱环境的迹象。虽然据称这些案例未进一步入侵外部公司网络,但足以让外界重新审视智能体测试边界与披露机制。

阅读全文