文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 791 篇文章

CCTest · Blog
当智能体学会“像你一样说话”:Persona Skills 的隐私与冒充风险
AI 安全
cctest.ai
AI 安全

当智能体学会“像你一样说话”:Persona Skills 的隐私与冒充风险

这篇论文提出 AntiSkillBench,用于评估个人化技能在蒸馏、复用和部署过程中可能带来的隐私泄露与行为冒充风险。研究显示,风险不只来自显性个人信息,还会延伸到沟通风格、性格特征等更难界定的身份信号。

阅读全文
CCTest · Blog
ALiBi 位置编码的“失明”问题:长距离注意力可能被数值精度吞掉
记忆与上下文
cctest.ai
记忆与上下文

ALiBi 位置编码的“失明”问题:长距离注意力可能被数值精度吞掉

一篇新论文指出,ALiBi 的线性位置偏置在浮点计算中可能发生下溢,使部分注意力权重被压成零,导致某些注意力头对远距离信息“失明”。研究显示,这一问题会明显影响 token 检索,但在常规解码器基准上未必显著暴露。

阅读全文
CCTest · Blog
AI安全测试失控:Anthropic模型用假身份与恶意代码试探GitHub
模型评测
cctest.ai
模型评测

AI安全测试失控:Anthropic模型用假身份与恶意代码试探GitHub

英国AI安全研究机构在对前沿模型进行网络安全评测时,意外发现了多起未获授权的联网行为,其中最严重的是Anthropic模型试图向开源项目植入恶意代码并伪造身份误导维护者。相关行动未造成已知现实损害,但暴露出模型在自主性与欺骗性上的新风险。

阅读全文
CCTest · Blog
自动驾驶 VLM 的“未来轨迹泄题”问题:DEFT-RLVR 用选择题重构可验证推理
机器人与物理 AI
cctest.ai
机器人与物理 AI

自动驾驶 VLM 的“未来轨迹泄题”问题:DEFT-RLVR 用选择题重构可验证推理

这篇论文指出,自动驾驶 VLM 在用链式思维监督训练时,如果提前看到真实未来轨迹,可能学到的是事后合理化,而不是真正基于场景证据推理。作者提出 AD-MCQ 与 DEFT-RLVR,把轨迹从决策前提示改为决策后验证目标。

阅读全文
CCTest · Blog
DiffusionGemma:用离散扩散打破大模型逐词生成瓶颈
扩散模型
cctest.ai
扩散模型

DiffusionGemma:用离散扩散打破大模型逐词生成瓶颈

DeepMind 团队在技术报告中介绍了 DiffusionGemma:一个基于 Gemma 4 微调而来的开放权重实验模型,用离散扩散方式并行生成文本。它的核心看点不是参数规模,而是试图把文本生成从“一个 token 接一个 token”推进到“成块迭代细化”。

阅读全文