文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 791 篇文章

CCTest · Blog
无需外部监督的在策略自蒸馏:让大模型从自己的共识中学习
大语言模型
cctest.ai
大语言模型

无需外部监督的在策略自蒸馏:让大模型从自己的共识中学习

这篇论文提出 U-OPSD:只利用模型自身多次生成结果的一致性来构造伪答案,并在分歧样本上进行自蒸馏。实验显示,该方法在数学推理基准上可稳定提升 Qwen3 等模型表现,并能匹敌或超过带真值监督的方法。

阅读全文
CCTest · Blog
图像对话不该只会等指令:让 AI 主动推荐下一步编辑
多模态
cctest.ai
多模态

图像对话不该只会等指令:让 AI 主动推荐下一步编辑

一项来自真实图像创作产品的数据研究指出,多轮图像编辑中的“下一步建议”必须看懂当前画面,而不能只依赖聊天文本。论文提出三阶段框架,通过人工意图构建、用户点击反馈强化学习和视觉校验器,显著提升了建议的可用性与一致性。

阅读全文
CCTest · Blog
可解释性不再是性能税?Steerling-8B 探索“生来透明”的语言模型
大语言模型
cctest.ai
大语言模型

可解释性不再是性能税?Steerling-8B 探索“生来透明”的语言模型

这篇技术报告提出一种训练期可解释语言模型路线:不是在模型训练后再解释黑箱,而是把可解释性作为训练目标的一部分。其代表模型 Steerling-8B 试图在生成结果、输入 token、概念与训练数据之间建立可追溯关系。

阅读全文
CCTest · Blog
把大模型的经验“蒸馏”给小代理:AMD 的层级记忆思路
记忆与上下文
cctest.ai
记忆与上下文

把大模型的经验“蒸馏”给小代理:AMD 的层级记忆思路

这篇工作把“记忆”当成小型工具型代理的补课机制:先从强教师的成功轨迹里提炼结构化经验,再按不同粒度注入给学生模型。核心不是再训练,而是用层级记忆提升小模型完成工具调用任务的成功率。

阅读全文
CCTest · Blog
新墨西哥州法院再罚 Meta 5.67 亿美元:儿童安全诉讼升级
政策与监管
cctest.ai
政策与监管

新墨西哥州法院再罚 Meta 5.67 亿美元:儿童安全诉讼升级

新墨西哥州一名法官命令 Meta 在此前 3.75 亿美元罚款基础上,再支付 5.67 亿美元,使该案罚款总额达到 9.42 亿美元。裁决还要求 Meta 在州内调整未成年人产品体验,包括限制点赞数展示、夜间推送和使用时长。

阅读全文