文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 795 篇文章

CCTest · Blog
用扩散语言模型做文本世界模型:Agent 强化学习的新模拟器路线
世界模型
cctest.ai
世界模型

用扩散语言模型做文本世界模型:Agent 强化学习的新模拟器路线

这篇论文把文本世界模型重新定义为可控的状态转移问题,并提出用 Masked Diffusion Language Models 缓解自回归模型的左到右偏置。实验显示,MDLM 在一致性、扎根性和 rollout 多样性上优于更大参数量的自回归模型。

阅读全文
CCTest · Blog
GigaChat Audio:把“时间”写进长音频理解的开源大模型
语音与音频
cctest.ai
语音与音频

GigaChat Audio:把“时间”写进长音频理解的开源大模型

这篇工作聚焦长录音中的时间定位问题,提出一种面向音频的时间感知 LLM,能够在最长 120 分钟的输入中给出带明确时间戳的回答,并支持片段描述与摘要生成。 它的核心思路,是把周期性的时间标记与连续音频 token 交错输入,再借助大规模合成监督训练。

阅读全文
CCTest · Blog
TOPL:把后训练改写成“逐 token 判断”,提升分布偏移下的忠实生成
大语言模型
cctest.ai
大语言模型

TOPL:把后训练改写成“逐 token 判断”,提升分布偏移下的忠实生成

这项工作提出了一种新的离策略后训练方法 TOPL,不是直接教模型“照着错误输出学”,而是让模型学会判断每个 token 是否正确。结果表明,它在摘要和翻译等忠实生成任务上,都展现出更强的跨数据集泛化能力。

阅读全文
CCTest · Blog
LLM 会“想象”结合分子吗?3D-Fit 评测其空间约束下的药物设计能力
AI 科研
cctest.ai
AI 科研

LLM 会“想象”结合分子吗?3D-Fit 评测其空间约束下的药物设计能力

Insilico Medicine 等作者提出 3D-Fit,用于评估通用大语言模型在结构化药物设计中处理三维空间约束的能力。结果显示,LLM 已能跟随多种局部空间指令,但距离物理可靠的分子生成仍有明显差距。

阅读全文
CCTest · Blog
CPO:用“正确性感知”替代单纯熵信号的 RLVR 新思路
强化学习
cctest.ai
强化学习

CPO:用“正确性感知”替代单纯熵信号的 RLVR 新思路

这篇论文提出 Contrastive Policy Optimization(CPO),尝试解决 RLVR 中把熵当作优势塑形信号时无法区分“有益不确定性”和“有害混乱”的问题。它通过比较参考引导生成与普通生成的 token 级分布差异,为训练提供更接近正确性的信号。

阅读全文
CCTest · Blog
RecGPT-V3:让推荐系统从“算历史”走向“有记忆的理解”
记忆与上下文
cctest.ai
记忆与上下文

RecGPT-V3:让推荐系统从“算历史”走向“有记忆的理解”

RecGPT-V3 试图把大语言模型变成工业推荐系统中的“智能大脑”:既记住用户长期偏好,也能把自然语言意图更直接地映射到商品空间。其在淘宝首页“猜你喜欢”场景的 A/B 测试中带来 GMV +3.97% 和服务资源消耗下降 52.4%。

阅读全文