文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 775 篇文章

CCTest · Blog
GigaBrain-0.7:用三系统架构推动具身模型跨机器人泛化
机器人与物理 AI
cctest.ai
机器人与物理 AI

GigaBrain-0.7:用三系统架构推动具身模型跨机器人泛化

GigaBrain-0.7试图把理解、预测与行动统一到一个具身基础模型中,并通过三系统架构引入面向行动前模拟和评估的世界模型。论文称,该模型在超过3.7万小时异构具身数据上预训练,面向多种机器人展现出更强的任务适应性。

阅读全文
CCTest · Blog
没有总指挥的AI数学研究:多智能体系统开始自主寻找新构造
AI 科研
cctest.ai
AI 科研

没有总指挥的AI数学研究:多智能体系统开始自主寻找新构造

一项名为 Station 的开放世界多智能体环境,让来自不同模型家族的AI围绕数学研究目标自行分工、实验与协作。论文称,该系统在多个组合数学与几何问题上获得了相对既有文献的新结果,并公开了对话、证明和验证代码。

阅读全文
CCTest · Blog
MobilePA-Bench:把移动端智能体从“会点屏幕”拉回真实任务
模型评测
cctest.ai
模型评测

MobilePA-Bench:把移动端智能体从“会点屏幕”拉回真实任务

MobilePA-Bench 提出一个面向移动规划智能体的交互式评测环境,重点考察工具调用、长程规划、记忆、技能与子智能体协作。研究显示,现有前沿大模型在严格工具顺序、权限限制和运行时错误下仍不够可靠。

阅读全文
CCTest · Blog
RAG索引扩容后答案为何变了?一项面向兼容性的重复审计
模型评测
cctest.ai
模型评测

RAG索引扩容后答案为何变了?一项面向兼容性的重复审计

一项针对检索增强问答系统的研究发现,即使模型、提示词和生成控制项保持不变,扩充语料索引仍可能让系统给出不同答案。研究提出“快照兼容性审计”,用于区分真正的索引影响与模型自身的随机波动。

阅读全文
CCTest · Blog
ReWorld:用分层注意力与地标记忆破解交互式世界模型的长程难题
世界模型
cctest.ai
世界模型

ReWorld:用分层注意力与地标记忆破解交互式世界模型的长程难题

ReWorld 将短期动作控制与长期场景记忆分开训练,并在推理时通过有限 KV 缓存和基于位姿的地标检索控制计算量。论文还通过统一动作尺度、回环轨迹和蒸馏技术,让同一模型兼顾高质量生成与实时交互。

阅读全文