文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 795 篇文章

CCTest · Blog
小米发布 Xiaomi-Robotics-1:用 10 万小时真实轨迹扩展机器人 VLA 模型
机器人与物理 AI
cctest.ai
机器人与物理 AI

小米发布 Xiaomi-Robotics-1:用 10 万小时真实轨迹扩展机器人 VLA 模型

Xiaomi-Robotics-1 试图把大模型的“规模化法则”引入机器人学习:用超过 10 万小时真实操作轨迹预训练,再对齐真实机器人和自然语言指令。实验显示,更大的数据和模型规模能带来更低动作预测误差,并提升真实机器人任务成功率。

阅读全文
CCTest · Blog
让机器人“按自己的坐标系看世界”:Robot-Centric Pointmaps 改进 VLA 泛化
机器人与物理 AI
cctest.ai
机器人与物理 AI

让机器人“按自己的坐标系看世界”:Robot-Centric Pointmaps 改进 VLA 泛化

KAIST AI 提出的 Robot-Centric Pointmaps 试图解决 VLA 模型中相机视角与机器人动作坐标系不一致的问题。它把场景点的三维坐标直接编码到机器人坐标系下,同时保留类似图像的二维网格结构,便于接入现有 VLA。

阅读全文
CCTest · Blog
AV-Flamingo:把音频、图像与长视频真正连起来的开放多模态模型
多模态
cctest.ai
多模态

AV-Flamingo:把音频、图像与长视频真正连起来的开放多模态模型

NVIDIA 推出的 AV-Flamingo 面向长而复杂的真实世界音视频场景,不再只盯着短片段,而是强调跨模态、跨时间的联合推理。它通过大规模数据、分阶段训练和带时间戳的链式思考,在多项基准上表现出很强竞争力。

阅读全文