文章与教程

Claude API 中转站避坑指南、检测原理与大模型 API 实测经验

共 791 篇文章

CCTest · Blog
退役 GPU 还能做什么?DumpsterCluster 探索用二手硬件运行 LLaMA-70B
推理与部署
cctest.ai
推理与部署

退役 GPU 还能做什么?DumpsterCluster 探索用二手硬件运行 LLaMA-70B

牛津大学研究团队用 128 张二手 GPU 搭建 DumpsterCluster,验证了退役硬件服务大模型推理的可行性。研究同时指出,低采购成本并不等于低总成本,电价与电力碳强度将决定这类方案是否真正划算。

阅读全文
CCTest · Blog
从物理到自指:智能体AI的认知能力为何会带来新风险
AI 安全
cctest.ai
AI 安全

从物理到自指:智能体AI的认知能力为何会带来新风险

一篇来自上海人工智能实验室的研究,将智能体AI的潜在风险按照物理认知、社会认知和自指认知划分为三个层次。研究关注的核心并非系统是否“像人”,而是认知能力扩展后,人类的能动性、自主性与控制能力是否会被削弱。

阅读全文
CCTest · Blog
文档抽取的选择性风险控制:为什么“低置信度就复核”还不够
模型评测
cctest.ai
模型评测

文档抽取的选择性风险控制:为什么“低置信度就复核”还不够

一项针对真实收据字段抽取的研究发现,常见的置信度阈值方法可能在文档级相关性、评分泄漏和分数并列等问题下失去风险控制。研究进一步提出从平均风险到文档级 PAC 证书的有效性阶梯,并说明何时应使用条件化校准。

阅读全文
CCTest · Blog
SPARGen:把三维重建、稠密对应与空间推理统一到多模态生成框架中
多模态
cctest.ai
多模态

SPARGen:把三维重建、稠密对应与空间推理统一到多模态生成框架中

SPARGen 尝试用一个原生多模态生成模型处理多类空间任务,将三维重建、稠密对应和空间推理都转化为由指令驱动的生成问题。它的价值不在于单点任务刷新纪录,而在于让不同空间监督共同塑造同一套表示。

阅读全文
CCTest · Blog
ChatGPT 桌面端推出 Computer History:让 AI 记住你的操作轨迹
记忆与上下文
cctest.ai
记忆与上下文

ChatGPT 桌面端推出 Computer History:让 AI 记住你的操作轨迹

OpenAI 正在 macOS 版 ChatGPT 桌面应用中引入 Computer History,让 ChatGPT 和 Codex 能参考用户近期的点击、输入和应用活动。它不像 Windows Recall 那样保存截图,但仍把个人电脑使用痕迹推向了更敏感的 AI 记忆场景。

阅读全文
CCTest · Blog
StateFlow:把视频预演从“一次生成”改成可编辑的3D世界状态
世界模型
cctest.ai
世界模型

StateFlow:把视频预演从“一次生成”改成可编辑的3D世界状态

StateFlow 提出一种以“持久3D世界状态”为核心的生成式预演框架,用于电影、游戏、建筑和城市设计等场景。它不再把视频一次性生成完,而是先构建可编辑世界,再围绕状态演化和相机访问进行迭代。

阅读全文