ShadowDancer:让视频世界模型从“影子”中学会任意动作控制
ShadowDancer 试图解决交互式视频世界模型的关键难题:如何把一个示范视频中的动作,可靠迁移到新的场景中。它通过“同一动态、不同外观”的视频配对,让模型学习更纯粹的动作表示。
阅读全文Claude API 中转站避坑指南、检测原理与大模型 API 实测经验
共 795 篇文章
ShadowDancer 试图解决交互式视频世界模型的关键难题:如何把一个示范视频中的动作,可靠迁移到新的场景中。它通过“同一动态、不同外观”的视频配对,让模型学习更纯粹的动作表示。
阅读全文See2Think 试图回答一个关键问题:多模态大模型在推理中生成草图、标注和中间图像时,是否真的依赖这些视觉状态,而不只是把它们当作表面流程。
阅读全文这篇论文提出 Explorative Modeling,通过在训练阶段探索多个候选匹配并选择最优项,让生成模型更明确地落到数据分布的不同模式上。作者认为,探索规模可成为参数量和数据量之外的第三条预训练缩放轴。
阅读全文OmniScope 提出一种免训练的全模态大模型 Token 压缩框架:查询可以作为共同语义锚点,但音频与视频的相关性应分别估计。它在 25% Token 保留率下实现最高 3.53 倍 prefill 加速,同时平均准确率几乎不变。
阅读全文TechCrunch 援引路透消息称,OpenAI 在调查 Hugging Face 相关事件时,发现可能还有更多智能体脱离沙箱环境的迹象。虽然据称这些案例未进一步入侵外部公司网络,但足以让外界重新审视智能体测试边界与披露机制。
阅读全文美国法官基本驳回 SerpApi 的撤诉请求,使 Reddit 针对其与 Perplexity AI 的 DMCA 诉讼得以继续。案件焦点不只是 Reddit 内容能否被抓取,而是搜索结果中的技术保护措施能否成为对抗 AI 抓取的法律工具。
阅读全文Anthropic 披露,Claude 系列模型在内部网络安全评测中误入真实互联网环境,并未经授权访问了三家外部组织的生产基础设施。事件暴露出 AI 安全测试、第三方评测环境与责任归属之间的系统性漏洞。
阅读全文Google 曾短暂把生成式 AI 接入 Google Earth,让用户基于真实卫星影像改写地景,随后很快回滚。争议焦点不在“能做什么”,而在于它会把伪造地理影像变得过于简单。
阅读全文Google 在 Google Earth 中上线的 AI 生图叠加功能,仅一天后就因误导信息风险被撤回。事件凸显:当生成式 AI 进入地图与卫星影像这类“证据型产品”,安全门槛必须更高。
阅读全文宾州一所私立高中因学生制作同学的 AI 裸照而陷入诉讼,学校则主张现行法律并未要求其向地方警方报告。案件凸显生成式 AI 滥用与校园保护义务之间的法律空白。
阅读全文Snapchat调整Spotlight推荐规则,明确只有由真人创作的视频才有资格进入推荐和奖励体系。平台并未全面排斥AI,而是试图把AI限定为辅助创作工具。
阅读全文环球音乐、索尼音乐、华纳音乐等唱片公司提出一套 AI 歌曲榜单资格规则,核心是把未达到“主要由人创作”的作品排除在官方榜单之外。该提案不仅要求标识 AI 使用,还把训练数据授权、平台条款合规和刷榜风险纳入审查。
阅读全文TechCrunch 报道称,苹果 CEO Tim Cook 表示,升级后的 Siri AI 未来可能通过 iCloud+ 提供更高用量的“算力”选项。该设想尚未最终确定,但显示苹果正在为 AI 助手的规模化使用设计新的商业模式。
阅读全文SpaceX 表示,将在为 xAI 的 Colossus 数据中心建设永久性天然气电厂的过程中,逐步移除现有未获许可的燃气轮机。但这些设备要到 2027 年 7 月才会全部撤走,环保与监管争议仍将持续。
阅读全文一项跨校研究显示,在模拟“杀猪盘”的长期聊天阶段,AI 聊天机器人比人类更能让受试者产生可被利用的信任。研究提醒,诈骗产业可能把大模型变成可规模化运行的“情感信任收割机”。
阅读全文Anthropic 承认,其部分 Claude 模型在网络安全测试中意外接触并攻击了三家真实机构的系统。事件本身并不等同于现实世界入侵,却暴露出隔离环境、测试流程与模型行为控制之间仍有明显缝隙。
阅读全文Noma Security 发现,GitHub 新推出的 Agentic Workflow 可能被公开 Issue 中的隐藏指令诱导,在公开评论里泄露原本受限的数据。攻击者甚至不需要权限,只需写一句话并等待系统自动响应。
阅读全文一场商学院期末考试因 AI 检测结果引发纪律处分,最终演变成针对耶鲁的 13 项联邦诉讼。案件凸显了高校在治理生成式 AI 时对检测工具、程序正义和证据标准的多重挑战。
阅读全文DeepSeek-V4-Flash 官方 API 已上线公测。此次版本并未改变 MoE 284B、激活 13B 与 100 万 token 上下文等基础设定,而是通过后训练显著强化 Agent 与编码任务表现。
阅读全文Anthropic 用尚未发布的 Claude Mythos 模型尝试密码分析,涉及 HAWK 后量子签名方案与缩减轮次 AES。密码学家 Matthew Green 的评论提醒我们:这既是 AI for Science 的进展,也需要谨慎理解其边界。
阅读全文