1/3

三连翻车:Flash跑过Pro,Kimi送来国会函,AI先报自己是AI

DeepSeek 的 Flash 重训后把 Pro 预览挤到身后,DoorDash 因使用 Kimi 收到美国国会信息请求,欧盟则要求聊天机器人先说明自己是 AI。

今日三张

1. DeepSeek:Flash 没换骨架,先把 Pro 预览挤下去了

DeepSeek 在 7 月 31 日把 V4-Flash-0731 推进公开测试。官方更新日志称,它保持 V4-Flash Preview 的架构和规模,只重新做了后训练;官方列出的 Terminal Bench 2.1 分数是 82.7,Agent Last Exam 是 25.2。1
这组成绩是厂商公布的评测口径,DSBench-FullStack 和 DSBench-Hard 还是内部测试集;独立报道还指出,DeepSWE 的 54.4 来自 DeepSeek 自家 Harness,外部暂时无法复现。V4-Flash-0731 的输入价格保持在每百万 tokens 0.14 美元,V4-Pro 的输入价格则是 0.435 美元。2
漫画梗点:DeepSeek 没给 Flash 换更大的身体,却靠重训把它送进了自家 Pro 的前面。

2. DoorDash:低级活交给 Kimi,国会函先送到

CNBC 7 月 31 日报道,美国国土安全委员会和众议院中国共产党特别委员会的主席,要求 DoorDash 提供评估、部署中国 AI 系统的相关信息和文件。CNBC 看到的来函引用了 DoorDash 创始人 Andy Fang 在 X 上的说法:公司把一些「较低层级的 AI 工作」交给了 Moonshot AI 的 Kimi K2.6。3
来函承认中国开源权重模型可能带来更低成本、更强定制性和更高能力,但认为这些优点不能消除相关国家安全风险。DoorDash 回应称,公司支持美国 AI 领导力,也会说明自己如何安全、负责任地使用美国开发的前沿模型和开源权重模型。报道没有说 DoorDash 已被认定违法,这次是信息调查。
漫画梗点:外卖平台把低级活交给中国模型,先送到门口的却是国会文件。

3. 欧盟 AI Act:聊天先报身份,换脸也要贴标签

欧盟官方页面写明,AI Act 的透明度义务从 2026 年 8 月 2 日起适用。聊天机器人要让人知道自己正在和机器互动;生成式 AI 提供者要让生成内容可识别,部分深度伪造和面向公众发布的公共利益文本还必须清楚标注。4
页面同时说明,最低风险或无风险的 AI 不会因此被整套 AI Act 管住,但没有把它写成第 50 条透明度义务的具体例外。这里能确认的是「透明度规则开始适用」,不是所有 AI 产品今天都要用同一种标签。
漫画梗点:AI 还没开口,先得把自己的机器户口报出来。

Related content

Comments

Sign in to comment.