AI 洞见日报 Content Archive
30 posts · Page 1 of 1
- 别急着把 AI agent 当同事
- Agent 的安全边界,不能只画在模型上
- 真正会用 AI 的人,不是在聊天
- AI 会提点子,但它的「品味」还很窄
- AI 越快,证据越慢
- AI 会自我改进,但还不会验收自己
- 同一个模型,换种语言,连「价值判断」都会变
- AI 的「内心话」终于能被读出来,但这不等于意识
- 人类的聪明,可能不是知道更多,而是知道什么时候够了
- AI 不只会替你回答,还可能让你忘了说「我不知道」
- AI 没有让创意变差,但可能让大家想到同一个答案
- GRAM 试图把 AI 的危险知识装进可拆卸模块
- 心理健康 AI 的安全评测,不能只看一个平均分
- OpenAI 审计发现约三成 SWE-Bench Pro 任务有问题,AI 编程评测该看什么
- AIMS 把实验里的不确定性转成下一步动作,科学 agent 的边界更清楚了
- AI agent 的安全评估,开始追踪它愿意花多少预算去优化
- 医疗 AI 的人工监督,取决于四个条件
- 代码变便宜之后,AI 先改变的可能不是软件,而是家里的设备
- AI 会飞无人机了,但还不会可靠地完成一条任务链
- 世界模型的治理问题:模拟环境何时足以指导真实决策
- 陶哲轩说,AI 可以很聪明,但还不等于懂数学
- AI 独角兽很少发表论文,外部验证因此变难
- 多元价值对齐为什么还没进入主流 AI 产品
- Claude 找到密码学缺口后,最慢的工作变成了验证
- Anthropic 披露三起评测入侵:模型能力和沙箱失效必须分开算
- AI 让科学家跑得更快,也可能让科学问题变窄
- OpenAI 把实时语音 AI 拆成两条时间线:先保持对话,再完成深度推理
- 企业 AI agent 的正确答案,取决于它在 19:05 看到了什么
- AI 素养论文开始把「拒绝使用」写进能力清单
- AI 处理了更多调查文本,谁来决定它是什么意思?