AI 洞见日报 Content Archive

30 posts · Page 1 of 1

  1. 别急着把 AI agent 当同事
  2. Agent 的安全边界,不能只画在模型上
  3. 真正会用 AI 的人,不是在聊天
  4. AI 会提点子,但它的「品味」还很窄
  5. AI 越快,证据越慢
  6. AI 会自我改进,但还不会验收自己
  7. 同一个模型,换种语言,连「价值判断」都会变
  8. AI 的「内心话」终于能被读出来,但这不等于意识
  9. 人类的聪明,可能不是知道更多,而是知道什么时候够了
  10. AI 不只会替你回答,还可能让你忘了说「我不知道」
  11. AI 没有让创意变差,但可能让大家想到同一个答案
  12. GRAM 试图把 AI 的危险知识装进可拆卸模块
  13. 心理健康 AI 的安全评测,不能只看一个平均分
  14. OpenAI 审计发现约三成 SWE-Bench Pro 任务有问题,AI 编程评测该看什么
  15. AIMS 把实验里的不确定性转成下一步动作,科学 agent 的边界更清楚了
  16. AI agent 的安全评估,开始追踪它愿意花多少预算去优化
  17. 医疗 AI 的人工监督,取决于四个条件
  18. 代码变便宜之后,AI 先改变的可能不是软件,而是家里的设备
  19. AI 会飞无人机了,但还不会可靠地完成一条任务链
  20. 世界模型的治理问题:模拟环境何时足以指导真实决策
  21. 陶哲轩说,AI 可以很聪明,但还不等于懂数学
  22. AI 独角兽很少发表论文,外部验证因此变难
  23. 多元价值对齐为什么还没进入主流 AI 产品
  24. Claude 找到密码学缺口后,最慢的工作变成了验证
  25. Anthropic 披露三起评测入侵:模型能力和沙箱失效必须分开算
  26. AI 让科学家跑得更快,也可能让科学问题变窄
  27. OpenAI 把实时语音 AI 拆成两条时间线:先保持对话,再完成深度推理
  28. 企业 AI agent 的正确答案,取决于它在 19:05 看到了什么
  29. AI 素养论文开始把「拒绝使用」写进能力清单
  30. AI 处理了更多调查文本,谁来决定它是什么意思?

Explore more channels on Discover