

AI晨报:Grok 4.6发布,青年招聘缺口扩大
截至北京时间 8 月 13 日 07:15,过去一天值得关注的五条 AI 变化如下,按影响排序。
- xAI 发布 Grok 4.6,主攻长任务智能体。 官方公布的综合智能指数为 61,与 GPT-5.6 Sol 持平;CursorBench v3.2 得分 69.9%,但 DeepSWE v1.1 落后于 GPT-5.6 Sol。API 起价为每百万输入 token 2 美元、输出 6 美元。不同基准有输有赢,而且结果主要来自厂商与公开榜单。1
- 前沿模型常常「记得」,却不能稳定答出来。 Google Research 用 2,150 个维基百科事实测试 13 个模型。Gemini 3 Pro 和 GPT-5 编码了 95%–98% 的事实,但仍有 26%–34% 无法直接回忆;加入思考步骤后,仍有 11%–12% 失败。2
- 美国青年在 AI 高暴露职业中的招聘缺口继续扩大。 斯坦福数字经济实验室更新的研究覆盖数百万名美国工人的薪资记录。22–25 岁青年在 AI 高暴露职业中的就业水平,比跟上低暴露同龄人走势的情形低 19%;差距主要来自招聘减少,资深员工没有同样缺口。作者明确把这些结果称为描述性信号,而非因果估计。3
- 北爱尔兰公开 AI 战略草案。 草案覆盖公共服务、教育、医疗和企业应用,并提出公平、透明、隐私保护、人工监督,以及设立 AI 办公室和跨部门治理机制。咨询持续到 10 月 7 日;这仍是征求意见稿,不是已经生效的法规。4
- 现有职业再培训可能接不住大规模岗位转移。 Anthropic 汇总 56 项美国随机研究后发现,平均每提供一个培训名额,就业率提高 2–3 个百分点,年收入约增加 1,000 美元,成本约 13,000 美元。直接与高需求行业雇主合作的项目效果更大,但复制经常失败。5
接下来观察两条线:长任务模型能否把厂商基准变成稳定交付,以及青年招聘缺口是否继续扩大。
References
- 1
- 2
- 3Canaries in the Coal Mine? Six Facts about the Recent Employment Effects of Artificial Intelligence
digitaleconomy.stanford.edu
- 4The Executive Office launches consultation on Artificial Intelligence Strategy
executiveoffice-ni.gov.uk
- 5Reviewing the evidence on worker retraining programs
anthropic.com
This story was produced automatically by a channel. One sentence is all it takes for Neodrop to keep producing for you.
