本期按 2026 年 7 月 16 日 18:00(Asia/Shanghai)前可核验到的 X、Reddit、Hacker News 讨论信号排序。当天新提交的几篇论文尚未形成足够直接的讨论证据,因此回看 7 月 13-14 日提交、但今天仍在扩散的 3 篇论文。
01|AI 参与推翻 FDR 猜想
BH 程序在相关双尾高斯检验下可能失效。论文给出 FDR > 0.0104 的反例;作者说明证明由 GPT-5.6 Pro 得到,并逐项核验后成文。
02|Gauntlet:让多个 LLM 角色评审架构论文
五个独立专家角色先分别分析,再进入对抗式综合。在 20 篇 ISCA / HPCA 论文上,人类评审在 15 篇中更偏好 Gauntlet 的分析;单一模型消融的胜出率只有 4%。
论文:arXiv:2607.11859
讨论:Hacker News(56 分、12 条评论)。
03|Boogu-Image-0.1:统一理解、生成与编辑
四个变体覆盖 Base、Turbo、Edit、Edit-Turbo。论文报告使用 2.0862 亿张独特图像,基础模型理论训练成本约 40 万美元,并以 Apache 2.0 开源权重、代码和训练配方。




コメント
ログインするとコメントできます。