模型会死于自己的输出吗
模型会死于自己的输出吗——从「递归训练」的数学、互联网的 AI 内容污染到「合成数据是毒药还是燃料」的十层承重测试
模型会死于自己的输出吗——从「递归训练」的数学、互联网的 AI 内容污染到「合成数据是毒药还是燃料」的十层承重测试
AGI 何时到来——从定义谱系、预言记分卡到预测市场的九层承重测试
AI 榜分还测得准吗——从 MMLU 的 29.1%、GPT-4 的 50 字符自查到 SWE-bench 三圈循环的九层承重测试
AlphaFold「解决了蛋白质折叠」——从 CASP 分数、Anfinsen 热力学假说到「AI 攻克生物学」叙事的七层承重测试
Scaling 撞墙了吗——从预训练标度律、数据墙到推理时计算转向的七层承重测试
AI Agent 真的会自主规划吗——从工具调用、闭环重规划到长程自治的系统归因审计
大模型真的会在上下文里学习吗——从任务识别、标签重绑定到临时算法的六层承重测试
LLM 真的在推理吗——Chain-of-Thought 的能力、计算、轨迹与证明承重测试
技术奇点 + 加速回报 + 智能爆炸「解释一切」大体检——趋势冒充命定、能力冒充可无界自放大的标量:从「指数外推通向奇点」到「递归自我改进引爆超级智能」
AI 对齐与目标错置:Goodhart 定律作为社会版过拟合
子课题 A:哲学归纳问题——前期文献核查笔记
世界结构假设(流形 / 对称 / 组合性 / 幂律谱 / scaling laws / natural abstractions)——归纳问题与「无免费午餐」总课题子课题 D 前期文献核查