模型会死于自己的输出吗
模型会死于自己的输出吗——从「递归训练」的数学、互联网的 AI 内容污染到「合成数据是毒药还是燃料」的十层承重测试
模型会死于自己的输出吗——从「递归训练」的数学、互联网的 AI 内容污染到「合成数据是毒药还是燃料」的十层承重测试
AGI 何时到来——从定义谱系、预言记分卡到预测市场的九层承重测试
AI 榜分还测得准吗——从 MMLU 的 29.1%、GPT-4 的 50 字符自查到 SWE-bench 三圈循环的九层承重测试
AlphaFold「解决了蛋白质折叠」——从 CASP 分数、Anfinsen 热力学假说到「AI 攻克生物学」叙事的七层承重测试
AI Agent 真的会自主规划吗——从工具调用、闭环重规划到长程自治的系统归因审计
大模型真的会在上下文里学习吗——从任务识别、标签重绑定到临时算法的六层承重测试
LLM 真的在推理吗——Chain-of-Thought 的能力、计算、轨迹与证明承重测试
AI 对齐与目标错置:Goodhart 定律作为社会版过拟合
语言作为压缩——大语言模型、人类语言与”可学习性”的信息论交叉:压缩≡语言建模真而窄、插值与结构学习是伪二分、Chomsky 与用法基础双向都过度而样本效率鸿沟是真命门、压缩=理解=智能则与计算收敛论同病
世界模型大体检——生成模型学到「世界」,还是「表面统计」?
“组合性圣杯:物理/AI 的「组合性」与衰老「可达配置空间收缩」是真同构还是漂亮类比?——主线最高风险桥的两段式建构与证否(群 V·方向三)”
过拟合的心智:刷题、内观标记与 AI 泛化