跳至正文

模型会死于自己的输出吗

模型会死于自己的输出吗——从「递归训练」的数学、互联网的 AI 内容污染到「合成数据是毒药还是燃料」的十层承重测试

AGI 何时到来

AGI 何时到来——从定义谱系、预言记分卡到预测市场的九层承重测试

AI 榜分还测得准吗

AI 榜分还测得准吗——从 MMLU 的 29.1%、GPT-4 的 50 字符自查到 SWE-bench 三圈循环的九层承重测试

LLM 真的在推理吗

LLM 真的在推理吗——Chain-of-Thought 的能力、计算、轨迹与证明承重测试

语言作为压缩

语言作为压缩——大语言模型、人类语言与”可学习性”的信息论交叉:压缩≡语言建模真而窄、插值与结构学习是伪二分、Chomsky 与用法基础双向都过度而样本效率鸿沟是真命门、压缩=理解=智能则与计算收敛论同病