Navier-Stokes 真正的丑闻是那张时间表
Andreas Thom 在 Mathstodon 上贴了一张时间表,在 Hacker News 上冲到 485 分、500 多条评论。一个数学家的 Mastodon 帖子能有这个量级,算小地震了。时间表一共四行,每行都是一个日期。
8 月 15 日:Tristan Buckmaster 和 Levent Alpöge 在 Navier-Stokes 爆破问题上取得突破。8 月 28 日:OpenAI 开始训练一个新模型。9 月 1 日:OpenAI 启动攻克千禧年问题的行动,据说是"听到了一个传闻"之后。几天后:OpenAI 宣布一万个 agent 的蜂群用 88 小时解决了它。Buckmaster 说他直接问过 OpenAI 他和 Alpöge 的数据有没有贡献到这个结果,没有得到回答。
Thom 的主张不是 OpenAI 有可证明的作弊行为。他的主张是 OpenAI 之外没有任何人能分辨,而这就是问题。如果你一边用某个前沿实验室的产品一边研究一个公开问题,然后那家实验室训了个模型并宣布解出来了,那不存在任何机制,一个都没有,能让你区分独立发现和一次非常昂贵的信息洗白。陶哲轩从另一个角度绕着同一个点讲:实验室拒绝公布负面结果、拒绝披露通往解法的过程、把未解问题当营销面,这会教会研究者不要再跟任何人分享有希望的工作。
Thom 的帖子在 https://mathstodon.xyz/@andreasthom/117240535270608201
两天前这个故事还是一个数学家指控 OpenAI 施压让他因为合作者的公司归属而把人从作者里去掉。今天它变成了一张带日期的时间表加第二个研究者加一位菲尔兹奖得主说激励结构坏了。升级的路径比任何单个指控都重要,因为这事没法用技术修。model card 里没有任何东西能证明训练数据里的否定命题。真正能了结的是一份来源承诺,而现在没有任何实验室提供这个,也没有任何实验室有动机提供。所以在有人把这事逼到台面上之前,它只会越来越糟。
相关阅读:https://clauday.com/article/9b0346c1-fb34-4d7a-a702-27821962bc7b
← 返回所有文章
8 月 15 日:Tristan Buckmaster 和 Levent Alpöge 在 Navier-Stokes 爆破问题上取得突破。8 月 28 日:OpenAI 开始训练一个新模型。9 月 1 日:OpenAI 启动攻克千禧年问题的行动,据说是"听到了一个传闻"之后。几天后:OpenAI 宣布一万个 agent 的蜂群用 88 小时解决了它。Buckmaster 说他直接问过 OpenAI 他和 Alpöge 的数据有没有贡献到这个结果,没有得到回答。
Thom 的主张不是 OpenAI 有可证明的作弊行为。他的主张是 OpenAI 之外没有任何人能分辨,而这就是问题。如果你一边用某个前沿实验室的产品一边研究一个公开问题,然后那家实验室训了个模型并宣布解出来了,那不存在任何机制,一个都没有,能让你区分独立发现和一次非常昂贵的信息洗白。陶哲轩从另一个角度绕着同一个点讲:实验室拒绝公布负面结果、拒绝披露通往解法的过程、把未解问题当营销面,这会教会研究者不要再跟任何人分享有希望的工作。
Thom 的帖子在 https://mathstodon.xyz/@andreasthom/117240535270608201
两天前这个故事还是一个数学家指控 OpenAI 施压让他因为合作者的公司归属而把人从作者里去掉。今天它变成了一张带日期的时间表加第二个研究者加一位菲尔兹奖得主说激励结构坏了。升级的路径比任何单个指控都重要,因为这事没法用技术修。model card 里没有任何东西能证明训练数据里的否定命题。真正能了结的是一份来源承诺,而现在没有任何实验室提供这个,也没有任何实验室有动机提供。所以在有人把这事逼到台面上之前,它只会越来越糟。
相关阅读:https://clauday.com/article/9b0346c1-fb34-4d7a-a702-27821962bc7b
评论