💬我花了周末的大部分时间,和完成这项研究工作的团队进行交流。 💬Seb 以及团队里的所有人,在整个过程中都秉持诚信、大度的态度开展工作。 💬一开始,我们以为另一

图片

无图片

正文

💬我花了周末的大部分时间,和完成这项研究工作的团队进行交流。 💬Seb 以及团队里的所有人,在整个过程中都秉持诚信、大度的态度开展工作。 💬一开始,我们以为另一支团队同样解决了这个难题。我们原本希望能够开展合作,联合对外发布成果。 💬当我们了解到,他们只完成了欧拉方程问题的证明,并没有解决纳维 - 斯托克斯方程问题之后,我们主动提出可以让他们率先发布成果,并且建议由他们来摘取这项荣誉;我们还提出可选方案,让 Tristan 作为第一作者,来重写 OpenAI 的证明论文。 💬我们认为很难向 Levent(Anthropic 的员工)提出同等安排,因为他并不愿意和我们沟通、协调。不过我们当时也愿意考虑其他可行方案。 💬我们原本非常希望双方能够做好协同。即便另一支团队始终不和我们沟通,我们也没有急于发布成果。 💬这支团队还拿出毫无依据的抄袭指控来对我们进行施压。 💬如今我们看到了他们的研究成果,双方采用的研究方法看起来并不相同。同样值得注意的一点是,我们最新的模型还可以解决许许多多其他的数学难题。 💬确实,我们着手开展这项研究,是因为上周网络上流传消息,称 Anthropic 的模型已经破解了一个千禧年大奖难题,我们很好奇我们自己的模型能不能做到同样的事情。 💬我想澄清几件事情: 💬我想澄清几件事情: 💬1)这张截图是我主动联系 Levent,想要协调双方成果发布时间的沟通记录。我希望从这条消息里能够清晰看出,我们在接触时怀揣最大的诚意。 💬2)我从来没有要求,将 Levent 从他自己成果的作者名单中移除,我的原文内容也能印证这一点。 💬我在和 Tristan 通话的过程中才惊讶得知,他们仅仅证明了欧拉方程,并没有解决纳维 - 斯托克斯方程;了解这件事之后,我们集体头脑风暴,探讨后续可行方案。 💬我们讨论的其中一个方案,是让 Tristan 作为第一作者,重写 OpenAI 关于纳维 - 斯托克斯方程的证明。 💬正是在这个背景下,我说 “如果 Levent 不是 Anthropic 的员工,事情会简单很多”,因为我认为,由 Anthropic 的员工作为 OpenAI 研究成果的作者,这件事并不合适。 💬重点是,对方承认在欧拉爆破问题的证明过程中使用了 Anthropic 内部模型;所以我认为,不能把 Levent 看作独立的学术研究者。 💬我原本还准备提出另一个方案,但是对话被中途打断:我们可以开放内部模型的访问权限,让他们尝试完善自己的证明,补齐欧拉方程和纳维 - 斯托克斯方程之间的论证缺口。 💬再说一次,我当时并不清楚,该如何处理把 OpenAI 内部知识产权的访问权限开放给 Anthropic 员工这件事。 💬3)我再直白重申一遍:正如我的文字清楚写明,以及通话中我所说的那样,OpenAI 的初衷是尽一切可能,肯定他们取得的数学成果,以及他们在欧拉方程课题上付出的艰辛努力。 💬在通话里,我立刻遭遇一连串诋毁言论,其中还包含直接的威胁:如果我们对外公布纳维 - 斯托克斯方程相关成果,他会立刻联系媒体,抛出一连串毫无根据的指控。 💬我驳斥了全部这些指控,而他回复 “无论你做什么,我都不会信任你”。 💬我很不解,为什么有人会把一件本可以用来共同庆祝他们成果的好事,演变成这样一场争执。也正是在这个时刻,我说我无法理解,为什么有人会因为毫无根据的指控,拿自己的职业生涯冒险。 💬说实话,在那一刻,我是想要体谅他,并且做最后一次努力,争取让他们拿到所有应得的荣誉。 💬我为这次极其不妥的措辞深表歉意,这句话的含义和我真正想要表达的内容完全相反。顺带一提,我在现场就收回了这段话。 💬4)整体来说,从个人层面,开展这些对话的过程非常艰难。尽管我多次邀约,Levent 始终拒绝参加任何会议。 💬正如 Sholto Douglas 所说,未来 Anthropic 和 OpenAI 之间需要建立协同机制;我感觉自己相当于在代表 OpenAI,和 Anthropic 进行代理谈判,但这名 Anthropic 员工却拒绝直接参与沟通。 💬很抱歉周日来打扰你(如果事情不重要,我不会找你的),我们能不能聊聊? 💬我想对你尽可能坦诚,我们希望能够协商双方成果的发布时间。 💬我们内部复现了纳维 - 斯托克斯方程的相关证明,这是一份非常非正式的内部模型输出,几乎没有人工参与。但我们充分认可这件事的重要性:这项历史性成果的荣誉,全部属于你和 Tristan。我们愿意和你共享所有信息,包含所有人类提示词和全部细节。

💬一些更具技术性的说明: 💬(a) 推特上广泛流传 Anthropic 已经解决两个千禧年难题的传闻,因此我们启动了针对千禧年难题的研究工作。我们的目标是验证我们的系统是否同样能够完成这项令人瞩目的成果,尤其是我们对于内部模型近期能力大幅提升感到振奋,相关细节已经发布在我们的博客文章之中。 💬(b) 在他们昨晚公开发布成果之前,我们从未看到过他们的任何研究内容。事后回看,可以发现双方的证明存在显著差异,哪怕是欧拉方程相关部分,得出的精确结论也不相同,分为受迫情形与非受迫情形。同样值得一提,我们的团队主体由数学家、物理学家以及计算机科学家构成,他们大多扎根学术界,尊重千禧年难题的学术地位与严谨性。 💬(c) Levent 在周三主动联系了一名 OpenAI 员工。因为他在推特发布大量帖子,看上去代表 Anthropic,并且使用 Anthropic 内部模型,我们判断这个项目至少一部分属于 Anthropic 的项目。另外,Levent 近期发布的多条推文,让我们认为他们至少已经解决一个千禧年难题,并且很快就会对外发布。 💬(d) 关于我方人员参与的程度:尽管有一群人员参与这项工作,但是我们团队整体并不具备流体动力学以及纳维 - 斯托克斯方程方向的专业研究背景,因此没办法在数学内容层面做出实质性贡献。我们多数人的参与,只是为了初步尝试,使用多智能体技术去求解多个千禧年难题。

总体总结

主题正文

  1. 💬当我们了解到,他们只完成了欧拉方程问题的证明,并没有解决纳维 - 斯托克斯方程问题之后,我们主动提出可以让他们率先发布成果,并且建议由他们来摘取这项荣誉;
  2. 💬确实,我们着手开展这项研究,是因为上周网络上流传消息,称 Anthropic 的模型已经破解了一个千禧年大奖难题,我们很好奇我们自己的模型能不能做到同样的事情。
  3. 💬正是在这个背景下,我说 “如果 Levent 不是 Anthropic 的员工,事情会简单很多”,因为我认为,由 Anthropic 的员工作为 OpenAI 研究成果的作者,这件事并不合适。
  4. 💬我原本还准备提出另一个方案,但是对话被中途打断:我们可以开放内部模型的访问权限,让他们尝试完善自己的证明,补齐欧拉方程和纳维 - 斯托克斯方程之间的论证缺口。
  5. 💬3)我再直白重申一遍:正如我的文字清楚写明,以及通话中我所说的那样,OpenAI 的初衷是尽一切可能,肯定他们取得的数学成果,以及他们在欧拉方程课题上付出的艰辛努力。
  6. 事后回看,可以发现双方的证明存在显著差异,哪怕是欧拉方程相关部分,得出的精确结论也不相同,分为受迫情形与非受迫情形。
  7. 因为他在推特发布大量帖子,看上去代表 Anthropic,并且使用 Anthropic 内部模型,我们判断这个项目至少一部分属于 Anthropic 的项目。
  8. 💬(d) 关于我方人员参与的程度:尽管有一群人员参与这项工作,但是我们团队整体并不具备流体动力学以及纳维 - 斯托克斯方程方向的专业研究背景,因此没办法在数学内容层面做出实质性贡献。