跳到正文
热点事件持续更新

OpenAI 发布前沿模型数学成果,AGMAI 独立性引争议

10 篇报道10 个报道来源27 分钟前更新

先了解这件事

AI 综述

OpenAI 在 GitHub 仓库 openai/math 发布一批由未发布内部前沿模型产出的数学结果,共 722 篇手稿、372 个结果族。OpenAI 称依据普林斯顿高等研究院(IAS)数学与人工智能独立顾问组(AGMAI)的建议和公开推荐确定发布方式。The Verge 报道称,AGMAI 表示其中包含对数百个长期开放数学问题的解答;OpenAI 的 Tibo 称模型确实解决了一些重要数学问题。 据 Testing Catalog,绝大多数结果用同一流程获得,平均每项约用三小时 ChatGPT Pro thinking 算力,评估期间模型共被提出约 4000 个问题;例外包括黎曼 zeta 函数零点无区域工作和 CM 阿贝尔簇的 Hodge 猜想证明,其中 Re(s)>11/12 零点无区域的文稿经人工编辑提高可读性。仓库还包含部分证明的 Lean 形式化、10 份模型推理摘要和尝试题目统计。 The Verge 此前报道,OpenAI 与九位数学家组成 AGMAI,称该组独立运作、可公开质疑公司,但不少数学家因 OpenAI 的发布方式误以为它是 OpenAI 任命的机构,争议集中在该组的独立性与发布方式是否造成误解。

AI 根据报道生成 · 18 分钟前更新

事件进展

2 个进展

  1. 10月6日 20:00 · 9 篇报道
    OpenAI 用内部前沿模型生成并发布大量数学新结果
    OpenAI:官网动态:OpenAI 发布内部前沿模型产出的数学研究成果
  2. 9月29日 01:00 · 1 篇报道
    OpenAI成立数学AI顾问组AGMAI引争议
    The Verge:AI:OpenAI 组建数学顾问组 AGMAI,数学家质疑其独立性与发布方式

报道时间线

沿着报道,了解事件的不同侧面。

10月7日
  1. IT之家
    OpenAI 发布 722 份手稿,公布未发布前沿模型解答数百个数学难题

    OpenAI 公布一批包含 722 份手稿、涵盖 372 个结果家族的文件,展示某款未发布前沿模型对数百个未解决数学问题的解答,成果发布在 GitHub 代码仓库中。

  2. Rohan Paul
    OpenAI 公开 722 份数学论文,覆盖 372 项研究结果

    OpenAI 发布其内部前沿模型产出的数学论文合集,共 722 份手稿、归入 372 个结果族,仓库地址 https://github.com/openai/math。作者补充:模型在测试中被给予约 4K 个研究问题,输出经分组过滤得到这些结果族,几乎全部来自同一标准设置,每个结果平均消耗相当于 3 小时 ChatGPT Pro 思考的算力。OpenAI 引用独立数学与人工智能咨询组的建议来决定发布方式,部分结果尚未有 Lean 形式化,仓库将持续更新。

  3. 马东锡 NLP
    OpenAI 发布 math 项目,数学问题疑似被攻克

    OpenAI 发布了 Openai/math 项目,暗示数学问题或一切可验证的问题已被其解决。作者指出 OpenAI 模型耗尽了其 Pro 账户的全部 token,偏离主线任务并启动大量 subagent 执行无意义的测试任务,最终认为这一切是"为了 verify 而 verify"。

  4. The Verge:订阅版科技
    OpenAI 发布 722 篇数学成果手稿,含数百个开放问题解答

    OpenAI 在 GitHub 仓库发布一批 722 篇手稿,涵盖 372 个结果族,由一个未发布的 frontier 模型产出,独立顾问组织 AGMAI 称其中包含对数百个长期开放数学问题的解答。

  5. Thomas Wolf
    Thomas Wolf 转发 OpenAI 发布前沿模型产出的数学成果

    OpenAI 发布由内部前沿模型产出的一系列新数学结果,并已在 GitHub 开放:https://github.com/openai/math。发布方式参考了普林斯顿高等研究院数学与人工智能独立咨询组的建议和公开推荐。Thomas Wolf 评论称“没有炒作,只有结果”。

  6. Testing Catalog
    OpenAI 发布内部前沿模型求解数学新结果的仓库

    OpenAI 在 GitHub 开源仓库 openai/math 发布由内部未发布前沿模型产出的一系列新数学结果。绝大多数结果用同一流程获得,平均每项结果使用约三小时 ChatGPT Pro thinking 算力,评估期间模型共被提出约 4,000 个问题。OpenAI 就结果发布咨询了 IAS 的数学与人工智能独立顾问组;例外包括黎曼 zeta 函数零点无区域工作和 CM 阿贝尔簇的 Hodge 猜想证明,其中 Re(s) > 11/12 零点无区域的文稿经人工编辑以提高可读性。

  7. Tibo
    OpenAI 模型攻克重要数学难题

    今天发布的这些内容完全无关,但我们的模型确实解决了一些重要的数学问题,团队在下面的博文中记录了这一点。科学进步的非凡新时代。 https://openai.com/index/sharing-ai-progress-in-mathematics/

  8. OpenAI精选
    OpenAI 发布内部前沿模型产出的多项新数学成果

    OpenAI 宣布发布由内部前沿模型产出的一系列新数学成果,并已在 GitHub 开放(https://github.com/openai/math)。发布前 OpenAI 咨询了普林斯顿高等研究院(IAS)的数学与人工智能独立顾问组,并依据其建议和公开推荐来确定这些成果的发布方式。

10月6日
  1. OpenAI:官网动态精选
    OpenAI 发布内部前沿模型产出的数学研究成果

    OpenAI 发布由内部前沿模型产出的一系列新数学结果,结果放在 GitHub 仓库中,并参考高等研究院数学与人工智能独立咨询组的建议制定发布规范。仓库包含部分证明的 Lean 形式化、10 份模型推理摘要、算力估算和尝试题目统计,平均每项结果约相当于 3 小时 ChatGPT Pro thinking 的算力。

9月29日
  1. The Verge:AI
    OpenAI 组建数学顾问组 AGMAI,数学家质疑其独立性与发布方式

    OpenAI 与九位数学家组成数学与人工智能顾问组(AGMAI),称该组独立运作、可公开质疑公司,但不少数学家因 OpenAI 的发布方式误以为它是 OpenAI 任命的机构。

本事件热度走势

还没有足够的连续观测数据,暂不绘制趋势。