AI快讯

OpenAI O3测试陷争议，或收购谷歌Chrome引哗然

小智 AI动态资讯 2025年04月27日

0 收藏 0 点赞 78 浏览 725 个字

摘要 :

OpenAI O3测试陷争议，或收购谷歌Chrome引哗然： 4 月 21 日消息，OpenAI 的 o3 人工智能模型的第一方与第三方基准测试结果存在显著差异，引发了外界对其公司透明度……

哈喽！伙伴们，我是小智，你们的AI向导。欢迎来到每日的AI学习时间。今天，我们将一起深入AI的奇妙世界，探索“OpenAI O3测试陷争议，或收购谷歌Chrome引哗然”，并学会本篇文章中所讲的全部知识点。还是那句话“不必远征未知，只需唤醒你的潜能！”跟着小智的步伐，我们终将学有所成，学以致用，并发现自身的更多可能性。话不多说，现在就让我们开始这场激发潜能的AI学习之旅吧。

OpenAI O3测试陷争议，或收购谷歌Chrome引哗然：

4 月 21 日消息，OpenAI 的 o3 人工智能模型的第一方与第三方基准测试结果存在显著差异，引发了外界对其公司透明度和模型测试实践的质疑。去年 12 月，OpenAI 首次发布 o3 模型时宣称，该模型能够在 FrontierMath 这一极具挑战性的数学问题集上正确回答超过四分之一的问题。这一成绩远远超过了竞争对手 —— 排名第二的模型仅能正确回答约 2% 的 FrontierMath 问题。

OpenAI 首席研究官 Mark Chen 在直播中表示：“目前市场上所有其他产品在 FrontierMath 上的成绩都不足 2%，而我们在内部测试中，使用 o3 模型在激进的测试时计算设置下，能够达到超过 25% 的正确率。”然而，这一高分似乎是一个上限值，是通过一个计算资源更为强大的 o3 模型版本实现的，而并非是 OpenAI 上周公开发布的版本。

负责 FrontierMath 的 Epoch 研究所于上周五公布了其对 o3 模型的独立基准测试结果，发现 o3 的得分仅为约 10%，远低于 OpenAI 此前声称的最高分数。这并不意味着 OpenAI 故意撒谎，该公司在 12 月份公布的基准测试结果中也包含了一个与 Epoch 测试结果相符的较低分数。Epoch 还指出，其测试设置可能与 OpenAI 有所不同，并且其评估使用了更新版本的 FrontierMath。

此外，当地时间 4 月 22 日，ChatGPT 的产品负责人 NickTurley 在谷歌反垄断庭审上作证说，如果反垄断执法者成功迫使谷歌公司出售 Chrome 浏览器，OpenAl 有兴趣收购。负责该案审理的法官去年认定，谷歌垄断了在线搜索和相关广告业务。谷歌尚未出售 Chrome 浏览器，该公司计划就垄断判决提起上诉。

嘿，伙伴们，今天我们的AI探索之旅已经圆满结束。关于“OpenAI O3测试陷争议，或收购谷歌Chrome引哗然”的内容已经分享给大家了。感谢你们的陪伴，希望这次旅程让你对AI能够更了解、更喜欢。谨记，精准提问是解锁AI潜能的钥匙哦！如果有小伙伴想要了解学习更多的AI知识，请关注我们的官网“AI智研社”，保证让你收获满满呦！

赏

微信打赏二维码微信扫一扫