OpenAI CEO罕见认错:DeepSeek是非常好的模型 将考虑跟进开源!

北京时间2月1日凌晨,为应对DeepSeek-R1所带来的竞争,OpenAI正式发布了o3-mini模型,这也是OpenAI推理系列中最新、最具成本效益的模型,并且已在ChatGPT和API中开放使用。

据悉,该模型在数学代码等基准测试中刷新SOTA,相关测试中o3-mini(high)在准确率和校准误差(Calibration Error)均是最优。

OpenAI CEO罕见认错:DeepSeek是非常好的模型 将考虑跟进开源!
△o3-mini与o1在AIME竞赛数学的得分对比

据介绍,o3-mini的价格比OpenAI o1-mini便宜63%,比满血版o1便宜93%。开发者可根据需求选择高、中、低三种推理强度,让o3-mini在处理复杂问题时进行深度思考,平衡速度和准确性。

具体来说,目前ChatGPT免费用户首次可以体验一个有限速率的o3-mini版本,速率限制与现有的 GPT-4o 限制类似;Plus用户可选择o3-mini-high更高智能版本;每月支付200美元的 Pro 用户可无限使用o3-mini和o3-mini-high。

API层面,o3-mini输入1.10美元/百万token、输出4.40美元/百万token,价格比o1-mini便宜63%,比满血版o1便宜93%,但仍是GPT-4o mini的7倍左右。

OpenAI表示,o3-mini的发布是在追求高效能智能技术道路上的又一重要里程碑。通过优化科学(Science)、技术(Technology)、工程(Engineering)和数学(Mathematics)领域的推理能力,同时保持较低的成本,让高质量AI技术变得更加平易近人。

OpenAI联合创始人、首席执行官山姆奥尔特曼在o3-mini发布后的在线问答中透露:在未来几周,满血版o3即将上线。

谈及对于DeepSeek的看法,奥尔特曼表示:它(DeepSeek)确实是一个非常好的模型,OpenAI会开发出更好的模型,但我们不会像往年那样保持那么大的领先优势了。

奥尔特曼还罕见地承认了自己的错误,并表示OpenAI正在讨论一个新的开源策略。

我个人认为,在这个问题上我们站错了队,需要想出一个不同的开源策略;不是OpenAI的每个人都持有这种观点,而且这也不是我们目前的最高优先级。

OpenAI CEO罕见认错:DeepSeek是非常好的模型 将考虑跟进开源!

OpenAI CEO罕见认错:DeepSeek是非常好的模型 将考虑跟进开源!

值得一提的是,图灵奖得主、主导Meta AI研究的首席科学家Yann LeCun日前就曾指出,DeepSeek 成功的最大收获,是AI开源的价值使任何人都能受益。

对那些看到DeepSeek表现并认为‘中国在AI领域正超越美国’的人而言,你的解读错了,正确解读应是‘开源模型正超越专有模型’。DeepSeek 从开放研究和开源获益良多(如同PyTorch和Llama),他们提出新想法,并从其他人的工作基础加以建构。他们发布新的模型并开源,所以每个人都能从中受益,这就是开放研究和开源的力量。Yann LeCun说道。

近期,中国AI技术厂商DeepSeek推出的V3和 R1 两款开源 AI 模型都颠覆了业界对于AI算力需求的看法。

特别是DeepSeek推出的推理大模型DeepSeek-R1,其不仅性能比肩OpenAI o1 ,并且其所需的训练成本可能只有后者的约1/20(仅用了2048 个 H800 GPU,花了两个月的时间训练完成,仅花费了约558万美元),API的定价更是只有后者的约1/28,相当于使用成本降低了约97%。

也就是说,DeepSeek采用并不先进的AI芯片,以更低的算力要求和更低的成本,达到了OpenAI等美国AI技术厂商的顶级AI大模型的效果。

这一成就被认为对美国的人工智能领导地位构成威胁,不仅引发了OpenAI、Meta、谷歌等众多大模型厂商恐慌,还引发了英伟达等AI芯片企业的价值重估和股价大跌。

然而,据SemiAnalysis,与外界认为DeepSeek公司拥有5万张H100 GPU计算卡看法不同,该机构认为,DeepSeek囤积了6万张英伟达GPU卡,其中包括1万张A100、1万张H100、1万张特供版H800、3万张特供版H20,算力资本支出的总体拥有成本(TCO)超过140亿元,达19.96亿美元(约合人民币143.45亿元)。

DeepSeek 的总服务器资本支出约为 16.29 亿美元,运营此类集群的成本高达 9.44 亿美元,因此总体的成本可能高达 25.73 亿美元。

OpenAI CEO罕见认错:DeepSeek是非常好的模型 将考虑跟进开源!

但是,DeepSeek并未进行过大规模融资,其母公司幻方似乎也不太可能会进行如此大规模的硬件支出。

DeepSeek官方公布的数据来看,其DeepSeek-V3的训练仅用了约2080张英伟达H800加速卡,这部分的芯片投资大约为4000万美元左右。

而且,DeepSeek训练其AI模型也并不一定非要拥有庞大的自有的硬件基础设施,其完全可以通过租用第三方的硬件基础设施来对自己的大模型进行训练。

不过,如果SemiAnalysis对于DeepSeek囤积了6万张英伟达GPU加速卡的分析是正确的话,那么这也意味着DeepSeek现有的AI算力硬件,足以支撑其沿着目前的技术路径在未来持续研发出多代性能更为强大的AI大模型。

文章来源于网络。发布者:火星财经,转载请注明出处:https://www.sengcheng.com/article/18536.html

(0)
打赏 微信扫一扫 微信扫一扫 支付宝扫一扫 支付宝扫一扫
火星财经的头像火星财经
雷军悼念大S:RIP
上一篇 2025年2月3日 下午3:00
万元显卡标杆!影驰名人堂RTX 5080隆重登场:26相供电
下一篇 2025年2月3日 下午3:00

相关推荐

  • 第一波教你用DeepSeek搞钱的人出现了:只有一个目的

    2月5日消息,在DeepSeek近乎疯狂的热度下,第一批利用它教你搞钱、炒股的人已经出现了。 经查,在一些电商、视频以及知识付费平台上,出现了多个打着利用DeepSeek赚钱名号的课程,还有不少挂着各种教授、行业专家名号的人开直播专门讲授DeepSeek知识。 这些课程种类不一,价格不等,从几十元到几百元都有。甚至有些自媒体以如何利用DeepSeek日进斗金…

    2025年2月5日
    30700
  • 官方通报35款App违法收集个人信息:涉爱剪辑等多款剪辑App

    5月20日消息,今日,国家网络安全通报中心发布《公安部计算机信息系统安全产品质量监督检验中心检测发现35款违法违规收集使用个人信息的移动应用》,通报应用宝中35款移动应用存在违法违规收集使用个人信息情况,涉及爱剪辑等多款剪辑类App。 具体通报如下: 1、未以结构化清单的方式逐一列出收集、使用个人信息规则。涉及12款移动应用如下: 智慧AI聊天(版本1.4.…

    2025年5月20日
    34800
  • 一家三口吃清洗过的鸡蛋后中毒:保存前清洗引发变质

    7月29日消息,据媒体报道,沈阳一家三口因食用炒鸡蛋后出现中毒症状。经调查,中毒原因是食用了保存前被清洗过的变质鸡蛋。 实验显示,清洗后的鸡蛋外壳菌落数量比未清洗的高出3至4倍。 食品专家指出,鸡蛋壳表面有一层肉眼不可见的胶状膜,能有效阻挡细菌侵入。水洗会彻底破坏这层保护膜,使细菌更易通过蛋壳气孔进入内部。建议消费者购买后直接冷藏,避免预先清洗;若需清洁,应…

    2025年7月29日
    30700
  • 什么是余额宝理财?新手入门全攻略收益计算与操作方法一文讲清

    对于刚接触理财的新手来说,余额宝几乎是绝大多数人的第一个理财入口,这款依托支付宝生态上线的货币基金产品,上线十余年来已成为国民级的零钱理财工具,但仍有不少初次接触的用户,对余额宝的产品本质、收益计算规则、操作方法存在认知误区,甚至将其与银行存款混为一谈。投资参考网记者结合最新的产品规则与监管要求,为新手用户梳理出完整的入门攻略,拆解清楚余额宝理财的核心逻辑与…

    2026年2月25日
    62200
  • 新债中签后如何卖出操作步骤图解,新债卖出技巧

    “终于中了!但这新债到底什么时候卖?卖早了怕亏,卖晚了又担心破发”,刚接触打新的投资者小李看着证券APP里的中签通知,犯了难。这样的困惑并非个例,据同花顺财经2025年数据显示,新债打新参与人数年均突破800万,但近30%的投资者因卖出时机不当,要么错失收益要么遭遇亏损。事实上,新债中签后的卖出并非盲目跟风,而是有明确的操作流程和技巧可循,掌握核心逻辑就能最…

    2026年1月2日
    98900

发表回复

登录后才能评论
关注微信