OpenAI重磅发布GPT-4.5(Orion) 史上最大模型震撼来袭

AI 智能摘要
AI巨头OpenAI于本周四震撼发布代号为Orion的全新AI模型GPT-4.5!作为OpenAI迄今为止规模最大的模型,GPT-4.5的发布引发业界高度关注。然而,OpenAI一度在白皮书中声明GPT-4.5并非前沿模型(后已删除)

AI巨头OpenAI于本周四震撼发布代号为Orion的全新AI模型GPT-4.5!作为OpenAI迄今为止规模最大的模型,GPT-4.5的发布引发业界高度关注。然而,OpenAI一度在白皮书中声明GPT-4.5并非前沿模型(后已删除),且性能评测结果喜忧参半,高昂的API定价更引发争议。GPT-4.5的发布,究竟预示着AI发展的哪些新趋势?搬主题为您深度解读!

GPT-4.5(Orion):OpenAI史上最大模型,规模空前

OpenAI在周四的公告中,将GPT-4.5定义为“迄今为止最大的模型”,并强调其训练所使用的计算能力和数据量均超越以往任何模型。如此巨大的规模,无疑预示着GPT-4.5在性能上将有显著提升。

然而,令人意外的是,OpenAI最初在其发布的白皮书中指出,“GPT-4.5不是前沿AI模型”。这一表述引发业界困惑,OpenAI随后删除了白皮书中的该行声明,更增添了GPT-4.5发布的神秘色彩。

GPT-4.5发布节奏:ChatGPTPro用户抢先体验,API定价高昂

ChatGPT Pro用户优先体验:OpenAI已于周四开始向ChatGPT Pro(每月200美元)订阅用户开放GPT-4.5的ChatGPT访问权限。

API付费层开发者同步可用:OpenAI API付费层的开发者也可从周四开始使用GPT-4.5。

ChatGPT Plus/Team用户下周陆续开放:注册ChatGPT Plus和ChatGPT Team的用户预计将在下周获得GPT-4.5模型访问权限。

API定价高昂,或限制大规模应用

OpenAI公布的GPT-4.5API定价极为高昂:

  • 输入Token:每百万输入Token(约75万字)收费75美元。
  • 输出Token:每百万输出Token收费150美元。

对比之下,GPT-4o的API定价仅为:

  • 输入Token:每百万输入Token2.50美元。
  • 输出Token:每百万输出Token10美元。

GPT-4.5的API定价是GPT-4o的数十倍,如此高昂的成本,或将限制GPT-4.5的大规模商业应用。OpenAI官方也承认,GPT-4.5的运行成本“非常高”,甚至正在评估是否长期在其API中提供GPT-4.5。

GPT-4.5性能评测:基准测试表现参差不齐,更注重“人类意图理解”

OpenAI强调,GPT-4.5并非旨在取代GPT-4o,后者仍是OpenAI的主力模型。GPT-4.5在功能上暂不支持ChatGPT逼真的双向语音模式,但支持文件和图像上传,以及ChatGPT画布工具等功能。

基准测试表现:部分领先,但未全面超越

SimpleQA基准测试:GPT-4.5在准确性方面优于GPT-4o和OpenAI的推理模型o1和o3-mini,且幻觉发生率更低。但OpenAI未公开其最佳推理模型“深度研究”在该基准测试中的表现。第三方AI初创公司Perplexity的“深度研究”模型在该测试中优于GPT-4.5。

图片[1]-OpenAI重磅发布GPT-4.5(Orion) 史上最大模型震撼来袭-搬主题

SWE-Bench Verified和SWE-Lancer编码基准测试:GPT-4.5在SWE-Bench Verified子集上与GPT-4o和o3-mini表现大致相当,但落后于OpenAI深度研究和Anthropic Claude 3.7 Sonnet。在SWE-Lancer测试中,GPT-4.5优于GPT-4o和o3-mini,但仍落后于深度研究。

图片[2]-OpenAI重磅发布GPT-4.5(Orion) 史上最大模型震撼来袭-搬主题
图片[3]-OpenAI重磅发布GPT-4.5(Orion) 史上最大模型震撼来袭-搬主题

AIME和GPQA学术基准测试:GPT-4.5未达到o3-mini、DeepSeek R1和Claude 3.7 Sonnet等领先推理模型的水平,但在同类非推理模型中表现优秀。

更注重“人类意图理解”和“情商”

OpenAI声称,GPT-4.5在基准测试难以量化的领域表现突出,例如理解人类意图的能力。OpenAI表示,GPT-4.5的回应语气更温暖、更自然,且在写作和设计等创意任务上表现出色。

在OpenAI的非正式测试中,GPT-4.5在SVG独角兽创作和情感支持对话方面均展现出更强的能力,优于GPT-4o和o3-mini。

图片[4]-OpenAI重磅发布GPT-4.5(Orion) 史上最大模型震撼来袭-搬主题

OpenAI强调,“学术基准并不总是反映现实世界的实用性”,并希望通过GPT-4.5的发布,更全面地了解其功能,收集用户反馈。

GPT-4.5挑战“ScalingLaws”:预训练规模扩张或遇瓶颈?

OpenAI声称GPT-4.5“处于无监督学习的前沿”,但其喜忧参半的性能表现似乎也印证了专家此前的猜测:预训练的“ScalingLaws”可能不会持续有效,单纯依靠扩大模型规模和数据量,可能无法持续带来性能的线性提升。

OpenAI联合创始人兼前首席科学家IlyaSutskever曾表示,“我们已经获得了峰值数据”,预训练的黄金时代或将结束。AI投资者、创始人和研究人员也表达了类似的担忧。

图片[5]-OpenAI重磅发布GPT-4.5(Orion) 史上最大模型震撼来袭-搬主题

推理模型或成AI发展新方向?

为了应对预训练规模扩张的瓶颈,包括OpenAI在内的AI实验室已开始探索推理模型等新方向。推理模型通过增加模型“思考”问题的时间和计算力,提升模型能力。OpenAI计划最终将GPT系列模型与其“o”推理系列融合,预计从今年晚些时候的GPT-5开始。

GPU短缺成OpenAI发展掣肘,高昂定价或为“算力焦虑”体现

OpenAI的CEO Sam Altman坦言,由于“缺少GPU”,OpenAI被迫推迟GPT-4.5的发布。他表示,GPT-4.5“庞大”且“昂贵”,需要“数万”个GPU才能向更多ChatGPT用户开放。

GPT-4.5高昂的API定价,或许也反映了OpenAI的“算力焦虑”。GPU短缺已成为制约OpenAI发展的瓶颈,OpenAI希望通过自研AI芯片和构建庞大数据中心网络来应对算力挑战。

搬主题点评:GPT-4.5的发布,预示AI发展进入“质量”时代?

从搬主题角度来看,OpenAI GPT-4.5的发布,虽然在基准测试中表现参差不齐,API定价也极为高昂,但其背后蕴含的行业信号更值得关注:

1.AI模型发展或进入“质量”时代:单纯依靠扩大模型规模和数据量,可能已无法持续带来性能的线性提升。未来AI模型的竞争,或将更侧重于模型架构创新、推理能力提升、以及对人类意图的更精准理解。

2.推理模型或成AI发展新趋势:OpenAI将GPT系列与“o”推理系列融合的计划,预示着推理模型将成为未来AI发展的重要方向。如何提升推理模型的效率和降低成本,将成为AI实验室新的竞争焦点。

3.GPU算力瓶颈凸显,AI基础设施建设迫在眉睫:GPU短缺已成为制约AI发展的关键因素。加大AI基础设施建设投入,突破算力瓶颈,将成为AI行业发展的当务之急。

4.AI定价模式或将重塑:GPT-4.5高昂的API定价,或将引发业界对AI定价模式的重新思考。如何平衡AI研发成本与用户可接受度,探索更合理的AI定价模式,将是AI商业化落地的关键。

最后总结

OpenAI GPT-4.5的发布,既是对OpenAI技术实力的又一次展示,也引发了业界对AI发展方向的深入思考。GPT-4.5的性能表现、高昂定价、以及OpenAI的战略调整,都预示着AI行业正步入一个新的发展阶段。搬主题将持续关注AI技术的最新动态,为广大网站站长和开发者提供更前沿、更深入的AI行业解读和SEO优化建议。

© 版权声明
THE END
喜欢就支持一下吧
点赞9 分享
评论 抢沙发

请登录后发表评论

    暂无评论内容