首页 > 实时讯息 >

初探OpenAI GPT-4.1：AI编程能力大增，但谷歌Gemini依然称王

0次浏览发布时间：2025-04-16 08:24:00

IT之家 4 月 16 日消息，科技媒体 bleepingcomputer 昨日（4 月 15 日）发布博文，报道称 OpenAI 最新发布的 GPT-4.1 系列模型，其性能相比 GPT-4o 虽然实现重大飞跃，但多项跑分未能超越谷歌的 Gemini 系列。

IT之家昨日报道，OpenAI 公司发布 GPT-4.1、GPT-4.1 mini 和 GPT-4.1 nano，官方公布的跑分数据来看，这些模型在编程方面的能力，远超 GPT-4o 及 GPT-4o mini。

例如在 SWE-bench Verified 跑分中，GPT-4o 的得分为 21.4%，GPT-4.5 的得分为 26.6%，而 GPT-4.1 的得分为 54.6%。

尽管性能有较大提升，不过根据多位专家测试，相比较谷歌的 Gemini 系列，GPT-4.1 对比中却显露劣势。

根据 Stagehand（一款生产级浏览器自动化框架）发布的基准数据，Gemini 2.0 Flash 的错误率仅为 6.67%，精确匹配率高达 90%，且价格低廉、速度更快。相比之下，GPT-4.1 的错误率高达 16.67%，成本更是 Gemini 2.0 Flash 的 10 倍以上。

此外，哈佛大学 RNA 科学家 Pierre Bongrand 提供的数据也指出，GPT-4.1 的性价比不及 Gemini 2.0 Flash、Gemini 2.5 Pro 及 DeepSeek 等竞品。

在编码专项测试中，GPT-4.1 同样未能占据上风。Aider Polyglot 的测试结果显示，GPT-4.1 的编码得分仅为 52%，而 Gemini 2.5 则以 73% 的成绩遥遥领先。

值得注意的是，GPT-4.1 被归类为非推理模型（non-reasoning model），但其编码能力仍属行业顶尖。

本文分类：实时讯息
本文标签：得分错误率之家模型仅为能力系列数据
浏览次数：0 次浏览
发布日期：2025-04-16 08:24:00
本文链接：https://www.kmwz.net/news/AzlzXEzBG8.html

上一篇 > 河北省举行全民国家安全教育日宣传活动
下一篇 > 时政微观察丨把中越友好接力棒一代代传下去

初探OpenAI GPT-4.1：AI编程能力大增，但谷歌Gemini依然称王

IT之家 4 月 16 日消息，科技媒体 bleepingcomputer 昨日（4 月 15 日）发布博文，报道称 OpenAI 最新发布的 GPT-4.1 系列模型，其性能相比 GPT-4o 虽然实现重大飞跃，但多项跑分未能超越谷歌的 Gemini 系列。IT之家昨日报道，OpenAI 公司发布

2025-04-16 08:24:00

美团外卖薛冰：投千亿元覆盖商家及消费者，推动门店明厨亮灶直播

新京报讯（记者秦胜南）4月15日，新京报记者获悉，美团外卖总经理薛冰在2025中国餐饮连锁峰会上宣布，未来三年美团外卖将向餐饮行业整体投入1000亿元，包括帮助商家补贴消费者激活需求、发放助力金帮商家增加收入、扶持和奖励优秀品质商家，以及推动明厨亮灶覆盖10万家店、加强行业基础建设等。“2024年餐

2025-04-15 21:46:00

美团外卖：投入千亿元现金，用透明标准助力好商家

“我们将发放更多助力金，帮助商家降成本提收入。”4月14日，美团外卖总经理薛冰在2025中国餐饮连锁峰会上宣布，未来三年，美团外卖将向餐饮行业整体投入1000亿元，帮助餐饮伙伴健康增长。据了解，近半年来，美团持续向餐饮商户发放不同规模的助力金，目前，助力金已发放至餐饮老店、实体小店、连锁品牌手中。一

2025-04-15 10:31:00

为AI立“心”，济南何以善治又善智

日前，中央网信办公布最新一批生成式人工智能服务已备案信息，济南再次上榜。记者从济南市委网信办获悉，截至目前，济南已有7个AI大模型通过备案，数量居全省首位，占全省11个大模型备案数量的近三分之二，其中包括浪潮海岳大模型、策问大模型等，推动“人工智能+”行动在各行业的融合发展。以应用场景为钥，济南正

2025-04-15 08:43:00

无人作战在现代战争中如何改变战争形态？有哪些典型应用？专家解读→

央视新闻当前，随着无人技术的蓬勃发展，便携式无人机等无人装备广泛应用于现代战场，客观上改变了现有作战模式。我军陆军各部队着眼战场变化，将便携式无人装备攻防演练融入日常训练，瞄准“无人化+智能化”，研究新的训法、战法，将成果运用于练兵实践，为军队战斗力提升注入新的活力。近日，第82集团军某旅组织多兵种

2025-04-13 23:04:00

初探OpenAI GPT-4.1：AI编程能力大增，但谷歌Gemini依然称王

热门文章

最新文章