发现者网
产业经济 科技业界 3C数码 文化传媒 移动智能 家电行业 AI大模型 汽车出行 热点资讯

OpenAI GPT-4.1系列发布:编程王者归来,百万tokens上下文处理新高度

2025-04-15来源:ITBEAR编辑:瑞雪

OpenAI公司近期宣布了一项重要更新,推出了GPT-4.1系列模型,这一消息引起了业界的广泛关注。此次发布的模型包括GPT-4.1、GPT-4.1 mini以及GPT-4.1 nano,它们通过API的形式向开发者开放。

据悉,GPT-4.1系列模型在多个方面相较于前代GPT-4o及其小型版本GPT-4o mini有了显著提升。特别是在编程能力、指令遵循以及长文本理解上,GPT-4.1系列模型展现出了更为卓越的性能。这些模型的上下文窗口支持高达100万tokens,且知识库已更新至2024年6月,确保了信息的时效性和准确性。

值得注意的是,目前GPT-4.1系列模型仅通过开发者API提供,普通用户暂时无法直接在ChatGPT页面上体验这些新模型。这一举措显示了OpenAI对开发者社区的重视,以及其在推动AI技术发展和应用方面的决心。

在编程方面,GPT-4.1模型相较于GPT-4o模型,代码生成速度提升了40%,同时用户输入查询的成本降低了80%。这一显著的改进使得GPT-4.1在编程领域具有更高的效率和更低的成本,为开发者提供了更为强大的工具。

GPT-4.1系列模型在多项基准测试中均表现出色。在编程测试SWE-bench Verified中,GPT-4.1得分54.6%,较GPT-4o提升了21.4个百分点。在指令遵循测试MultiChallenge中,GPT-4.1也提升了10.5个百分点。而在多模态长文本测试Video-MME中,GPT-4.1更是创下了72.0%的新纪录。这些测试结果表明,GPT-4.1系列模型在多个领域都具有卓越的性能。

除了GPT-4.1之外,GPT-4.1 mini和nano也展现了小型模型的巨大潜力。GPT-4.1 mini在多项基准测试中媲美甚至超越了GPT-4o,同时延迟降低了近一半,成本减少了83%。而GPT-4.1 nano作为最快、最经济的选择,拥有100万token的上下文窗口,在MMLU测试中得分80.1%,适合分类和自动补全任务。

GPT-4.1系列模型在实际应用中同样表现出色。例如,在Windsurf测试中,GPT-4.1在编程效率上提升了30%,减少了50%的不必要编辑。而在Thomson Reuters的法律AI助手CoCounsel中,使用GPT-4.1后,多文档审查准确率提升了17%。这些实际应用案例进一步证明了GPT-4.1系列模型的强大性能和广泛应用前景。

然而,随着GPT-4.1系列模型的发布,OpenAI产品命名的复杂性也进一步加剧。ChatGPT目前已包含多种模型选项,如GPT-4o、GPT-4o mini、o1-pro等。OpenAI首席执行官山姆·奥尔特曼早在2024年2月就承认了命名问题,并计划通过未来的GPT-5整合品牌,以缓解命名混乱。同时,OpenAI还计划在2025年7月前逐步淘汰API中的GPT-4.5 Preview模型。

在价格方面,GPT-4.1模型每100万tokens输入费用为2美元(约合14.6元人民币),每100万tokens输出费用为8美元(约合58.3元人民币)。相较于GPT-4o,GPT-4.1在提供更强悍性能的同时,还便宜了26%。而GPT-4.1 nano则是OpenAI最便宜、最快的模型,为开发者提供了更为经济高效的解决方案。

中国电信2025年云网路由交换设备集采结果揭晓
中国电信近日宣布,其云网路由交换设备(2025年)集中采购项目已顺利完成评审工作。此次采购项目规模庞大,涉及多个关键网络设备领域,旨在进一步优化和提升云网基础设施能力。

2025-11-13

Kernelcom“智能键盘”来袭:12.5英寸超宽屏,AMD/Intel双版本可选
快科技11月12日消息,近日一款名为Kernelcom的设备正在Kickstarter上众筹,虽然其本质上是一款功能完备的笔记本电脑,但制造商还是将其宣传为“智能键盘”。 这款设备最大的特点是其12.5英寸超…

2025-11-13

漫步者花再拍拍耳机拆解:时尚设计遇上趣味彩屏,内部配置大揭秘
耳机内部搭载了13mm大动圈单元,内置一颗麦克风拾音,采用MIC-POWER微电新能源3.85V/40mAh钢壳扣式电池供电;主板上,搭载了JL杰理科技JL6973D8的蓝牙音频SoC,WINSEMI稳先微…

2025-11-10

2025年AI智能鼠标深度体验:星火大模型赋能,它能替代哪些办公工具?
AI智能鼠标2025深度测评:星火大模型加持,AI问答、AI绘图能替代哪些工具?当一款鼠标,内嵌了如科大讯飞星火这般强大的认知大模型时,它所带来的,远不止是光标移动的流畅,更是一场关于效率与创造力的革命。我们…

2025-11-10

王江:借互联网之力 促多元文化交流 共筑网络空间文化新辉煌
王江认为,随着互联网深度融入人类生产生活,网络空间已成为全球多元文化繁荣发展的新平台、文明交流互鉴的新场域、各国人民情感共鸣的新纽带,网络文化交流发展呈现了许多新气象。要高度重视青年群体在网络文明对话和交流…

2025-11-09

即时配送系统深度剖析:万象生鲜系统如何助力企业配送效率与服务双提升
通过有效整合这些功能和应用场景,即时配送系统能够支撑企业在激烈市场中处于竞争优势。万象生鲜系统如何优化配送效率与服务体验万象生鲜系统通过集成先进的即时配送技术,大幅提升了配送效率和服务体验。 结论即时配送系…

2025-11-08

HPE深耕中国40年:以科技之力,共答可持续数字化转型的时代之卷
作为全球领先的科技企业,HPE在推动2040年全价值链净零的过程中,通过在人工智能、混合云与网络技术领域提供低碳高效的解决方案,帮助企业在数字化转型的同时加速IT的可持续发展,携手上下游生态合作伙伴以更可持续…

2025-11-07

小米通话App即将停服,王化回应称与手机通话功能无关,服务终止时间已定
王化在其个人微博发文表示,2010年12月10日发布的米聊中就嵌入了小米通话的功能,当时市面上的“网络通话”App有限,小米通话的初衷是解决米粉之间移动网络沟通的需求。 而如今大家可以通过很多常见的App实…

2025-11-07

中兴AI全光智会屏亮相移动大会,以融合创新赋能多行业数字化转型
具体而言,AI全光智会屏以中兴通讯领先的全光网技术为核心底座,具备4K无损画面、零延迟智能交互、可靠安全及统一运维四大核心优势,能够为高端智能会议应用提供极致服务体验。 从应用价值来看,AI全光智会屏以全光…

2025-11-07

中兴携手中国移动推出移动屏,融合多技术成家庭智慧生活新枢纽
此次推出的移动屏,依托中国移动爱家泛屏一体化解决方案,深度融合5G通信与AI智能技术,集超大PAD、电视、云电脑等多元功能于一身。27英寸高清触控大屏成为家庭信息交互的核心载体,打破传统设备功能边界,将通信、…

2025-11-07