发现者网
产业经济 科技业界 3C数码 文化传媒 移动智能 家电行业 AI大模型 汽车出行 热点资讯

阿里通义千问推出Qwen2.5-Turbo,长上下文AI模型能力再升级!

2024-11-19来源:ITBEAR编辑:瑞雪

近期,阿里通义千问在其官方平台上发布了一项重大更新,正式推出了Qwen2.5-Turbo开源AI模型。这一新模型在历经数月的精心优化后,终于面向广大社区用户亮相。

Qwen2.5-Turbo的最大亮点在于其显著提升了上下文长度的处理能力。相较于之前的版本,该模型将上下文长度从12.8万个tokens大幅扩展至100万个tokens,这一改进意味着它能够处理约100万英语单词或150万汉字的文本内容,足以容纳10部完整的小说、150小时的演讲稿,或是30000行代码。

在自然语言处理(NLP)领域,大型语言模型(LLM)的上下文长度是一个至关重要的指标。它决定了模型在一次处理过程中能够考虑和生成的文本的最大长度。Qwen2.5-Turbo在这一方面的突破,无疑为其在处理长文本任务时提供了更大的优势和灵活性。

在性能表现上,Qwen2.5-Turbo同样不负众望。在1M-token的Passkey检索任务中,该模型实现了100%的准确率,而在RULER长文本评估中,其得分也高达93.1,成功超越了GPT-4和GLM4-9B-1M等业界知名模型。

为了进一步提升处理效率,Qwen2.5-Turbo还整合了稀疏注意力机制(sparse attention mechanisms)。这一机制使得模型在处理100万tokens文本时,从输入到输出第一个token的时间从4.9分钟缩短至68秒,速度提升了4.3倍。这一显著的效率提升,使得Qwen2.5-Turbo在处理长文本时更加迅速和高效。

除了性能上的提升,Qwen2.5-Turbo在经济性方面也表现出色。其处理成本保持在每百万个tokens 0.3元的水平,能够处理3.6倍于GPT-4o-mini的token数量。这一优势使得Qwen2.5-Turbo在长上下文处理解决方案中更具竞争力,成为用户们的高效、经济之选。

然而,尽管Qwen2.5-Turbo在多个基准测试中取得了优异的成绩,其团队仍然保持着清醒的头脑。他们意识到,在真实场景中的长序列任务表现可能还存在不够稳定的问题,同时大型模型的推理成本也还有进一步优化的空间。

对此,Qwen2.5-Turbo的团队承诺将继续努力,不断优化模型的人类偏好、提高推理效率,并探索更强大的长上下文模型,以满足用户们日益增长的需求和期待。

Valve推出Steam Frame新VR头显 正式宣告上一代Index头显停产
用户可通过无线适配器,将 PC 或 Steam Machine 上的平面屏(flatscreen)及 VR 游戏串流至 SteamFrame;与此同时,Steam Frame 本身也是一款独立设备,搭载高通…

2025-11-14

小天互连IM系统:打破政企信息孤岛 驱动一体化协作新变革
某省级政务大厅在信创升级中,通过小天互连IM系统实现了与政务服务平台、电子证照系统的无缝对接,群众办事进度可直接通过即时通讯推送,办理效率提升50%,印证了其国产化集成的稳定性。 从国产化生态适配到开放 A…

2025-11-14

桥梁位移监测仪:精准感知位移 灵活部署续航 守护桥梁安全出行
这种方式能够利用清洁能源为设备持续供电,既体现了节能环保的理念,也巧妙地解决了在市政供电不便场景下的设备续航问题,保障了监测工作的不间断进行。为了便于现场操作与维护,桥梁位移监测仪还配备了便捷的配置方式。 …

2025-11-14

2025微信数据保护全攻略:误删聊天记录别急,多场景恢复方案来了
提前备份是数据安全的核心,2025年微信已支持电脑、云服务、外部存储等多种备份方式,恢复时只需简单操作即可找回记录。苹果和安卓厂商的云服务早已支持微信数据备份,关键是确认误删前有有效备份记录。 2. 选择…

2025-11-13

高光谱探测器助力宽带叠层扫描成像 开启3D高光谱成像新篇
最近的研究表明,能量分辨或高光谱探测器可以在某种程度上取代单色器的作用来执行,例如,在单次采集中使用宽带辐射进行边缘减影叠层扫描成像。利用这样的探测器,时间相干性变得可调(在探测器的能量分辨率的限制内)并且在…

2025-11-12

SK海力士VFO工艺打造HBS技术,为移动设备AI性能提升带来新突破
据闪德资讯获悉,SK海力士正在研发结合移动DRAM和NAND的高带宽存储(HBS)技术,可提高智能手机和平板电脑等移动设备的AI性能。 相比HBM使用的硅通孔(TSV)技术,VFO无需穿孔,成本更低、良率更高…

2025-11-12

中国电信携手多方完成2万公里中轨NTN在轨试验 速率达140Mbps
快科技11月11日消息,近日,中国电信研究院联合浙江电信,携手清华大学、上海清申科技、北京捷蜂创智科技,依托云网融合大科创装置天地一体卫星试验能力,成功完成NTN(非地面网络)制式在中轨卫星条件下的在轨技术验…

2025-11-12

物联网防逆流方案:10秒动态调节,光伏发电余电不上网更高效
防逆流柔性调节通过加装物联网网关与双向计量电表,监测市电总进线处的功率和逆变器实时的发电功率,通过网关内置的智能算法,以*快10秒为一个检测周期,持续跟踪负荷变化,动态调节逆变器的有功功率输出,既达到防逆流…

2025-11-11

奇安信“未知威胁检测防护”项目获2024年度北京市科技进步一等奖
央广网北京11月11日消息(记者 万玉航)11月7日,北京市人民政府召开了2024年度北京市科学技术奖励大会,奇安信参与申报的“面向海量软件的未知威胁高效检测与防护关键技术研发及应用”项目获得北京市科学技术进…

2025-11-11

可编程网络中控系统:控制为核心基石,附属功能助力效能提升
AI算法在中控系统中的应用,并非为了追求技术噱头,而是通过分析设备运行状态数据,实现控制指令的预判与自适应调整——如根据会议室人数自动调节空调温度、根据室外光照强度自动调整室内照明亮度,让控制更智能、更贴合实…

2025-11-10