我要投稿

阿里发布Qwen2.5-Turbo，支持100万Tokens上下文！

发布日期：2024-11-21 07:09:10 浏览次数： 2412 作者：AIGC开放社区

阿里巴巴重磅发布了Qwen2.5-Turbo 版本。

为了满足用户和开发者的需求，阿里在Qwen2.5-Turbo 版本，将上下文从之前的128K扩展至100万tokens，相当于大约100万个英文单词或150万个汉字，足以涵盖10部长篇小说、150小时的演讲稿或3万行代码，使得模型的整体理解、生成能力获得大幅度提升。

在线demo：https://www.modelscope.cn/studios/Qwen/Qwen2.5-Turbo-1M-Demo

这种百万级上下文能力，使Qwen2.5-Turbo在处理复杂长文本任务时表现出色，例如，在大海捞针任务中，能够完美捕捉所有隐藏的数字，显示出在超长上下文中捕捉细节信息的强大能力。

Qwen2.5-Turbo还通过采用稀疏注意力机制，显著提高了推理速度，将生成首个token的时间从4.9分钟减少到了68秒，实现了4.3倍的加速，这意味着在实际应用中，能更快地响应用户的请求。

以理解长篇小说为例，Qwen2.5-Turbo能够处理包含690k tokens的三部《三体》系列小说，并提供英文的剧情摘要，这展示了它在深度理解长文本和跨语言摘要方面的强大能力。

尽管处理能力大幅提升，Qwen2.5-Turbo的价格却保持不变，为0.3元/1M tokens，用户可以以相同的成本处理更多的tokens，即3.6倍于GPT-4o-mini的tokens数量。

在扩展上下文长度的同时，Qwen2.5-Turbo几乎不影响短文本任务的能力，在短文本基准测试中，它在大多数任务上显著超越了之前上下文长度为1M tokens的开源模型，并且与GPT-4o-mini和Qwen2.5-14B-Instruct模型相比，在短文本任务性能接近的同时，支持8倍长度的上下文。

目前，Qwen2.5-Turbo主要通过API来使用，方式、标准和Qwen API相同，并兼容OpenAI的API。

获取API Key：首先，您需要在阿里云大模型服务平台注册并获取您的API Key。这个密钥是调用Qwen 2.5 Turbo API所必需的认证信息。

API地址：https://help.aliyun.com/zh/model-studio/developer-reference/what-is-qwen-llm

安装依赖：如果打算在Python环境中使用Qwen 2.5 Turbo，需要先安装OpenAI库。可以通过运行pip install openai命令来完成安装。

接下来，我们将通过一个简单的Python脚本示例来展示如何使用Qwen 2.5 Turbo的API。这个例子中，我们将读取一个包含长文本的文件，然后请求Qwen 2.5 Turbo对该文本进行总结。

当上述代码执行完毕后，completion.choices[0].message.content将包含Qwen 2.5 Turbo生成的文本摘要。

三大注意事项

API Key安全：请确保您的API Key不会泄露给第三方，避免未经授权的使用。

请求频率限制：根据阿里云平台的规定，可能存在一定的请求频率限制，请合理安排您的调用计划。

错误处理：在实际应用中，建议添加适当的错误处理逻辑，以应对网络问题或API调用失败的情况。

53AI，企业落地大模型首选服务商

产品：场景落地咨询+大模型应用平台+行业解决方案

承诺：免费场景POC验证，效果验证后签署服务协议。零风险落地应用大模型，已交付160+中大型企业

相关资讯

2025-04-26

Ollama-Deep-Researcher-本地Mac结合魔搭社区模型搭建网页研究助手

2025-04-25

Manus开源版本！无需邀请码，老金手把手教你咋用！

2025-04-25

78k star，像写 Markdown 一样画流程图，这个开源工具太牛了！

2025-04-25

MarkItDown MCP：一款好用的将文件和办公文档转换为Markdown的AI工具！

2025-04-24

AI+SQL客户端，这款开源神器让数据库管理像聊天一样简单！

2025-04-24

效率革命！GitHub爆火的开源神器MinerU：PDF、网页、电子书一键转Markdown

2025-04-24

Suna：构建你专属“通用智能体”的开源利器

2025-04-24

开源TTS领域迎来重磅新星！Dia-1.6B：超逼真对话生成，开源2天斩获6.5K Star！

了解更多

了解更多

160+中大型企业正在使用53AI

立即咨询预约演示

把握AI发展的机遇，共同探索、共同进步

2025-01-22

如何打造基于GenAI的员工服务机器人

2025-01-22

热点资讯

Ollama 本地运行大模型(LLM)完全指南

2024-07-25

我把最近爆火的 DeepSeek-V3 接到了 Cursor！

2025-01-01

万字详解DeepSeek-R1，引爆AI圈的又一力作，大模型爆发势不可挡！

2025-01-21

太强了！10大开源大模型！

2024-05-06

QWEN2.5开源上新，14B/32B回归实测：这就是最强单卡本地模型！

2024-09-20

全民进入GPT-4时代：OpenAI强势推出GPT-4o mini！彻底取代GPT-3.5！

2024-07-20

如何免费使用 Claude AI？Claude使用指南！

2024-07-11

Qwen2 阿里最强开源大模型（Qwen2-7B）本地部署、API调用和WebUI对话机器人

2024-06-12

开源项目Composio：突破 AI 智能体开发的边界

2024-08-13

DeepSeek-V3 正式发布

2024-12-26

大家都在问

AI大模型火热，将 Hugging Face大模型转换为 GGUF 为何受关注？

2025-04-21

微软最新 Playwright MCP 服务器强势来袭？

2025-04-19

OpenAI开源的Codex CLI是什么？

2025-04-17

MCP，这个AI 开源协议有多大想象空间？

2025-04-15

Google ADK，知多少？

2025-04-13

一文看懂谷歌 A2A：它到底是个啥？为什么能带AI Agent 组队开黑？

2025-04-10

实测Llama 4，究竟是王者归来，还是廉颇老矣？

2025-04-07

4天开发，1700万美元融资：开源的Browser Use为啥这么火？

2025-04-03

热门标签

内容创作大模型技术个人提效 langchain llamaindex 多模态技术 RAG技术智能客服知识图谱模型微调 RAGFlow coze Dify Fastgpt Bisheng Qanything AI+汽车 AI+金融 AI+工业 AI+培训 AI+SaaS 提示词框架提示词技巧 AI+电商 AI面试数字员工 ChatBI 知识管理开源大模型智能营销智能硬件智能化改造 AI+医疗 MaxKB

应聘简历请发送至： ceo@53ai.com

友情链接：

CopyRight © 2012-2024 深圳市博思协创网络科技有限公司版权所有

粤ICP备17114055号

广州：广州市华景路37号(华景软件园)暨南大学科技大厦6楼（整层）

深圳：深圳市福田区泰然四路29号天安创新科技广场一期A座1204

上海：上海市浦东新区金新路58号1602室

微信扫码
和创始人交个朋友

联系我们

售前咨询

预约演示

微信扫码

添加专属顾问

回到顶部