← 返回资讯
大模型 @Alibaba_Qwen

通义千问: Fast, faster, Qwen. 🚀 Thrilled to see Qwen…

Fast, faster, Qwen. 🚀 Thrilled to see Qwen3.5 reaching a record-breaking 580 tps for agentic workl…

查看原文
TL;DR · 产品解读

阿里通义千问 Qwen3.5 发布,官方宣称达到 580 tps 的 agentic 推理速度。如数字属实,这将刷新开源模型推理速度纪录,目标直指 Agent 场景的高频调用需求。

深度解读

产品是什么

通义千问 Qwen3.5 是阿里云 Qwen 系列的最新版本,定位为面向 Agent 工作流的高性能推理模型。官方以「Fast, faster, Qwen」为 slogan,强调极速推理能力。从 X 推文的只言片语来看,Qwen3.5 的核心突破在于 agentic workload(智能体工作负载)场景下的吞吐量提升,宣称达到 580 tps(tokens per second) 的纪录。

值得注意的是,这则发布信息来自 Twitter/X 的简短推文,没有详细的技术白皮书或官方博客支撑。580 tps 这个数字对于 LLM 推理来说极为激进——主流开源模型如 Llama-3.1 70B 在 vLLM 优化下通常在 50-100 tps 区间,即使是专精推理加速的模型也鲜有超过 300 tps 的公开 benchmark。因此这个数字可能存在几种解读:①指 Prefill 阶段的峰值吞吐而非 end-to-end;②特定硬件配置下的测试结果;③针对短序列任务的优化结果。

解决什么问题

Qwen3.5 直指当下 Agent 应用落地的核心痛点:推理延迟与成本。当大模型被嵌入自动化工作流(如客服机器人、代码生成

未登录访客
SMARTFLOW PRO

继续阅读深度解读 + 编辑加注

下方还有 3-5 段深度分析 + Vincent 编辑加注 + 可点击信源,仅 Pro 会员可见

加入机智流 PRO →

¥99 / 季 · 每周 1 篇深度研报 · 飞书+微信群双通道

已是 Pro 但仍被提示?联系反馈

参考来源
  1. 通义千问官方推文 · 2026-05-27
  2. Qwen2.5 系列官方介绍 · 2025-03-01
本解读由 AI 自动生成 · 模板:产品解读 · 仅供参考,请以原文为准。