PPIO首发上线Qwen3-Next-80B-A3B

PPIO首发上线Qwen3-Next-80B-A3B

今天,阿里通义千问发布了下一代基础模型 Qwen3-Next-80B-A3B,该模型已经首发上线 PPIO

Qwen3-Next 系列采用了“混合注意力机制”——引入业内前沿的“线性注意力机制”,与经典的“全注意力机制”混搭使用,该架构专为极长上下文和超大规模参数性能而优化。

现在,PPIO 上线了 Qwen3-Next-80B-A3B-InstructQwen3-Next-80B-A3B-Thinking,其上下文长度为 64k,价格为每百万 tokens 输入,每百万 tokens 输出。

前往 PPIO 官网或点击文末阅读原文即可体验,新用户填写邀请码【LYYQD1】注册可得 15 元代金券。

# 01 Qwen3-Next 的架构创新

Qwen3-Next 系列代表了 Qwen 系列下一代的基础模型,专为极长上下文和超大规模参数性能而优化。

这一系列引入了一套架构创新,旨在最大化性能的同时最小化计算成本:

  • 混合注意力(Hybrid Attention):用 Gated DeltaNet 与 Gated Attention 组合替代标准注意力,实现高效上下文建模。
  • 高稀疏度 MoE:在 MoE 层中实现 1:50 的极低激活比,大幅减少每个 token 的 FLOPs,同时保留模型容量。
  • 多 Token 预测(MTP):提升预训练模型性能,加快推理速度。
  • 其他优化:包括零中心和带权衰减的 LayerNorm、Gated Attention,以及其他稳定性增强手段。

基于这一架构,Qwen 训练并开源了 Qwen3-Next-80B-A3B——总参数 800 亿,但仅 30 亿处于激活状态,实现了极端稀疏性与高效率。

尽管极度高效,Qwen3-Next 在下游任务上的表现仍优于 Qwen3-32B —— 同时训练成本却不到十分之一。

此外,在处理超过 32K tokens 的长上下文时,它的推理吞吐量比 Qwen3-32B 高出 10 倍以上。

# 02 如何在 PPIO 使用?

我们将 PPIO Qwen3-Next 的模型 API 接入  Cherry Studio 进行体验。

提示词 1:

请用三种不同的身份回答同一个问题:

  • 身份1:物理学博士
  • 身份2:中学老师
  • 身份3:科幻小说作家

问题:量子计算与经典计算的根本差异是什么?

该问题测试 MoE 路由是否能覆盖不同领域的知识,Qwen3-Next-80B-A3B-Instruct 的回答如下:

提示词2:

某工厂有三个机器:A、B、C。

  • A 生产 40 个零件,每个零件有 20% 概率次品。
  • B 生产 60 个零件,每个零件有 10% 概率次品。
  • C 生产 100 个零件,每个零件有 5% 概率次品。

问题:如果我从总产出里随机抽一个零件,结果是次品,那么它来自机器 A 的概率是多少?请详细推理。

该问题测试模型的推理能力是否因为 MoE 的稀疏化受影响,Qwen3-Next-80B-A3B-Thinking 的回答如下:

现在,你可以到 PPIO 官网在线体验 Qwen3-Next ,或者将模型 API 接入 Cherry Studio、ChatBox 或者你自己的 AI项目中。

查看详细接入教程:

https://ppio.com/docs/model/overview

PPIO 致力于为企业及开发者提供高性能的模型 API 服务,目前已上线 DeepSeek R1/V3、Qwen3、Kimi K2 等系列模型,仅需一行代码即可调用。并且,经过长期实践,PPIO 已经实现大模型推理的 10 倍+ 降本,实现推理效率与资源使用的动态平衡。

Read more

PPIO上线“企业Token Plan”:主流旗舰模型最低6折接入,支持200席位

PPIO上线“企业Token Plan”:主流旗舰模型最低6折接入,支持200席位

AI 应用落地进入规模化阶段后,企业面临的挑战已经从“能不能用”变成了“怎么用得起、用得稳、管得住”。 过去一年,模型 API 的调用成本普遍下降了一个数量级,但这并没有让企业的 AI 预算问题消失。主流可用的模型从三五个变成了十几个,每家厂商定价体系不同,缓存机制不同,并发限制也不同。多模型混用的企业团队,往往需要维护多个账户、多套账单,遇到某个模型价格调整或服务波动时处理起来相当被动。 而现在,PPIO 发布的企业 Token Plan,正是要解决这些问题。 一键接入 17 款主流大模型,支持 200 席位 PPIO 企业 Token Plan 是一套标准化的预付费折扣产品,核心机制是“融合 Token”:以 DeepSeek V4 Flash 输入 Token 为基准单位(

By PPIO
PPIO正式发布“Fusion融合模型”:用十分之一的价格超越顶级模型的智商

PPIO正式发布“Fusion融合模型”:用十分之一的价格超越顶级模型的智商

省钱又智能的 Fusion 融合模型来了! 跟仅做简单请求转发的传统 API 网关不同,PPIO 智能模型网关正式上线的新功能——Fusion 融合模型会将每次调用变成一场“专家会诊”——网关会将复杂任务同时分发给多个各有所长的“专家模型”并行作答,再通过思考编排与交叉验证,由主模型融合生成最终答案。 Fusion 模型以智能优先、兼顾性价比:通过工程化的融合手段,把回答质量稳定在头部旗舰模型梯队,同时把成本控制在中低梯队。在 DRACO 深度研究基准测试中,PPIO 用三个开源模型融合后的评分超越了 Claude Fable 5,而成本仅为后者的十分之一。 Fusion 融合模型证明,智能的提升不再只发生在参数层,它也可以发生在调用层。 为什么 Agent 时代不能只依赖一个模型? 2026 年,大模型市场进入密集迭代期。Claude、GPT、Kimi、GLM 等主流模型几乎每季度都有新版本发布,排行榜的头部位置频繁更替。对应用开发者而言,可选的模型越来越多,但每个模型都有各自的短板。

By PPIO
爆满收官!PPIO构建AI落地“最强朋友圈”

爆满收官!PPIO构建AI落地“最强朋友圈”

WAIC开展前夜,7月16日,我们在上海北外滩组织了一场AI Builders Night。 从模型、Agent 到算力、数据与应用,AI 行业的变化越来越快。 但当热度持续攀升,一个更具体的问题也被反复提起:技术能力不断向前,究竟有多少产品真正进入了业务,进入了用户的工作流,进入了真实世界? 这一次,我们把讨论留给正在一线推进的人。 # 01 重磅圆桌 行业大佬拆解AI落地真相 我们邀请了四位深耕AI产业、落地经验丰富的重磅嘉宾:PPIO 合伙人陆昆仑、明略科技创始人吴明辉、Joulebeat 创始人向涛,以及蚂蚁集团副总裁 & 蚂蚁百灵大模型负责人周俊。 讨论全程聚焦AI创业、产品落地的真实痛点与真实困惑:团队踩过的实战深坑、被用户否决的功能、倒逼产品改版的客户反馈、曾经判断失误的行业决策。 比起复盘“做对了什么”,这些真实的试错成本、尚未解决的行业难题,才是更有参考价值的行业经验。 几位嘉宾以不同赛道、不同视角的观点交锋,展开了激烈的探讨,最终沉淀出统一共识:AI的价值从来不在于单次演示的惊艳效果,而在于能否打通企业数据与系统、适配复杂业务流程,

By luigi