PPIO上线Qwen3-Embedding系列模型

分享
PPIO上线Qwen3-Embedding系列模型

今天,PPIO 已上线 Qwen3-Embedding 系列模型!

Qwen3-Embedding 系列模型是 Qwen 模型家族的新成员。该系列模型专为文本表征、检索与排序任务设计,基于 Qwen3 基础模型进行训练,充分继承了 Qwen3 在多语言文本理解能力方面的优势。

Qwen3-Embedding 系列模型并非 chat 模型,需要通过 API 调用。现在,您可以到 PPIO 官网接入 API 进行体验。

PPIO 登录地址:

https://ppio.cn/?utm_source=official_wechat

如果你是新用户,填写邀请码【N7EUVY】注册还可以得 15 元代金券。此外,通过你的专属邀请码每成功邀请一位好友并完成实名认证,还可以额外获得 30 元代金券。

你还可以在 Bilibili 网站上搜索【PPIO派欧云】查收关于最新的 Embedding 模型的视频教程。


# 01

什么是 Embedding 模型?

Embedding 模型是一种将离散的符号(如单词、句子、图像等)映射到连续的向量空间中的模型。在自然语言处理(NLP)领域,它通常用于将单词或句子转换为向量形式,以便计算机能够更好地处理和理解语言信息。

训练 Embedding 模型的目标是使相似的符号在向量空间中更接近,不相似的符号更远离。例如“苹果”和“香蕉”两个单词,一个好的文本 Embedding 模型会把它们编码成两个接近的向量。这样,AI 系统就可以通过“向量距离”来判断语义相似性。

Embedding 模型常见的应用场景包括:

语义搜索/RAG:用户提问后,先用向量查找相关文本,再送入大模型回答;

推荐系统:将用户和物品编码成向量,进行向量匹配;

多模态检索:输入一段文字,返回相关图片或视频;

聚类/去重/相似性判断:快速找出文本之间的相似程度。

今天上线的 Qwen3-Embedding 系列模型有两个系列:Qwen3-Reranker(文本重排序) 和 Qwen3-Embedding(文本嵌入)。

Qwen3-Embedding 系列提供从 0.6B 到 8B 参数规模的 3 种模型配置,以满足不同场景下的性能与效率需求。开发者可以灵活组合表征与排序模块,实现功能扩展。

此外,模型支持以下定制化特性:

表征维度自定义:允许用户根据实际需求调整表征维度,有效降低应用成本;

指令适配优化:支持用户自定义指令模板,以提升特定任务、语言或场景下的性能表现。

Qwen3-Embedding 系列在多个下游任务评估中达到行业领先水平。其中,8B 参数规模的 Embedding 模型在 MTEB 多语言 Leaderboard 榜单中位列第一(截至 2025 年 6 月 6 日,得分 70.58),性能超越众多商业 API 服务。此外,该系列的排序模型在各类文本检索场景中表现出色,显著提升了搜索结果的相关性。

Qwen3-Embedding 系列支持超过 100 种语言,涵盖主流自然语言及多种编程语言。该系列模型具备强大的多语言、跨语言及代码检索能力,能够有效应对多语言场景下的数据处理需求。


# 02

在 Cherry Studio 接入PPIO 的 Qwen3-Embedding

由于 Qwen3-Embedding 系列模型并非 chat 模型,需要通过 API 调用。我们以 Cherry Studio 为例进行接入。

(1)获取并保存【 API key 】、【 Base URL 】和【模型名称】

注册并登录 PPIO,然后打开 API 密钥管理页面,点击【创建】按钮,输入自定义密钥名称,生成 API 密钥。

!!!注意:密钥在服务端是加密存储,请在生成时保存好密钥(比如记录在备忘录里);若遗失密钥,可以在控制台上删除并创建一个新的密钥。

PPIO 登录地址为:

https://ppio.cn/?utm_source=official_wechat

然后到模型广场获取模型名和 Base URL,固定地址为:

https://api.ppinfra.com/v3/openai

(2)在 Cherry Studio 中集成 API

下载并安装 Cherry Studio,官网地址为:

https://cherry-ai.com/download

打开 Cherry Studio,点击设置,选择【PPIO派欧云】,输入官网生成的 API 密钥。

点击【添加】,填入所需模型名称。

在导航栏左侧点击知识库并添加,自定义名称后,下拉嵌入模型,会看到刚刚添加的 Qwen3-Embedding-8B 模型,将其添加。

然后上传本地文档,这样一个本地知识库就搭建好了。

回到对话页面,选择刚刚构建的知识库,并点击 @ 添加一个模型。

输入问题,就可以通过本地知识库进行回答了。


热门三方平台集成

PPIO 支持在 20+ 主流平台中调用平台模型。

通用对话客户端:Cherrystudio、LobeChat、Nextchat、ChatHub、Chatbox

代码开发工具:Cursor、CLINE

开发/ API 平台:Dify、OneAPI、RAGFlow、FastGPT

生产力套件集成:Word、WPS Office AI,这些是办公软件集成AI功能。

智能翻译工具:沉浸式翻译、欧路词典、流畅阅读、沉浸式导读。

知识管理工具:思源笔记、Obsidian、AnythingLLM

详细教程:

https://ppio.cn/docs/third-party/overview

阅读更多

PPIO加入中国信通院“算力超银生态共建计划”,探索Token普惠新模式

PPIO加入中国信通院“算力超银生态共建计划”,探索Token普惠新模式

2026 年 9 月 2 日,2026 开放数据中心大会暨首届算博会正式(ODX)在国家会议中心二期盛大开幕,由中国信通院发起的“算力超银生态共建计划”首批生态共建伙伴正式发布。 派欧云计算(上海)有限公司(下面简称 PPIO )作为上海市两家算力超银生态共建伙伴之一正式签约加入该计划,PPIO 董事孔杰受邀参加发布仪式。 后续 PPIO 将围绕“算力超市”、“算力银行”两大创新模式开展研究,探索适配大模型时代的算力交易与资源调度新模式。 “算力超市”方向:搭建或依托现有算力平台,通过“算模数用”测评机制认定资源的商品化展示、标准化计价、在线交易与自动交付,推行按“卡时”“核时”及“Token”计费等灵活计费方式,支持中小企业按需采购、随用随付。 “算力银行”方向:建立算力资源“存入—计费—支取—

By luigi
PPIO入选《2026浦东“人工智能+”创新应用典型案例集》

PPIO入选《2026浦东“人工智能+”创新应用典型案例集》

近日,浦东新区科经委面向浦东人工智能产业征集的《2026 浦东“人工智能+”创新应用典型案例集》正式发布。该案例集共收录浦东 42 个示范与创新案例,涵盖教育、医疗、制造、金融、城市治理、能源、半导体、AI 安全等多个赛道。 派欧云计算(上海)有限公司(以下简称 “PPIO”)成功入选该案例集,PPIO 的基于推理加速技术的智能座舱行业模型解决方案已经在智能网联新能源汽车领域应用落地。 智能座舱行业模型解决方案是 PPIO 面向汽车软件企业打造的 AI 推理服务平台,聚焦闭源模型算力成本高、GPU资源供应不稳定、推理流量峰谷波动大等痛点。 平台通过自研推理加速引擎、PD 分离架构与弹性算力调度,为客户提供低成本、低时延、高弹性的开源大模型推理服务。 平台综合采用算子融合、低精度量化、投机采样等技术,突破逐 Token 串行解码效率瓶颈;引入 PD 分离将

By luigi
PPIO上线“企业Token Plan”:主流旗舰模型最低6折接入,支持200席位

PPIO上线“企业Token Plan”:主流旗舰模型最低6折接入,支持200席位

AI 应用落地进入规模化阶段后,企业面临的挑战已经从“能不能用”变成了“怎么用得起、用得稳、管得住”。 过去一年,模型 API 的调用成本普遍下降了一个数量级,但这并没有让企业的 AI 预算问题消失。主流可用的模型从三五个变成了十几个,每家厂商定价体系不同,缓存机制不同,并发限制也不同。多模型混用的企业团队,往往需要维护多个账户、多套账单,遇到某个模型价格调整或服务波动时处理起来相当被动。 而现在,PPIO 发布的企业 Token Plan,正是要解决这些问题。 一键接入 17 款主流大模型,支持 200 席位 PPIO 企业 Token Plan 是一套标准化的预付费折扣产品,核心机制是“融合 Token”:以 DeepSeek V4 Flash 输入 Token 为基准单位(

By PPIO