WanQian Pro 3.5 正式发布 - 全新智能对话助手
我们非常高兴地宣布,WanQian Pro 3.5 正式发布!这是 WanQian 系列的全新产品,基于 Nvidia 大语言模型构建,通过 OpenRouter API 提供服务。WanQian Pro 3.5 继承了 WanQian 系列「智能、简洁、高效」的设计理念,为用户带来更加出色的 AI 对话体验。
WanQian Pro 3.5 采用了 Nvidia 最新的 Nemotron 系列模型,这是 NVIDIA 自主研发的大语言模型系列,在多项基准测试中表现优异。配合我们的优化调度系统,为用户提供稳定、快速、智能的对话服务。
关于技术架构
WanQian Pro 3.5 的技术架构如下:
- 底层模型:基于 Nvidia Nemotron 系列大语言模型,由 NVIDIA 官方提供技术支持。
- API 接入:通过 OpenRouter 平台统一接入,OpenRouter 是领先的 AI 模型聚合平台,提供稳定可靠的 API 服务。
- 服务优化:Tian-Tech 天天工作室对响应流程进行了优化,提升用户体验。
- 流式输出:支持实时流式响应,让对话更加流畅自然。
产品版本
WanQian Pro 3.5 目前提供两个版本,满足不同用户的需求:
- WanQian Pro 3.5
基于 Nvidia Nemotron-3-Ultra-550B 模型,拥有 5500 亿参数,兼顾性能与响应速度,适合日常对话、知识问答等场景。
📊 性能数据:Context 1M | 吞吐量 36 tok/s | 延迟 2.01s - WanQian Pro 3.5 Deeper
基于 Nvidia Nemotron-3-Super-120B 模型,拥有超 1200 亿参数,能力更强,适合复杂问题分析、深度推理等场景。
📊 性能数据:Context 262K | 吞吐量 62 tok/s | 延迟 1.28s | 发布于 2026年3月
Pro 系列 vs GLM 系列:重装坦克与轻装尖兵
WanQian Pro 3.5 系列的 NVIDIA 模型与历史版本的 GLM 模型走的是完全不同的技术路线,适用于不同的场景。
一句话概括:WanQian Pro 的两个 NVIDIA 模型是"重装坦克",GLM 系列是"轻装尖兵"。
核心架构与参数:体量悬殊
这是三者最根本的区别,决定了它们的"智力上限"和运行效率。
| 特性 | WanQian Pro 3.5 Nemotron-3-Ultra-550B |
WanQian Pro 3.5 Deeper Nemotron-3-Super-120B |
GLM-4.7-Flash |
|---|---|---|---|
| 总参数量 | 550B (5500亿) | 120B (1200亿) | ~30B |
| 激活参数量 | 55B | 12B | 3B |
| 模型架构 | MoE + Mamba-2 | MoE | MoE + MLA |
| 上下文窗口 | 1M | 262K | 200K |
性能基准测试
在公开的基准测试中,体量更大的 NVIDIA 模型在综合能力上优势明显。
- 综合评分:Nemotron-3-Ultra-550B 在综合评测中平均得分高达 8.1,远超 GLM-4.7-Flash 的 4.3
- 编程能力:GLM-4.7-Flash 在 SWE-Bench 测试中得分 59.2,表现不错。但 Ultra-550B 在相似测试中得分更高
- 通用知识:在 MMLU 测试中,Ultra-550B 准确率高达 89.08%,远超 GLM-4.5 的 86.50%
成本与速度
三款模型在 OpenRouter 上都是完全免费的,没有调用成本的压力。
- 响应速度:Nemotron-3-Ultra-550B 平均响应时间约 2.01秒,而 GLM-4.7-Flash 约 35秒。更"聪明"的模型,思考速度反而可能更快
- 吞吐量:Deeper-120B 在吞吐量上表现惊人,是同尺寸模型的 2.2倍到7.5倍
总结
- WanQian Pro 3.5 (Ultra-550B) - "旗舰大脑":追求极致性能和智力,适合复杂逻辑、深度研究等高难度任务
- WanQian Pro 3.5 Deeper (Super-120B) - "效率先锋":性能和资源消耗最佳平衡,适合高并发、大规模应用
- GLM 系列 - "敏捷尖兵":以极低成本提供可观性能,适合轻量化、高并发场景
核心特性
- 强大的语言理解能力:基于 Nvidia Nemotron 模型,能够准确理解用户意图,进行自然流畅的对话。
- 多轮对话支持:支持多轮上下文对话,保持对话连贯性。
- 代码能力:具备良好的代码理解和生成能力,可辅助编程开发。
- 知识问答:涵盖广泛的知识领域,提供准确的信息解答。
- Markdown 支持:支持代码块、粗体、链接等格式,回复更丰富。
- 快速响应:经过优化,响应速度快,体验流畅。
技术优势
- Nvidia 官方模型:采用 NVIDIA 自主研发的大语言模型,技术背景雄厚。
- OpenRouter 稳定接入:通过 OpenRouter 平台统一管理,保证服务稳定性。
- 免费使用:接入免费模型,降低使用门槛。
- 持续更新:随着模型版本更新,服务能力持续提升。
使用方法
使用 WanQian Pro 3.5 非常简单:
- 访问 WanQian Pro 3.5 页面
- 在顶部选择您想使用的版本(Pro 3.5 或 Pro 3.5 Deeper)
- 在输入框中输入您的问题,按 Enter 发送
- 即可获得 AI 的智能回复
版本选择建议
- 选择 WanQian Pro 3.5:日常使用、简单问答、响应速度优先的场景
- 选择 WanQian Pro 3.5 Deeper:复杂问题、深度分析、专业领域咨询等场景
注意事项
- 每日调用限制:本服务基于 OpenRouter 免费模型,每日限制 50 次对话请求,请合理使用。
- 无优速通:WanQian Pro 3.5 系列不提供优速通服务,所有用户共享免费额度。
- 免费模型会不断更新优化,实际能力可能随官方更新而提升。
- 当前版本不支持图片输入等多模态功能。
- 对话记录不会保存,刷新页面后会自动清空。
- 如遇服务不稳定,可能是免费模型负载较高,建议稍后重试。
关于 Tian-Tech
WanQian Pro 3.5 由 Tian-Tech 天天工作室提供服务。Tian-Tech 是一家专注于 AI 应用的小型工作室,致力于为用户提供优质的 AI 对话服务。
特别说明:WanQian 是 Tian-Tech 的自有品牌,基于 NVIDIA 模型和 OpenRouter API 构建,与 NVIDIA 官方无直接关联。服务内容和质量由 Tian-Tech 独立负责。
常见问题
- Q: WanQian Pro 3.5 和 WanQianW2 有什么区别?
A: WanQian Pro 3.5 基于 Nvidia Nemotron 模型,WanQianW2 基于 GLM 模型,两个产品使用不同的底层模型。 - Q: 为什么有时候响应很慢?
A: 免费模型有调用频率限制,高峰期可能会比较慢,建议避开高峰期使用。 - Q: 可以商用吗?
A: 请参考 OpenRouter 和 NVIDIA 的使用条款。 - Q: 如何切换版本?
A: 在页面顶部的模型选择器中点击即可切换。
感谢您对 WanQian 的支持!欢迎体验 WanQian Pro 3.5,感受 Nvidia 模型的强大能力。如果您有任何问题或建议,欢迎随时反馈。
← 返回产品文档