Yi 系列(零一万物)

★★★★★ 4.4 分

零一万物李开复团队的开源大模型,中文质量扎实、尺寸覆盖全,Apache 2.0 许可适合商用部署。

中文通用开源全尺寸
参数量Yi-1.5 6B / 9B / 34B
模型类型对话大语言模型
许可证Apache 2.0
开发者零一万物(01.AI)
★★★★★ 4.2

李开复创立的Apache全开放中文系列

中文开源Apache大模型

模型介绍

Yi 系列由李开复创立的零一万物(01.AI)出品,覆盖 6B/9B/34B 三个主力尺寸,2023 年发布的 Yi-34B 与 Yi-1.5 系列在多语言与中文评测上表现扎实,且全部采用 Apache-2.0 许可,无需任何限制即可商用。系列还包含 Yi-Coder(编程)与 Yi-VL(视觉)变体,并有 6B-200K 等长上下文版本。虽然 2024 年后主力迭代放缓,但干净的开源许可以及对中文的良好支持,让 Yi 仍是合规商用与轻部署的有力选项。

模型基本信息

开发机构零一万物(01.AI)
模型版本Yi-1.5(2024)
参数规模6B / 9B / 34B(Yi-1.5);+ Yi-Coder-9B、Yi-VL-34B 变体
模型类型文本对话 / 通用大模型
许可证Apache-2.0
上下文长度16K(默认);32K;另有 6B-200K 长上下文版
发布日期2023-11-22(Yi-34B-Chat);2024-05-10(Yi-1.5-34B-Chat)
模型架构Llama 架构(Decoder-only Transformer + GQA),扩展 304K 词表的双语 BPE tokenizer

模型能力

中文能力很强
英文能力很强
代码能力中(Yi-Coder 强)
推理能力中
长文本能力强(200K 版)
视觉能力中(Yi-VL)
工具调用中

模型版本

Yi-1.5-34B-Chat34BYi-1.5-9B-Chat9BYi-1.5-6B6BYi-Coder-9B9B 编程Yi-VL-34B34B 视觉

模型获取

部署方式

OllamaLM Studiollama.cppvLLMtransformers

显存需求

Yi-6B Q4约4GB
Yi-9B Q4约6GB
Yi-34B Q4约20GB

硬件推荐

RTX 3060Yi-6B/9B(Q4)
RTX 3090Yi-34B Q4 约20GB
RTX 4090Yi-34B Q4 舒适
RTX 5090Yi-34B FP16
MacM 系列 6B/9B 流畅

推荐配置

入门RTX 3060 12G + Yi-9B Q4 约6GB
进阶RTX 3090 24G + Yi-34B Q4 约20GB
专业RTX 4090/5090 + Yi-34B FP16 或长上下文 6B-200K

为什么选择这个模型

  • Apache-2.0 干净可商用
  • 34B 中有突出中文表现的成熟选择
  • 轻量尺寸对消费级友好
  • 有 200K 长上下文版本

模型优点

  • Apache-2.0 无限制商用
  • 中文质量扎实
  • 6B/9B 轻量,34B 单卡可跑
  • Yi-Coder/Yi-VL 覆盖编程与视觉
  • 长上下文 200K 版

模型缺点

  • 2024 后主力迭代放缓
  • 社区生态热度下降
  • 推理与代码上限低于同期旗舰
  • 多模态(Yi-VL)成熟度一般

适合场景

  • 中文合规商用
  • 轻量私有化部署
  • 长文本处理(200K 版)
  • 教学与迁移学习
  • 双端(端侧+服务)

不适合场景

  • 最前沿推理/竞赛题
  • 最新 Agent 框架首选
  • 追求最大参数旗舰
  • 需要活跃维护的项目

部署教程

Ollama
ollama run yi:34b(或 yi:6b-200k 体验长上下文)
LM Studio
LM Studio 搜索 01-ai yi 下载 GGUF → 加载 → 使用
llama.cpp
./llama-cli -m yi-1.5-34b-chat-q4_k_m.gguf -p 提示词 -ngl 999
vLLM
pip install vllm && vllm serve 01-ai/Yi-1.5-34B-Chat-16K

智算工坊实验室

实测速度Yi-9B/34B Q4 实测 ≈35-40 token/s(RTX 3060/3090)
显存占用9B Q4 约6GB;34B Q4 约20GB
功耗单卡满载约170W
不同 GPU 对比34B 在 3090 与 4090 差距约 15-20%;200K 版本需预留大 KV Cache
→ 查看实验室数据

常见问题 FAQ

Yi 还值得使用吗?

若你要 Apache 许可的中文模型且不想追新,Yi 依然稳健;追求最新能力则建议 Qwen3.5/GLM-5 等新一代。

Yi 的 200K 版本怎么用?

Yi-6B-200K / 9B-200K 专为长上下文训练,ollama 标签 yi:6b-200k,需注意 KV Cache 显存占用。

相关模型

相关工具

相关硬件

相关文章

数据来源

  • https://huggingface.co/01-ai/Yi-1.5-34B-Chat
  • https://huggingface.co/01-ai/Yi-1.5-9B-Chat-16K
  • https://huggingface.co/01-ai/Yi-6B-200K
  • https://www.01.ai/