第一部分:零一万物 Yi 版本全景概览
零一万物(01.AI)由李开复博士于2023年3月创立,致力于开发具有国际竞争力的中英双语大模型。公司成立仅8个月估值突破10亿美元,成为“AI六小虎”之一,目前已启动赴港上市进程,从大语言模型制造商转型为企业人工智能基础设施公司。

大语言模型 零一万物Yi各个版本对比
从版本谱系来看,Yi系列已发展出以下主要版本线:


开源基座系列(Yi-6B / Yi-34B / Yi-1.5) :Yi-6B和Yi-34B(2023年11月6日)→ Yi-9B(2024年3月)→ Yi-1.5系列(2024年5月13日,6B/9B/34B)。这是Yi系列的开源根基,以中英双语能力和超长上下文为核心卖点。Yi-34B在发布时即在Hugging Face英文榜单和C-Eval中文评测中夺得全球开源大模型“双料冠军”。


旗舰闭源系列(Yi-Large → Yi-Lightning) :Yi-Large(2024年5月13日,千亿参数闭源旗舰)→ Yi-Lightning(2024年10月16日)。Yi-Large在斯坦福AlpacaEval 2.0评测中英语能力LC Win Rate排名世界第二,仅次于GPT-4 Turbo。Yi-Lightning在LMSYS盲测榜单上排名世界第六、中国第一,API定价仅为$0.14/M tokens。


代码专项系列(Yi-Coder) :Yi-Coder-1.5B / Yi-Coder-9B(2024年9月5日),支持52种编程语言,最大上下文128K tokens,在参数量少于100亿的开源代码模型中提供SOTA性能。


多模态与垂直系列:Yi-Vision(多模态图像理解)、Yi-Medium(均衡性价比)、Yi-Medium-200K(200K超长上下文)、Yi-Spark(轻量高效版本)。


API服务矩阵:零一万物面向国内市场发布了包含Yi-Large、Yi-Large-Turbo、Yi-Medium、Yi-Medium-200K、Yi-Vision、Yi-Spark等多款模型API接口,保证客户在不同场景下都能找到最佳性能与性价比的方案。


第二部分:各版本详细对比与拆解
一、开源基座系列核心对比
维度 Yi-6B Yi-34B Yi-9B Yi-1.5-34B
发布时间 2023年11月 2023年11月 2024年3月 2024年5月
参数规模 6B 34B 9B 34B
上下文 4K/200K 4K/200K 4K 4K/16K/32K
训练数据 3T tokens 3T tokens 0.8T tokens 5000亿tokens持续预训练
MMLU得分 63.2 76.3 — —
开源协议 Apache 2.0 Apache 2.0 Apache 2.0 Apache 2.0
硬件门槛 RTX 3090 4×RTX 4090 RTX 3090/4090 4×RTX 4090
Yi-34B是Yi系列开源战略的奠基之作。在MMLU(5-shot)基准测试中,Yi-34B得分76.3,显著超越Llama 2-34B的62.6和Qwen-14B的66.7。Yi-34B-Chat在MMLU、CMMLU、BBH、GSM8k等所有开源模型的基准测试中排名第一,尤其在MMLU、CMMLU、常识推理和阅读理解方面表现卓越。在部署门槛方面,Yi-34B需要72GB显存(4×RTX 4090或单卡A800 80GB),Yi-6B则可在单卡RTX 3090上运行。


Yi-9B是Yi系列中专攻代码和数学的轻量模型。它基于Yi-6B持续训练,额外使用0.8T tokens进行训练,在代码和数学任务上表现优异,BF16和Int8量化版均可在消费级显卡上部署。


Yi-1.5系列是开源模型的全面升级版。Yi-1.5-34B在包含5000亿个标记的高质量语料库上进行持续预训练,并针对300万个微调样本进行微调,在编码、数学、推理和指令遵循方面表现优异。Yi-1.5分为34B、9B、6B三个版本,且提供了Yi-1.5-Chat微调模型可供开发者选择。


二、旗舰闭源系列核心对比
维度 Yi-Large Yi-Lightning Yi-Large-Preview
发布时间 2024年5月 2024年10月 2025年
参数规模 千亿参数(MoE) 未公开(MoE) 估计200B MoE
上下文 32K 16K 256K
LMSYS排名 — 世界第6、中国第1 —
AlpacaEval 世界第2 — —
API定价(输入) ¥20/百万tokens ¥0.99/百万tokens ¥0.80/百万tokens
核心定位 旗舰通用 高性价比旗舰 长文本增强
Yi-Large是零一万物首个千亿参数闭源旗舰,采用MoE架构。在斯坦福AlpacaEval 2.0经官方认证的排行榜上,Yi-Large的英语能力LC Win Rate排名世界第二,仅次于GPT-4 Turbo,Win Rate更是排名世界第一。Yi-Large的API定价为输入20元/百万tokens、输出20元/百万tokens。


Yi-Lightning是零一万物在性价比维度实现突破的关键产品。在国际权威盲测榜单LMSYS上,Yi-Lightning排名世界第六、中国第一。其API定价低至0.99元/百万tokens,仅为Yi-Large的二十分之一,同时在Chatbot Arena上取得了第6名的成绩。这一性价比优势使Yi-Lightning成为成本敏感型企业的首选模型。


Yi-Large-Preview是零一万物针对中小型应用场景优化的版本,支持256K超长上下文窗口,在推理深度和长文本处理上实现突破。API定价为输入¥0.80/百万tokens、输出¥3.20/百万tokens。其256K上下文窗口可一次性处理整本书籍、长篇报告和大量历史对话记录。


三、代码专项与多模态版本
Yi-Coder 是Yi系列中专攻编程的开源模型,提供1.5B和9B两个规格。最大上下文长度为128K tokens,支持52种主要编程语言。在参数少于100亿的开源代码模型中,Yi-Coder提供了SOTA级别的编码性能,特别适合在本地或边缘设备上进行代码补全和Agent部署。GGUF量化版本进一步降低了部署门槛,可通过Ollama一键运行。


Yi-Vision 是Yi系列的多模态版本,支持图像理解和分析,可应用于智能客服、内容创作等需要视觉理解能力的场景。


Yi-Medium和Yi-Medium-200K 提供均衡的性能与成本组合,其中200K版本特别适合多篇文档内容理解、海量数据分析挖掘和跨领域知识融合等场景。


第三部分:为什么分这么多版本?
Yi系列推出如此丰富的版本矩阵,背后有清晰的战略逻辑。


一、开源闭源双轨:以开源建生态,以闭源做商业
李开复在零一万物成立一周年时明确提出了开源闭源双轨战略。开源模型(Yi-6B/34B/9B/1.5系列)作为技术标杆吸引开发者构建应用生态,在Hugging Face和ModelScope上积累了庞大的下载量和社区贡献。闭源模型(Yi-Large/Lightning)则通过API服务实现商业变现,API平台复用性更强,商业模式更趋近于云服务,能够更快穿透千行百业。


这一策略的精妙之处在于:开源版本为闭源旗舰建立了技术公信力——开发者通过免费使用Yi-34B验证了模型质量后,在商业场景中更倾向于选择同系列的闭源旗舰。Yi-Large在AlpacaEval 2.0上的世界第二成绩,进一步强化了这一信任背书。


二、场景适配与成本分层:从旗舰到轻量的全价位覆盖
Yi系列的版本分化不是简单的参数缩放,而是针对不同业务场景的系统性分化。Yi-Large管旗舰性能,Yi-Lightning管性价比,Yi-Large-Preview管超长文本,Yi-Medium管均衡任务,Yi-Coder管编程开发,Yi-Vision管多模态理解,Yi-Spark管轻量高效部署。


在定价层面,Yi系列覆盖了从0.99元/百万tokens到20元/百万tokens的完整价格带。Yi-Lightning的0.99元定价使其成为成本敏感型客服系统和内容生成场景的首选,而Yi-Large的20元定价则面向对性能有极致要求的复杂推理任务。这种分层定价使企业可以根据业务需求灵活选型,在成本、性能和能力之间找到最优平衡点。


三、技术路线聚焦:从通用基座到垂直深耕
零一万物在技术路线上采取了聚焦策略。Yi-34B以中英双语和200K超长上下文作为差异化卖点,Yi-9B专攻代码和数学,Yi-Coder进一步深耕编程场景。2024年下半年起,公司开始将重心从纯模型研发转向AI Infra和ToB解决方案,推出“如意”数字人解决方案和AI 2.0数字人产品矩阵,涵盖AI伴侣、IP形象、电商直播、办公会议等多个应用场景。这一转型反映了零一万物在商业化路径上的务实选择——与其在通用大模型赛道上与DeepSeek、Qwen等正面竞争,不如聚焦于模型能力与行业场景的深度结合。


第四部分:最著名版本——Yi-Lightning API接入与RAG系统搭建实战
Yi-Lightning是Yi系列中性价比最高的旗舰模型,在LMSYS盲测榜单上取得世界第六、中国第一的成绩,API定价仅为0.99元/百万tokens。以下为完整的部署与RAG系统搭建步骤。


步骤一:环境准备与API密钥获取
前置条件:


零一万物开发者账号(访问 platform.01.ai 注册)


Python 3.8+ 开发环境


基础RAG依赖库


获取API密钥:


登录零一万物API平台


在“API密钥管理”页面创建密钥


保存生成的API Key


步骤二:安装依赖环境
bash
# 创建虚拟环境
python3 -m venv yi_env
source yi_env/bin/activate


# 安装核心依赖
pip install openai llama-index llama-index-embeddings-huggingface
pip install sentence-transformers
步骤三:基础对话调用
python
from openai import OpenAI


client = OpenAI(
    base_url="https://api.01.ai/v1",
    api_key="你的API-Key"
)


response = client.chat.completions.create(
    model="yi-lightning",
    messages=[
        {"role": "system", "content": "你是一个专业的技术助手。"},
        {"role": "user", "content": "请解释MoE架构中稀疏激活的原理"}
    ],
    temperature=0.6,
    max_tokens=2048
)
print(response.choices[0].message.content)
步骤四:搭建RAG智能问答系统
以下示例展示如何结合LlamaIndex与Yi-Lightning构建融合网络文档和本地知识库的RAG问答系统:


python
from llama_index.core import VectorStoreIndex, SimpleDirectoryReader
from llama_index.llms.openai_like import OpenAILike
from llama_index.embeddings.huggingface import HuggingFaceEmbedding


# 配置Yi-Lightning作为LLM
llm = OpenAILike(
    model="yi-lightning",
    api_base="https://api.01.ai/v1",
    api_key="你的API-Key",
    is_chat_model=True
)


# 配置BGE嵌入模型
embed_model = HuggingFaceEmbedding(
    model_name="BAAI/bge-large-zh-v1.5"
)


# 加载本地知识库文档
documents = SimpleDirectoryReader("./knowledge_base").load_data()


# 构建向量索引
index = VectorStoreIndex.from_documents(
    documents,
    embed_model=embed_model
)


# 创建查询引擎
query_engine = index.as_query_engine(llm=llm)


# 执行查询
response = query_engine.query("请总结这份技术文档的核心要点")
print(response)
步骤五:接入开发工具链
Yi-Lightning支持通过OpenAI兼容API接入Aider等编程辅助工具:


bash
# 设置环境变量
export OPENAI_API_BASE=https://api.01.ai/v1
export OPENAI_API_KEY=你的API-Key


# 使用Aider进行代码辅助
aider --model yi-lightning
步骤六:监控与成本优化
关键指标监控:


Token消耗:Yi-Lightning输入0.99元/百万tokens,Yi-Large输入20元/百万tokens


响应延迟:Yi-Lightning面向高并发场景优化


缓存命中率:对高频重复查询场景可大幅降低成本


降本策略:对简单问答和批量文本处理,使用Yi-Lightning或Yi-Spark;对复杂推理和长文本任务,使用Yi-Large-Preview(256K上下文);对编程场景,使用Yi-Coder-9B本地部署。


第五部分:不同版本的实践成果
案例一:零一万物与极逸AI共研游戏产业大模型(基于Yi-Lightning蒸馏版)
2025年11月,零一万物与恺英网络旗下杭州极逸人工智能达成深度合作,联合研发面向游戏行业的产业大模型,并率先在极逸自研AIGC引擎“SOON”中落地,实现从美术、动画、代码到数值的全流程一键游戏生成。


实践成效:零一万物提供Yi系列基座大模型与AI Infra经验,负责通用能力调优、多模态架构及训练框架;极逸AI开放游戏领域数据与SOON引擎插件接口,主导场景化微调、游戏逻辑封装及商业化落地。技术路线上,模型同时输出角色立绘、Spine动画、技能特效与可执行代码,平均生成时长不到30分钟;通过引入“游戏机制一致性”损失,确保生成数值符合策划设定的战斗公式与平衡区间。该方案使用Yi-Lightning 34B MoE蒸馏版,推理成本仅0.12元/千token,可在单卡A800实时运行。2025年Q4完成第一版产业模型并发布SOON 2.0,2026年推出“IP一键游戏化”平台。


案例二:“如意”数字人解决方案(基于Yi-Lightning)
2024年10月,零一万物发布全新旗舰模型Yi-Lightning后,首度对外披露了基于Yi模型构建的一整套大模型ToB解决方案,面向电商直播、办公会议等场景的“如意”数字人解决方案。基于Yi-Lightning模型,零一万物搭建起了包含角色大模型、直播声音大模型、电商话术大模型在内的一整套专用模型基座。


实践成效:央视《新闻直播间》栏目重点报道了Yi-Lightning的模型训练方法论及“如意”数字人解决方案。央视记者现场试用了“如意”数字人——只需对着镜头录制几分钟的画面,上传到系统后编辑想要数字人表达的文字内容,在1至2分钟内即可生成一段数字人视频。在商业落地方面,某头部酒旅企业在接入Yi-Lightning全新加持的“如意”数字人直播后,GMV较此前上升170%。合作案例还包括全国某著名餐饮连锁店和某知名水果连锁店,均取得了显著的GMV提升。


案例三:Yi-34B-Chat-200K多文档理解与知识库构建(基于Yi-34B)
Yi-34B-Chat-200K是Yi系列中专注于超长上下文处理的版本,支持200K上下文窗口,可处理约20至30万个中英文字符,适合用于多篇文档内容理解、海量数据分析挖掘和跨领域知识融合等场景。


实践成效:2024年2月,零一万物发布Yi大模型API并启动邀测,为开发者提供Yi-34B-Chat(0205)和Yi-34B-Chat-200K两种模型。在阿里云魔搭社区,Yi-34B在发布时即获得全球开源大模型“双料冠军”的评价,魔搭第一时间推出了模型部署相关教程,供开发者参考并快速上手。零一万物随后推出面向国内市场的API开放平台,提供包含Yi-Large、Yi-Large-Turbo、Yi-Medium、Yi-Medium-200K、Yi-Vision等多款模型接口,保证客户在不同场景下都能找到最佳性能、最具性价比的方案。Yi-34B-Chat-200K的超长上下文能力使企业和开发者能够在不分段的情况下处理完整的技术文档库、法律合同集或研究报告合集,显著提升了知识密集型工作流的效率。

版权声明:本平台仅提供信息存储空间服务,用户发布内容不代表本站观点,交易风险自担;侵权违法内容请立即举报(邮箱:37996619@qq.com),本站接通知后先行屏蔽,责任由发布者承担。