国内外主流大语言模型全景盘点
根据Arena发布的最新全球大模型实力排行(从AI Agent角度考察模型在长流程任务中的自主执行能力),前10名中美各占5家。
根据Arena发布的最新全球大模型实力排行(从AI Agent角度考察模型在长流程任务中的自主执行能力),前10名中美各占5家。
DeepSeek 是由深度求索公司开发的大语言模型系列,自2023年首次发布以来,已形成覆盖通用对话、推理编程、代码生成、多模态理解等多场景的完整产品矩阵。
Kimi 是由北京月之暗面科技有限公司开发的大语言模型系列,自2023年10月首次发布以来,已从一款主打超长上下文理解的对话助手
豆包大模型是字节跳动旗下火山引擎推出的自研大语言模型,原名“云雀”,于2024年5月15日在火山引擎原动力大会上正式发布,主力模型pro-32k版定价较行业低99%。
文心一言是百度基于文心大模型技术推出的生成式AI产品,自2023年3月16日启动邀测以来,经历了从ERNIE 3.5到ERNIE 5.1的多次重大升级。
腾讯混元(Tencent Hy)是腾讯全链路自研的大语言模型系列,最早可追溯至2021年腾讯推出的千亿规模NLP大模型,2022年进一步推出万亿参数NLP稀疏大模型。
百川智能由前搜狗CEO王小川和茹立云于2023年4月10日联合创立,专注于研发通用人工智能基础大模型及上层应用,核心团队由来自搜狗、百度、华为、微软、字节、腾讯等企业的顶尖AI人才组成。
MiniMax(稀宇科技)成立于2022年初,是国内率先完成文本、语音、视频、图像、音乐五大模态全线自研的大模型公司。
讯飞星火是科大讯飞自主研发的认知大模型系列,自2023年5月6日正式发布以来,已从早期的通用对话模型演进为覆盖深度推理、多语言、多模态、端侧部署的全栈模型矩阵。
LongCat(龙猫)是美团旗下LongCat团队开发的大语言模型系列,专注于智能体(Agentic)任务场景下的实用性与推理效率。
阶跃星辰(StepFun)由前微软全球副总裁姜大昕于2023年4月在上海创立,核心团队包括首席科学家张祥雨、CTO朱亦博等AI领域顶尖专家,位列“国产大模型六小虎”之一。
OpenAI 的 GPT 系列从 2018 年的 GPT-1 走到 2026 年的 GPT-5.6,完整跨越了三个时代:纯规模竞赛时代、产品与多模态时代,以及自 o1 开启的推理时代。
Anthropic 由前 OpenAI 研究副总裁 Dario Amodei 于 2021 年创立,以“宪法 AI(Constitutional AI)”为技术底色,旗下 Claude 系列已成为全球
Gemini 是谷歌 DeepMind 团队开发的多模态大模型系列,最早可追溯至 PaLM 和 PaLM 2 的迭代积累,于2023年12月6日正式发布。
Meta Llama(Large Language Model Meta AI)是全球最具影响力的开源大模型系列,由Meta AI团队开发。
Mistral AI 由前 DeepMind 研究员 Arthur Mensch、前 Meta AI 研究员 Guillaume Lample 和 Timothée Lacroix 于2023年5月在
Grok 是埃隆·马斯克于2023年7月创立的 xAI 公司旗下旗舰大语言模型系列,核心团队来自 Google DeepMind、OpenAI 等顶尖机构,曾参与 GPT、AlphaStar 等项目。