Deepseek、智谱、MiniMax 集体宣布上新
2026.02.12
2026年2月,中国AI大模型领域迎来密集发布期,DeepSeek、智谱AI和MiniMax三大厂商集体宣布技术升级:DeepSeek推出V3.2正式版及专注高难度数学的V3.2-Special版本,并预告将于2月中旬发布新一代旗舰模型V4;智谱AI确认其新模型GLM-5已在chat.z.ai平台上线,该模型此前以"Pony Alpha"身份登顶全球模型服务平台OpenRouter热度榜首;MiniMax则宣布M2.5模型即将正式上线,目前已在海外MiniMax Agent产品中进行内测。此次集体上新标志着中国大模型行业在技术迭代与商业化路径上进入新阶段。
3 个来源
三大厂商密集发布最新模型

DeepSeek近期在模型性能上实现显著突破,其V系列模型已迭代至V3.2正式版,该版本在2025年12月推出,进一步强化了推理与Agent(智能体)能力。同时,DeepSeek还推出了专注于攻克高难度数学和学术问题的特殊版本V3.2-Special,针对专业领域需求进行优化[1]

智谱AI于2月11日晚正式确认,此前在全球模型服务平台OpenRouter登顶热度榜首的神秘模型"Pony Alpha"实为其新一代基座模型GLM-5。目前该模型已在chat.z.ai平台上线,标志着智谱在基础模型研究上的重要进展。值得注意的是,智谱于2026年1月8日在港交所正式挂牌上市,公司首席科学家、清华大学计算机系教授唐杰在挂牌当日的内部信中已预告GLM-5"即将发布",并宣布自2026年起"全面回归基础模型研究"[1]

MiniMax方面,其M2.5模型即将正式上线,目前该模型已在海外的MiniMax Agent产品中进行内测。此外,MiniMax近期还开源了首个面向Coding Agent的系统性评测集OctoCodingBench,旨在为下一代AGI的落地标准提供更清晰的评估框架[2]

技术创新突破性能瓶颈

DeepSeek团队近期在技术架构上取得重要突破,其发表的两篇论文公开了两项创新架构:mHC(流形约束超连接)技术用于优化深层Transformer信息流动,使模型训练更稳定、易扩展,能在不增加算力负担的前提下提升性能;Engram(条件记忆模块)则将静态知识与动态计算解耦,利用廉价DRAM存储实体知识,释放昂贵HBM专注推理,显著降低长上下文推理成本[1]

在上下文长度方面,DeepSeek已将模型支持的上下文长度提升至1M(百万)Token,远超去年8月发布的V3.1版本的128K。目前,能将上下文推至百万级别的模型较少,全球范围内仅有谷歌的Gemini系列和Anthropic的Claude Opus 4.6等少数模型实现这一突破[1]

MiniMax的OctoCodingBench评测结果显示,部分开源模型在过程合规指标上已快速逼近甚至超越部分闭源模型,为Coding Agent的发展提供了重要参考。与此同时,百川智能也宣布开源新一代医疗大模型Baichuan-M3,该模型在全球最权威的医疗AI评测HealthBench中以65.1分的综合成绩位列全球第一,在HealthBench Hard上以44.4分的成绩夺冠,首次在医疗领域实现对GPT-5.2的超越[2]

商业化路径呈现明显分化

随着智谱AI与MiniMax相继上市,曾被市场冠以"AI大模型六小虎"称号的几家企业,其发展路径已现明显分化。DeepSeek以"开源、免费、高性能"的大模型策略震撼市场,彻底打乱了原有竞争节奏,各行各业企业纷纷拥抱其开源模型以快速低成本集成AI能力[1]

智谱AI选择深化To B赛道,主要收入来自为金融机构、大型企业等大客户提供本地化部署的模型及服务(MaaS),与DeepSeek形成"闭源vs开源"、"项目制vs平台化"的差异化竞争格局[1]。智谱在上市后设立前沿创新部门X-Lab,聚焦架构、学习范式与持续进化三大方向,强化基础研究能力[2]

MiniMax则专注To C端市场,主要收入来自面向全球个人用户的AI原生应用(如Talkie、海螺AI)订阅和服务,互联网产品化特征明显。MiniMax多次强调自身的AGI理想,2025年初,CEO闫俊杰对外表示,公司重要目标不是增长或收入,而是"加速技术迭代"[1][3]。MiniMax的战略重心放在提升用户体验和智能上限,而非单纯追求用户数量增长[3]

行业格局与未来展望

艾媒咨询CEO兼首席分析师张毅表示,智谱和MiniMax的上市将加速资本的头部集中,为大模型及相关AI企业产品的合理估值和定价提供重要参考。在此背景下,中小厂商更多聚焦于垂直领域或边缘部署以实现差异化竞争[1]

行业专家预计,DeepSeek的下一代模型V4将在2026年春节前后正式发布,该模型将具备更强的写代码能力。科技媒体The Information此前爆料称,DeepSeek将在2月中旬农历新年期间推出这一新一代旗舰AI模型[2]

针对"AI热潮是否是泡沫"的讨论,智源研究院认为,推理优化在2025年的实践探索远未触及天花板,2026年该领域进展仍将是支撑AI大规模应用的关键因素,"技术泡沫"是假命题[1]。随着各大厂商加速技术迭代,中国大模型行业正从单纯追求参数规模转向注重实际应用价值和商业化落地能力,行业竞争进入更加理性和务实的新阶段[3][1]

本内容由AI生成