K3采用稀疏混合专家架构,总参数2.8万亿,单Token推理实际激活约1040亿参数。它原生支持图像理解与百万Token上下文,核心发力智能体场景的长程代码生成、工具调用。
此次发布的意义不止于国产大模型参数再突破,更关键的是国内团队首次将该量级前沿模型的权重、推理逻辑与部署入口,全面开放给技术社区自主探索。
但需厘清认知:这里的开源并非人人可本地部署。2.8T级模型对显存、带宽、推理框架及集群调度要求极高,硬件门槛突出。普通开发者更现实的路径,是等vLLM、SGLang等推理框架适配、云端服务上线及量化版本推出后,通过接口调用使用其能力。
真正值得关注的是它在开源生态的真实表现:代码智能体能否稳定落地、长上下文是否信息衰减、视觉与工具调用能否嵌入真实工作流。开放权重不是终点,能被社区复用、改造与验证,才算真正在开源赛道站稳脚跟。KimiK3模型开源
