Kimi K3 发布并当日打通全生态部署
Kimi K3 正式发布:2.8T 参数 MoE 架构、100 万 token 上下文、原生视觉能力。发布当天即获得 vLLM 官方部署指南与 SkyPilot day-0 完整 serving 栈支持,并上线 DigitalOcean Serverless Inference;Cursor 宣布接入(CursorBench 得分接近前沿),由 Fireworks、Together、Baseten 提供美国本土推理并支持零数据保留。Fireworks 自称发布时唯一与官方质量持平的提供商,AA 上达 165 tok/s。
- 为什么重要
- 这是近期罕见的'发布即全栈落地'案例:开源推理栈、云平台、编程工具、合规托管在同日齐备,显示大模型竞争已从模型能力比拼转向部署速度、生态响应与企业合规承诺的综合较量。对开发者而言,K3 在多条路径上均可立即使用。
- 趋势影响
- K3 进入主流 AI 编程工具且性能接近前沿,加上美国本土推理和零数据保留支持,降低了企业合规顾虑,对 Cursor 用户是可立即启用的新模型选项。
- 置信度 / 来源数
- 高 · 5 条来源 · 4 位达人



