Kimi K3
官方当前旗舰模型,原生支持视觉理解,拥有 1M token 上下文,适合长程编程、知识工作、深度推理、复杂 Agent 与多模态企业流程。
recommended model
model: "kimi-k3" context: 1,000,000 tokens reasoning_effort: "max" vision + tools + agent企业级 Kimi 大模型服务
覆盖 Kimi 全模型的企业接入、部署与自动化场景,帮助研发、客服与知识工作团队把模型真正用进业务。
Official Model Matrix
最新旗舰放在第一位,下面再按编程、速度、通用能力与存量迁移选择模型。
官方当前旗舰模型,原生支持视觉理解,拥有 1M token 上下文,适合长程编程、知识工作、深度推理、复杂 Agent 与多模态企业流程。
recommended model
model: "kimi-k3" context: 1,000,000 tokens reasoning_effort: "max" vision + tools + agentkimi-k2.7-code面向长程编程、代码库理解、工具调用和复杂工程任务。
256K 上下文 · 文本 / 图片 / 视频 · 思考模式kimi-k2.7-code-highspeedK2.7 Code 高速版,适合对响应速度更敏感的编程和自动化任务。
官方文档称常规场景约 180 Token/s,具体以资源情况为准kimi-k2.6通用 Agent、代码、图像与视频理解,支持思考和非思考模式。
256K 上下文 · 对话与 Agentkimi-k2.5多模态与 Agent 能力完整,适合已有系统迁移期间的兼容评估。
官方提示:已停止向新注册用户开放,计划迁移到新模型moonshot-v18K、32K、128K 文本及视觉模型,服务存量系统迁移时使用。
官方模型列表已标注下线计划,不建议新项目选用模型名称、价格、限速、地区和开放状态会变化,最终以 Kimi 官方模型列表及实际渠道页面为准。
Access Channels
按企业希望的速度、控制权和运维方式,选择直连、工具链、推理平台或本地部署。
直接使用 Kimi 官方 API,适合快速接入企业应用、内部助手和在线业务。
适合:先上线、快速验证、持续调用
通过官方集成把 Kimi 接入编程 Agent,用于代码库理解、修复、重构和团队开发。
需要安装 OpenCode,并使用自己的 Kimi 账号或 API Key
按平台当前可用情况选择 Kimi K3、K2.7 Code 等 Serverless API 或专属 GPU 部署。
适合:海外部署、弹性推理、专属资源
围绕权重、算力、网络、数据边界和权限体系,评估本地或专有环境部署路径。
不承诺通用硬件方案,需按模型与并发单独评估
通过统一网关接入多个渠道,处理路由、密钥隔离、日志、限流和成本分摊。
第三方授权、模型版本、地区和计费必须逐项核验
Integration Layer
模型只是起点,还要把密钥、权限、路由、日志和业务系统接起来。
按 OpenAI 兼容格式接入 Kimi,降低业务系统改造成本。
按任务在 K3、K2.7 Code、K2.6 和其他可用模型之间分流。
隔离环境、项目和团队权限,减少密钥外泄与误用风险。
接入 Tool Calling、知识库、批处理和企业内部工作流。
const response = await fetch(
"/v1/chat/completions",
{
method: "POST",
headers: {
"Authorization": `Bearer ${API_KEY}`,
"Content-Type": "application/json"
},
body: JSON.stringify({
model: "kimi-k3",
messages: [
{ role: "user", content: "你好" }
]
})
}
);Enterprise Use Cases
把 Kimi 放进已有系统和团队流程,具体实施范围根据数据、权限和验收要求确认。
把 Kimi 接入官网、客服、内部系统和业务后台,统一 API、权限与日志。
围绕本地网络、数据边界、算力和并发,评估私有环境部署方案。
为研发、运营、采购和管理团队建立受控的内部模型调用入口。
处理图片、视频、长文档和复杂任务,适合知识审核与视觉分析。
将模型、网关、数据和权限放进可控环境,按业务合规要求规划边界。
用 OpenCode、知识库和团队规范统一代码、文档与协作流程。
组合工具调用、批处理和定时任务,处理报告、分类、抽取与通知。
将企业资料接入检索和工具链,让模型回答有来源、动作可追踪。
Delivery Path
把模型能力、调用渠道、数据边界和实施责任一次说清楚。
明确模型、场景、并发与数据类型
比较官方 API、工具链、推理平台和自部署
完成密钥、路由、权限和样例测试
按约定推进上线、监控与后续支持
FAQ
K3 更适合长上下文、视觉理解、深度推理和复杂 Agent;K2.7 Code 偏编程;K2.6 偏通用 Agent、代码和多模态理解。最终按任务、延迟、额度和预算确认。
官方 API 直接连接 Kimi 开放平台;Fireworks 提供自己的推理平台与部署形态。模型、价格、地区、限速和数据处理规则分别以对应平台为准。
OpenCode 是编程 Agent 工具,不是模型供应商。官方文档提供了接入中国区 Kimi 开放平台的方式,使用时仍需配置自己的账号或 API Key。
通常通过统一网关或内部服务封装模型 API,再增加成员权限、密钥隔离、日志、预算和敏感数据规则。
需要先确认目标模型权重、许可、显卡与网络环境、并发和数据边界,再判断本地部署、专属资源还是 API 接入更合适。
官方模型列表已标明部分旧模型进入下线或迁移阶段。新项目建议优先使用当前可用模型,存量系统再单独制定迁移计划。
Contact Us
告诉我们你要用哪个模型、通过哪个渠道、接入什么系统,或者是否需要企业自部署。