Kimi K3 怎么用?从网页端、API 到本地部署的完整指南
Kimi K3 是月之暗面(Moonshot AI)于 2026 年 7 月 16 日发布的旗舰大模型。它拥有 2.8 万亿 参数,采用混合专家(MoE)架构,支持 100 万 token 的超长上下文,并原生支持视觉理解。
目前,使用 Kimi K3 主要有三种途径:官方产品体验、API 调用和本地部署。你可以根据自己的需求和技术水平选择最适合的方式。
📌 本文大纲
- 途径一:通过 Kimi 官方产品使用(零门槛)
- 途径二:通过 Kimi Code 使用(适合开发者)
- 途径三:通过 API 调用(适合开发者)
- 途径四:本地部署(需等待开源权重)
- 总结
一、途径一:通过 Kimi 官方产品使用(零门槛)
这是最简单的使用方式,无需任何技术配置,适合所有用户。
操作步骤:
- 打开浏览器,访问 Kimi 官网:
https://www.kimi.com。 - 注册或登录你的 Kimi 账号。
- 在聊天界面中,点击输入框上方的模型切换按钮。
- 从模型列表中选择
K3或K3 Swarm。K3:综合能力最强的模型,适合日常对话与 Agent 任务。K3 Swarm:适合大规模搜索与批量处理场景。
- 在输入框中输入你的问题或指令,Kimi K3 将开始工作。
Kimi K3 目前已在 Kimi 网页端、Kimi Work 桌面客户端和 Kimi Code 中上线。在 Kimi Work 中,你可以完成创建复杂可编辑文档或运行多步骤任务。
二、途径二:通过 Kimi Code 使用(适合开发者)
Kimi Code 是月之暗面推出的终端与 IDE 编程智能体,能将 Kimi K3 转化为一个能在代码仓库中自主工作的 Agent。它适合需要处理大型代码库、执行复杂工程任务的开发者。
操作步骤:
- 安装并认证:安装 Kimi Code 命令行工具,并使用你的 Kimi 账号登录认证。
- 进入项目目录:在终端中,进入你的项目文件夹。
- 启动 Kimi Code:在项目目录下运行 Kimi Code CLI。
- 选择模型:在会话中输入
/model命令,从列表中选择k3。 - 分配任务:用自然语言描述你的编程任务,Kimi K3 将自动规划、编辑、运行并校验自己的工作。
注意:Kimi Code 目前提供k3(Kimi K3 旗舰版)和kimi-for-coding(K2.7 Code 标准版)等模型。切换模型会使已建立的缓存失效,建议在新会话中进行切换。
三、途径三:通过 API 调用(适合开发者)
Kimi K3 提供了兼容 OpenAI 格式的 API,你可以将其集成到自己的应用或工作流中。
准备工作:
- Python 3.9+ 或 Node.js 18+
- 在 Kimi API 平台(
platform.kimi.ai)注册并获取 API Key
Python 代码示例:
from openai import OpenAI
client = OpenAI(
api_key="你的Kimi API Key",
base_url="https://api.moonshot.ai/v1" # 或 https://api.kimi.ai/v1
)
response = client.chat.completions.create(
model="kimi-k3",
messages=[
{"role": "system", "content": "You are a helpful coding assistant."},
{"role": "user", "content": "Write a Python function to parse nested JSON."}
],
temperature=0.7,
max_tokens=2048
)
print(response.choices[0].message.content)API 关键信息:
- Model ID:
kimi-k3 - Base URL:
https://api.moonshot.ai/v1 - 上下文窗口:最高 1,048,576 tokens
- 推理模式:始终启用,当前仅支持
reasoning_effort: "max"
API 定价参考(每百万 tokens):
- 缓存命中输入:$0.30
- 未缓存输入:$3.00
- 输出:$15.00
四、途径四:本地部署(需等待开源权重)
月之暗面承诺,Kimi K3 的完整模型权重将于 2026 年 7 月 27 日 前开源。届时,开发者可以下载并本地运行模型。
重要提醒:
- 截至目前(2026 年 7 月 20 日),Kimi K3 的权重尚未公开下载。
- Kimi K3 拥有 2.8 万亿参数,官方建议采用 64 张以上加速卡 组成的超节点进行部署。这对个人开发者或小型团队来说,硬件门槛极高。
- 更现实的方案是,在权重开源后,通过托管推理服务或云平台来使用。
五、总结
Kimi K3 的使用方式可以根据你的需求灵活选择:
| 使用方式 | 适合人群 | 特点 |
|---|---|---|
| Kimi 官方产品 | 所有用户 | 零门槛,开箱即用,体验完整功能 |
| Kimi Code | 开发者 | 在终端和 IDE 中处理大型代码库,实现 Agent 式编程 |
| API 调用 | 开发者 | 集成到自有应用,兼容 OpenAI 格式 |
| 本地部署 | 有强大硬件资源的团队 | 需等待 7 月 27 日开源权重,硬件要求极高 |
对于绝大多数用户,通过 Kimi 官网或客户端直接使用是最便捷的方式。开发者可以优先考虑 Kimi Code 或 API 调用。本地部署则需要强大的硬件支持,并等待开源计划的落地。
💡 如果你正在寻找能将大模型能力转化为实际业务生产力的工具,可以了解 实在Agent。它通过“TARS 大模型 + ISSUT 屏幕语义理解 + RPA 引擎”的全栈架构,无需 API 即可直接操作各类业务系统,将 AI 的理解转化为跨系统执行力。已服务超 6000 家制造、能源、交通航空、跨境、医药、电商等行业企业。访问实在智能官网(www.ai-indeed.com)即可申请试用。
本文内容通过AI工具匹配关键字智能整合而成,仅供参考,实在智能不对内容的真实、准确或完整作任何形式的承诺。如有任何问题或意见,您可以通过联系contact@i-i.ai进行反馈,实在智能收到您的反馈后将及时答复和处理。




