Kimi K3 完全使用指南
模型核心参数
- 总参数量:2.8 万亿(官方数据)。
- 架构特性:原生支持视觉理解。
- 上下文上限:最高 100 万(1M)token,但非全局统一,取决于具体入口和会员档位。
- 上下文长度分配(关键差异)
- 网页 Agent:128K。
- Kimi Code (Moderato 档):256K。
- Kimi Code (Allegretto 及以上档):1M。
- 第三方 Coding Agent:需手动将最大上下文设为 1,048,576。
开源状态说明
- 定位:全球首个开源的 3 万亿级模型。
- 时效性:截至 2026 年 7 月 17 日,完整权重尚未全部放出,官方承诺最迟于 7 月 27 日发布。
四大产品入口与能力边界
- 网页 Agent:面向普通用户,执行云端资料调研与整理。限制:上下文 128K,单次任务输出单个文件,复杂任务建议分轮处理。
- Kimi Work:桌面端应用,可挂载本地文件夹,执行文件读取、目录整理,运行 Python/Shell,并通过 WebBridge 操作浏览器。关键:涉及敏感登录态和文件操作,需严格限制授权目录,谨慎赋予执行权限。
- Kimi Code:终端命令行 Coding Agent。核心能力:读取现有项目、执行代码修改、运行测试和验证。安全机制:默认在写文件和执行命令前弹窗审批(/yolo 可跳过,需谨慎使用)。
- API:面向开发者,模型 ID 为 kimi-k3,兼容 OpenAI SDK。关键细节:视觉输入需用 Base64 或 ms:// 文件 ID;思考模式固定为 max;max_completion_tokens 最高可设 1,048,576。
API 定价(截至 2026-07-17)
- 缓存命中输入:2 元 / 百万 token。
- 缓存未命中输入:20 元 / 百万 token。
- 输出:100 元 / 百万 token。
给 Agent 的任务编写范式
建议采用六段式结构:背景、角色、材料、限制、交付物、验收标准。将模糊的人类意图显式化为机器可执行的规则,是有效使用 Agent 的前提。
风险与注意事项
- 权限管理:赋予文件夹、浏览器和终端权限时需极度审慎,遵循最小权限原则。
- 事实核查:Agent 输出的数据(特别是引用和数字)必须回溯原始链接或文件进行核验,不可轻信。
- 稳定性:从其他模型切到 K3 或客户端未完整回传思考内容时,输出可能不稳定,建议开启新会话操作。