Pi 配置 DeepSeek V4.1 Flash

本文核查时间:2026 年 9 月。按 Pi 当前文档中的自定义 Provider 配置方式编写。DeepSeek API 价格、模型 ID 和 Pi 配置字段都可能变化,使用前请以官方文档为准。
一、DeepSeek Flash 模型概况
DeepSeek V4.1 Flash(官方 API 模型 ID:deepseek-flash)于 2026 年 9 月 10 日发布。
| 项目 | 参数 |
|---|---|
| 架构 | 稀疏 MoE,总参数 552B |
| 上下文 | 1M tokens |
| 最大输出 | 384K tokens |
| Thinking | 支持 thinking / non-thinking,默认 thinking |
| 视觉 | 支持 |
| 并发限制 | 2500 |
模型 ID 对照:
| 渠道 | 模型 ID |
|---|---|
| DeepSeek v4.1 Flash | deepseek-flash |
| DeepSeek v4 flash | deepseek-v4-flash、deepseek-v4-flash-vision-exp |
| OpenRouter | deepseek/deepseek-v4.1-flash |
| OpenCode Go | deepseek-flash |
价格(每 1M tokens,DeepSeek 官方定价页 2026-09):
| 项目 | 低谷(off-peak) | 高峰(peak) |
|---|---|---|
| 输入(缓存命中) | $0.003 | $0.006 |
| 输入(缓存未命中) | $0.15 | $0.30 |
| 输出 | $0.60 | $1.20 |
高峰时段:UTC 周一至周五 01:00–04:00 和 06:00–10:00,其余为低谷。
二、前置条件
- Pi 已安装(
pi --version能输出版本号;安装见 pi.dev,本文不展开)
三、配置自定义 Provider
编辑 ~/.pi/agent/models.json(Windows 为 %USERPROFILE%\.pi\agent\models.json)。
以下字段均来自 DeepSeek 官方 Pi 集成文档和 Pi 官方 models 文档,为已验证可用项:
{
"providers": {
"custom": {
"baseUrl": "https://api.example.com",
"api": "openai-completions",
"apiKey": "$API_KEY",
"models": [
{
"id": "deepseek-flash",
"name": "DeepSeek V4.1 Flash",
"reasoning": true,
"input": [
"text",
"image"
],
"thinkingLevelMap": {
"minimal": null,
"low": "low",
"medium": null,
"high": "high",
"max": "max"
},
"contextWindow": 1000000,
"maxTokens": 384000,
"cost": {
"input": 0.3,
"output": 1.2,
"cacheRead": 0.006,
"cacheWrite": 0
},
"compat": {
"supportsStore": false,
"supportsDeveloperRole": false,
"maxTokensField": "max_tokens",
"requiresReasoningContentOnAssistantMessages": true,
"thinkingFormat": "deepseek"
}
}
]
}
}
}
字段说明:
baseUrl:API 域名比如https://api.deepseek.com,Pi 用openai-completions时会自动拼/chat/completions,自建网关的baseUrl通常需要带/v1,模型 ID 以网关侧配置为准。apiKey:"$API_KEY"是环境变量引用。也支持直接纯文本。reasoning: true:声明模型支持 thinking 深度思考。input:先写["text", "image"]。模型输入支持文本和图片。cost:填了 Pi 才会在会话里显示成本统计。- contextWindow: 1000000:上下文窗口,pi 本地用它做预算和触发压缩,不发给 API。填小了会提前压缩,填大了会撞服务端硬限。
- maxTokens: 384000:最大输出 token,实际作为
max_tokens发给服务端(字段名由 compat决定)。这也是 pi 认为单次回答的上限,输出被截断时会据此提示。 thinkingLevelMap:深度思考等级,DeepSeek V4.1 Flash 只有low、high、max,没有的映射为 null,表示该档位在 UI 中隐藏。compat.thinkingFormat: "deepseek":告诉 Pi 用 DeepSeek 的 thinking 参数协议。- -compat.requiresReasoningContentOnAssistantMessages: true:用于在启用 reasoning 时为回放的 assistant 消息补充reasoning_content字段。compat.supportsStore: false:不发 OpenAI 的 store 请求字段。非 OpenAI 后端认不出多余字段就报错,所以关掉。compat.supportsDeveloperRole: false:系统提示用 system role 发送,而不是推理模型默认的 developer role(老式/自建后端不认识 developer)。compat.maxTokensField: "max_tokens":输出上限字段名用max_tokens。
四、运行验证
以下命令基于 Pi 当前文档中的通用用法,建议先在本地执行 pi --help 确认参数存在:
# 列出 custom provider 可见的模型
pi --list-models custom
# 交互式(进入后 /model 切换模型)
cd /path/to/project
pi --provider custom --model deepseek-flash
# 一次性非交互
pi --provider custom --model deepseek-flash -p "给当前目录写一个 README"
Pi 文档说明,打开模型选择器时会重新加载 models.json,修改配置后通常不需要重启当前会话。
Anthropic 协议端点
DeepSeek 官方还提供 Anthropic 格式端点 https://api.deepseek.com/anthropic。Pi 可以使用 anthropic-messages API 类型进行尝试,但工具调用、thinking 和流式响应的完整兼容性需根据实际返回结果验证。