配置指南

InkTalk API 配置与获取指南

语音识别、AI 文本处理与手写识别分别使用不同服务与凭据,本页按服务逐一说明开通、获取与填写方式,以及常见错误的排查方向。

适用版本:InkTalk 0.3 更新日期:2026 年 8 月 19 日 适用对象:配置与维护人员
概览

需要配置哪些服务

能力是否必需服务需要填写的内容
语音输入必需火山引擎豆包流式语音识别API Key,或旧版 App ID 与 Access Token;资源 ID
总结、翻译、整理、自由语音指令可选任意兼容 OpenAI Chat Completions 的模型服务Base URL、API Key、模型 ID
中文和英文手写识别可选Google ML Kit Digital Ink Recognition不需要 API Key;首次使用时下载语言模型
语音识别和 AI 文本处理使用不同的服务与凭据。火山引擎豆包语音 API Key、火山方舟 API Key、阿里云百炼 API Key、OpenAI API Key 和 DeepSeek API Key 不能互相替代。
必需

一、火山引擎豆包流式语音识别

1. 服务用途

InkTalk 使用火山引擎双向流式语音识别 WebSocket 接口完成实时语音转写。默认配置为豆包流式语音识别模型 2.0 小时版:

2. 开通服务

  1. 登录火山引擎豆包语音控制台
  2. 找到「语音识别大模型」或「豆包流式语音识别模型 2.0」。
  3. 按实际计费方式开通小时版或并发版。
  4. 记录开通的模型版本和计费方式。InkTalk 中选择的资源 ID 必须与控制台开通项一致。
控制台页面名称可能随火山引擎更新而变化。若控制台没有显示目标服务,应先确认账号实名认证、服务地域、项目和开通权限。

3. 获取新版 API Key

  1. 打开豆包语音 API Key 管理
  2. 创建或复制当前项目可用的 API Key。
  3. 在 InkTalk 设置页的「语音识别」区域填写「API Key」。
  4. 使用新版 API Key 时,将旧版 App ID 和 Access Token 留空。

新版鉴权在 WebSocket 握手时使用 X-Api-Key。InkTalk 会自动生成请求 ID 和协议序号,不需要手工填写。

4. 使用旧版 App ID 与 Access Token

旧版控制台用户可以打开旧版语音服务控制台查询 App ID 和 Access Token。

在 InkTalk 中:

不要同时依赖两套凭据。只要「API Key」非空,InkTalk 就优先使用新版 API Key。

5. 选择正确的资源 ID

InkTalk 选项资源 ID适用情况
豆包流式识别 2.0 · 小时版volc.seedasr.sauc.duration默认推荐;按音频时长计费
豆包流式识别 2.0 · 并发版volc.seedasr.sauc.concurrent已购买并发资源的账号
豆包流式识别 1.0 · 小时版volc.bigasr.sauc.duration仍在使用 1.0 小时版的账号
豆包流式识别 1.0 · 并发版volc.bigasr.sauc.concurrent仍在使用 1.0 并发版的账号
资源 ID 与控制台开通项不一致时,可能出现 HTTP 401、403 或「resource not enabled」等错误。

6. 在 InkTalk 中验证

  1. 打开 InkTalk 设置。
  2. 保存语音凭据和资源 ID。
  3. 点击「测试语音识别连接」。
  4. InkTalk 会验证 WebSocket 握手、开始请求和服务端首包确认,不会访问麦克风。
  5. 出现「ASR 协议验证成功」和 logid 后,再到真实输入框测试麦克风、实时文本和最终定稿。
连接测试成功不等于真实录音已经验收。麦克风权限、手机录音通道、网络切换、长时间连接和第三方编辑器仍需分别测试。

7. 排错链接

可选

二、OpenAI 兼容 AI 文本服务

1. InkTalk 的接口要求

AI 文本处理是可选功能,用于总结、翻译、整理和自由语音指令。InkTalk 固定使用以下兼容方式:

因此,提供方必须兼容 OpenAI Chat Completions 的请求和响应结构。填写 Base URL 时不要附加 /chat/completions,InkTalk 会自动追加该路径。

2. 设置字段说明

字段填写要求示例
Base URL填写到版本根路径,不包含 /chat/completionshttps://api.openai.com/v1
API Key从模型服务商控制台创建的调用密钥不要填写 ChatGPT、百炼或方舟的登录密码
模型提供方支持 Chat Completions 的模型 IDgpt-4o-mini
保存后点击「测试 AI 连接」。InkTalk 会发送一段固定测试文本,这属于一次真实模型调用,可能产生费用。

3. OpenAI API

获取步骤:

  1. 登录 OpenAI API Platform
  2. API Keys 页面创建项目 API Key。
  3. 根据账号状态配置 API 计费与用量限制。ChatGPT 订阅与 API 用量属于不同产品,API 可用额度以 API Platform 为准。
  4. 在 InkTalk 中填写以下内容:
InkTalk 字段建议值
Base URLhttps://api.openai.com/v1
API Key在 OpenAI API Platform 创建的项目 API Key
模型gpt-4o-mini

gpt-4o-mini 当前支持 v1/chat/completions。模型能力与可用端点见 OpenAI Docs:GPT-4o mini,鉴权方式见 OpenAI API Authentication

OpenAI 官方不建议把长期 API Key 放入移动客户端。InkTalk 当前是本机 BYOK(自带密钥)工具,适合个人受控设备;面向团队或公开分发时,应使用自己的服务端代理保存密钥,并给移动端签发受限的短期凭据。

4. 阿里云百炼与千问

获取步骤:

  1. 阅读获取与配置百炼 API Key
  2. 进入阿里云百炼控制台,选择业务空间并创建 API Key。
  3. 确认 API Key 所属地域、业务空间和计费方案。
  4. 百炼 Base URL 总览选择与 API Key 匹配的地址。

中国大陆按量付费的简单配置:

InkTalk 字段建议值
Base URLhttps://dashscope.aliyuncs.com/compatible-mode/v1
API Key百炼中国大陆版 API Key
模型qwen-plus

生产环境可以使用业务空间专属地址:

https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1

{WorkspaceId} 替换为控制台显示的业务空间 ID。API Key、地域、业务空间和 Base URL 必须配套,否则通常返回 HTTP 401。

Token Plan 和 Coding Plan 的专属 Key 仅适用于对应的交互式 AI 工具,不应当作为 InkTalk 的通用模型服务 Key。InkTalk 应使用允许应用调用的按量付费或业务空间 API Key。

5. 火山方舟豆包大模型

获取步骤:

  1. 登录火山方舟控制台
  2. 在模型列表或体验中心选择支持 Chat API 的模型,并记录模型 ID。
  3. 火山方舟 API Key 管理创建 API Key。
  4. 参考火山方舟开始使用ChatCompletions API确认模型 ID 与接口。

InkTalk 配置示例:

InkTalk 字段示例值
Base URLhttps://ark.cn-beijing.volces.com/api/v3
API Key火山方舟 API Key
模型doubao-seed-2-0-lite-260215,或控制台当前显示的其他 Chat 模型 ID
火山方舟 API Key 与豆包语音 API Key 属于不同产品。语音识别区域必须填写豆包语音凭据;AI 文本处理区域才填写火山方舟凭据。

6. DeepSeek API

获取步骤:

  1. 登录 DeepSeek Platform
  2. API Keys 页面创建密钥。
  3. 根据平台要求充值或确认可用余额。
  4. 参考 DeepSeek API Quick Start 选择当前模型。

InkTalk 配置示例:

InkTalk 字段建议值
Base URLhttps://api.deepseek.com
API KeyDeepSeek Platform API Key
模型deepseek-v4-flashdeepseek-v4-pro
DeepSeek 当前官方文档使用 deepseek-v4-flashdeepseek-v4-pro。不要继续照抄旧文档中的 deepseek-chatdeepseek-reasoner,应以控制台和当前 Quick Start 为准。

7. 关闭思考模式开关

InkTalk 的「关闭思考模式」会同时发送多种兼容字段:

这些字段分别面向不同提供方,并非所有服务都接受未知参数。初次配置时建议关闭此开关。只有确认提供方兼容后再开启;若返回 HTTP 400 或「unknown field」,应关闭开关并重新测试。

8. 常见 AI 错误

现象常见原因处理方式
HTTP 401API Key 错误;Key 与地域或 Base URL 不匹配重新复制 Key,并核对地域、业务空间和计费方案
HTTP 403模型未授权;账号无权限;余额或服务状态异常在提供方控制台开通模型并检查权限
HTTP 404Base URL 多填或少填版本路径;模型 ID 不存在Base URL 不要包含 /chat/completions,重新复制模型 ID
HTTP 400模型不支持 Chat Completions;关闭思考模式附加字段不兼容更换 Chat 模型,或关闭「关闭思考模式」
解析响应失败提供方响应不是 choices[0].message.content 结构使用真正兼容 OpenAI Chat Completions 的接口
请求超时网络不可达;模型响应超过 InkTalk 的 60 秒读取超时检查网络,或改用响应更快的模型
可选

三、Google ML Kit 手写识别

InkTalk 的中英文手写识别使用 Google ML Kit Digital Ink Recognition 19.0.0。该功能不需要申请 API Key,也不需要填写 Base URL。

首次选择某种手写语言时,InkTalk 会按需下载对应的语言模型。根据 Google ML Kit Digital Ink Recognition 官方文档,每种语言模型大约需要 20 MB 存储空间。

使用要求:

若手写页面一直显示准备模型或下载失败,应检查网络、设备存储空间、Google 模型下载服务可达性和系统对后台下载的限制。
安全

四、密钥保存与备份安全

InkTalk 将凭据保存到应用私有的 SharedPreferences,但「配置导出」文件会包含语音识别和 AI 服务密钥。

自检

五、完整配置检查表

只使用语音输入

使用 AI 文本处理与自由语音指令

使用手写识别

避免混淆

六、InkTalk 不使用的凭据

以下内容不应填写到 InkTalk 的 API Key 字段:

InkTalk 不会要求上传这些信息。设置页只需要对应服务商正式创建的 API Key、旧版语音凭据和模型配置。