语音识别、AI 文本处理与手写识别分别使用不同服务与凭据,本页按服务逐一说明开通、获取与填写方式,以及常见错误的排查方向。
| 能力 | 是否必需 | 服务 | 需要填写的内容 |
|---|---|---|---|
| 语音输入 | 必需 | 火山引擎豆包流式语音识别 | API Key,或旧版 App ID 与 Access Token;资源 ID |
| 总结、翻译、整理、自由语音指令 | 可选 | 任意兼容 OpenAI Chat Completions 的模型服务 | Base URL、API Key、模型 ID |
| 中文和英文手写识别 | 可选 | Google ML Kit Digital Ink Recognition | 不需要 API Key;首次使用时下载语言模型 |
InkTalk 使用火山引擎双向流式语音识别 WebSocket 接口完成实时语音转写。默认配置为豆包流式语音识别模型 2.0 小时版:
wss://openspeech.bytedance.com/api/v3/sauc/bigmodel_asyncvolc.seedasr.sauc.duration新版鉴权在 WebSocket 握手时使用 X-Api-Key。InkTalk 会自动生成请求 ID 和协议序号,不需要手工填写。
旧版控制台用户可以打开旧版语音服务控制台查询 App ID 和 Access Token。
在 InkTalk 中:
X-Api-App-Key。X-Api-Access-Key。| InkTalk 选项 | 资源 ID | 适用情况 |
|---|---|---|
| 豆包流式识别 2.0 · 小时版 | volc.seedasr.sauc.duration | 默认推荐;按音频时长计费 |
| 豆包流式识别 2.0 · 并发版 | volc.seedasr.sauc.concurrent | 已购买并发资源的账号 |
| 豆包流式识别 1.0 · 小时版 | volc.bigasr.sauc.duration | 仍在使用 1.0 小时版的账号 |
| 豆包流式识别 1.0 · 并发版 | volc.bigasr.sauc.concurrent | 仍在使用 1.0 并发版的账号 |
logid 后,再到真实输入框测试麦克风、实时文本和最终定稿。AI 文本处理是可选功能,用于总结、翻译、整理和自由语音指令。InkTalk 固定使用以下兼容方式:
{Base URL}/chat/completionsPOSTAuthorization: Bearer {API Key}model 与 messageschoices[0].message.content因此,提供方必须兼容 OpenAI Chat Completions 的请求和响应结构。填写 Base URL 时不要附加 /chat/completions,InkTalk 会自动追加该路径。
| 字段 | 填写要求 | 示例 |
|---|---|---|
| Base URL | 填写到版本根路径,不包含 /chat/completions | https://api.openai.com/v1 |
| API Key | 从模型服务商控制台创建的调用密钥 | 不要填写 ChatGPT、百炼或方舟的登录密码 |
| 模型 | 提供方支持 Chat Completions 的模型 ID | gpt-4o-mini |
获取步骤:
| InkTalk 字段 | 建议值 |
|---|---|
| Base URL | https://api.openai.com/v1 |
| API Key | 在 OpenAI API Platform 创建的项目 API Key |
| 模型 | gpt-4o-mini |
gpt-4o-mini 当前支持 v1/chat/completions。模型能力与可用端点见 OpenAI Docs:GPT-4o mini,鉴权方式见 OpenAI API Authentication。
获取步骤:
中国大陆按量付费的简单配置:
| InkTalk 字段 | 建议值 |
|---|---|
| Base URL | https://dashscope.aliyuncs.com/compatible-mode/v1 |
| API Key | 百炼中国大陆版 API Key |
| 模型 | qwen-plus |
生产环境可以使用业务空间专属地址:
https://{WorkspaceId}.cn-beijing.maas.aliyuncs.com/compatible-mode/v1
将 {WorkspaceId} 替换为控制台显示的业务空间 ID。API Key、地域、业务空间和 Base URL 必须配套,否则通常返回 HTTP 401。
获取步骤:
InkTalk 配置示例:
| InkTalk 字段 | 示例值 |
|---|---|
| Base URL | https://ark.cn-beijing.volces.com/api/v3 |
| API Key | 火山方舟 API Key |
| 模型 | doubao-seed-2-0-lite-260215,或控制台当前显示的其他 Chat 模型 ID |
获取步骤:
InkTalk 配置示例:
| InkTalk 字段 | 建议值 |
|---|---|
| Base URL | https://api.deepseek.com |
| API Key | DeepSeek Platform API Key |
| 模型 | deepseek-v4-flash 或 deepseek-v4-pro |
deepseek-v4-flash 和 deepseek-v4-pro。不要继续照抄旧文档中的 deepseek-chat 或 deepseek-reasoner,应以控制台和当前 Quick Start 为准。InkTalk 的「关闭思考模式」会同时发送多种兼容字段:
enable_thinking=falsethinking={"type":"disabled"}reasoning_effort="minimal"| 现象 | 常见原因 | 处理方式 |
|---|---|---|
| HTTP 401 | API Key 错误;Key 与地域或 Base URL 不匹配 | 重新复制 Key,并核对地域、业务空间和计费方案 |
| HTTP 403 | 模型未授权;账号无权限;余额或服务状态异常 | 在提供方控制台开通模型并检查权限 |
| HTTP 404 | Base URL 多填或少填版本路径;模型 ID 不存在 | Base URL 不要包含 /chat/completions,重新复制模型 ID |
| HTTP 400 | 模型不支持 Chat Completions;关闭思考模式附加字段不兼容 | 更换 Chat 模型,或关闭「关闭思考模式」 |
| 解析响应失败 | 提供方响应不是 choices[0].message.content 结构 | 使用真正兼容 OpenAI Chat Completions 的接口 |
| 请求超时 | 网络不可达;模型响应超过 InkTalk 的 60 秒读取超时 | 检查网络,或改用响应更快的模型 |
InkTalk 的中英文手写识别使用 Google ML Kit Digital Ink Recognition 19.0.0。该功能不需要申请 API Key,也不需要填写 Base URL。
首次选择某种手写语言时,InkTalk 会按需下载对应的语言模型。根据 Google ML Kit Digital Ink Recognition 官方文档,每种语言模型大约需要 20 MB 存储空间。
使用要求:
InkTalk 将凭据保存到应用私有的 SharedPreferences,但「配置导出」文件会包含语音识别和 AI 服务密钥。
/chat/completions。以下内容不应填写到 InkTalk 的 API Key 字段: