AI 功能
连接 AI 服务
配置并验证用于生成智能标题、会议摘要、自定义模板与会议问答的 AI 大模型。
Kapinote 的语音转录与 AI 总结采用了完全解耦的架构设计:
- 语音转录模型: 负责将音频流实时转换为时间戳文字对齐的转录片段;
- AI 大模型服务: 负责基于转录文本提炼核心决议、生成结构化待办清单,并在对话中回答你关于会议细节的任何提问。
添加与配置步骤
- 打开 设置 → AI。
- 切换选择 云端(Cloud)、本地(Local) 或 命令行工具(CLI),然后选择对应的服务商。
- 按照表单提示填入必要的参数(API Key、模型名称或 Base URL)。
- 点击 验证 按钮。验证通过即表明 Kapinote 已成功连通所配置的模型。
- 保存该配置,并将其设为当前生效的默认 AI 服务。
配置字段详解
| 配置项 | 含义与填写规范 |
|---|---|
| API Key(密钥) | 在各服务商开发者平台创建的专用 API Key(非网页账号登录密码) |
| 模型名称(Model) | 服务商官方规定的模型标识符(如 claude-3-7-sonnet-20250219、gpt-4o、deepseek-chat),严格区分大小写 |
| Base URL(接口地址) | API 请求的基础网关地址。除非使用了第三方代理转发或私有部署,建议直接保留 Kapinote 预置默认值 |
| 地区(Region) | 特殊字段:在 AWS Bedrock 中,Base URL 字段需填入对应的 AWS Region 标识(如 us-east-1) |
对于 CLI 命令行服务,模型字段通常可直接留空,此时 Kapinote 会自动继承该命令行工具在系统全局配置中的默认模型。
三大接入方式的对比与选型
- 云端托管服务(Cloud): 开箱即用、推理速度快、支持业界最顶尖的模型能力(Claude 3.7、GPT-4o、DeepSeek-V3 等);单次请求的转录上下文会发送至对应服务商。
- 本地 Ollama(Local): 无需 API Key;模型下载完成后可在 Mac 本地处理会议文本。输出质量与推理速度取决于模型大小、统一内存与芯片规格(如
qwen3.5:4b、qwen3.5:9b、qwen3.8:27b)。 - 命令行工具(CLI): 直接复用 Mac 本地已安装并登录的 Gemini CLI、Claude Code、GitHub Copilot CLI 或 OpenAI Codex CLI,无需额外输入 API Key,直接复用该工具已有的账号订阅与配额。
详细配置指南请参考 云端 AI 服务、Ollama 本地 AI与本地及 CLI 服务。
验证失败时的排查步骤
- 核对模型标识: 确认模型字符串完全准确且符合服务商命名规范(如 DeepSeek 为
deepseek-chat,而非网页端别名)。 - 检查配额与权限: 确认 API Key 具备该模型的调用权限,且服务商账号内有充足的可用余额或免费额度。
- CLI 登录状态: 使用 CLI 模式前,请务必先在 Mac 终端中独立执行一次命令测试,确认已成功登录。
- 更多详细解决方案请查看 故障排查。