Kapinote logo文档
AI 功能

连接 AI 服务

配置并验证用于生成智能标题、会议摘要、自定义模板与会议问答的 AI 大模型。

Kapinote 的语音转录与 AI 总结采用了完全解耦的架构设计:

  1. 语音转录模型: 负责将音频流实时转换为时间戳文字对齐的转录片段;
  2. AI 大模型服务: 负责基于转录文本提炼核心决议、生成结构化待办清单,并在对话中回答你关于会议细节的任何提问。

添加与配置步骤

  1. 打开 设置 → AI
  2. 切换选择 云端(Cloud)本地(Local)命令行工具(CLI),然后选择对应的服务商。
  3. 按照表单提示填入必要的参数(API Key、模型名称或 Base URL)。
  4. 点击 验证 按钮。验证通过即表明 Kapinote 已成功连通所配置的模型。
  5. 保存该配置,并将其设为当前生效的默认 AI 服务。

配置字段详解

配置项含义与填写规范
API Key(密钥)在各服务商开发者平台创建的专用 API Key(非网页账号登录密码)
模型名称(Model)服务商官方规定的模型标识符(如 claude-3-7-sonnet-20250219gpt-4odeepseek-chat),严格区分大小写
Base URL(接口地址)API 请求的基础网关地址。除非使用了第三方代理转发或私有部署,建议直接保留 Kapinote 预置默认值
地区(Region)特殊字段:在 AWS Bedrock 中,Base URL 字段需填入对应的 AWS Region 标识(如 us-east-1

对于 CLI 命令行服务,模型字段通常可直接留空,此时 Kapinote 会自动继承该命令行工具在系统全局配置中的默认模型。

三大接入方式的对比与选型

  • 云端托管服务(Cloud): 开箱即用、推理速度快、支持业界最顶尖的模型能力(Claude 3.7、GPT-4o、DeepSeek-V3 等);单次请求的转录上下文会发送至对应服务商。
  • 本地 Ollama(Local): 无需 API Key;模型下载完成后可在 Mac 本地处理会议文本。输出质量与推理速度取决于模型大小、统一内存与芯片规格(如 qwen3.5:4bqwen3.5:9bqwen3.8:27b)。
  • 命令行工具(CLI): 直接复用 Mac 本地已安装并登录的 Gemini CLI、Claude Code、GitHub Copilot CLI 或 OpenAI Codex CLI,无需额外输入 API Key,直接复用该工具已有的账号订阅与配额。

详细配置指南请参考 云端 AI 服务Ollama 本地 AI本地及 CLI 服务

验证失败时的排查步骤

  • 核对模型标识: 确认模型字符串完全准确且符合服务商命名规范(如 DeepSeek 为 deepseek-chat,而非网页端别名)。
  • 检查配额与权限: 确认 API Key 具备该模型的调用权限,且服务商账号内有充足的可用余额或免费额度。
  • CLI 登录状态: 使用 CLI 模式前,请务必先在 Mac 终端中独立执行一次命令测试,确认已成功登录。
  • 更多详细解决方案请查看 故障排查