面试舱 使用文档

面试舱 是一款 Electron 桌面应用,在面试过程中为用户提供实时 AI 辅助。应用以独立窗口运行,不干扰面试界面,通过语音转写捕获面试官问题,AI 即时生成回答建议供参考。

v0.2.0macOSElectron简体中文

准备阶段

粘贴简历与职位描述,AI 自动提取结构化信息

面试中

实时语音转文字捕获问题,AI 根据上下文生成回答建议

面试后

回放所有问答记录,查看完整面试纪要,复盘提升

新用户入门指南

从零开始,完成下载、安装、配置,开启第一次面试辅助

1. 下载与安装

macOS(Apple Silicon / Intel)

  1. 访问下载页面,按 Mac 芯片类型选择 Apple Silicon 或 Intel 版本
  2. 下载完成后解压 .zip 文件
  3. 面试舱.app 拖入「应用程序」文件夹
  4. 首次打开时,系统可能提示来自未识别的开发者,请在「系统设置 > 隐私与安全性」中点击「仍要打开」

说明

Windows 11 版本尚在开发中,敬请期待。

2. 注册账号

应用内登录通过邮箱 + 密码完成。注册需在 Web 端进行:

1

访问网站,点击导航栏「注册」

2

输入邮箱地址,点击「发送验证码」

3

填写收到的验证码

4

设置密码(至少 8 个字符)

5

注册成功后自动登录,可直接跳转至购买页面

提示

桌面客户端与 Web 端使用同一套账号体系。首次使用建议先在 Web 端完成注册,然后在客户端登录。

3. 首次启动

双击 面试舱 图标启动应用:

  1. 应用启动后直接进入主界面
  2. 首次启动时,主界面显示引导文案「开启一次高质量面试」
  3. 点击右下角的设置按钮(齿轮图标),或右键点击窗口选择「设置」

首次启动权限请求

  • 麦克风权限:macOS 系统会弹出权限请求对话框,点击「允许」以启用语音转写功能
  • 语音识别权限:使用 macOS 内置语音转写时,系统会额外请求语音识别权限

如果尚未登录,在设置页面顶部会显示登录表单:输入邮箱密码登录,勾选「记住会话」(默认已勾选)。

4. 配置 AI 提供商(必需)

应用需要连接 AI 服务才能生成回答建议。

两种提供模式

Server 模式(平台托管)

  • API Key 由平台统一管理,无需配置密钥
  • 服务端只鉴权,不代理请求,直连运营商保证速度
  • 从账户余额(点数)中自动扣费
  • 适合:没有 API Key 或不想管理密钥的用户

BYOK 模式(自带密钥)

  • 使用你自己的 API Key(OpenAI / Claude / 阿里云等)
  • 请求直连 AI 服务商,不消耗平台点数
  • 密钥通过系统加密钥匙串安全存储
  • 适合:已有 API 账号、希望控制成本的用户

支持的 AI 提供商:

提供商支持模式可用模型
OpenAIServer + BYOKGPT-4o / GPT-4.1 系列
ClaudeServer + BYOK3.5 Sonnet / Haiku
阿里云Server + BYOK通义千问 Turbo / Plus / Max / Flash
火山引擎BYOK豆包系列
OllamaBYOK本地模型,无需 API Key

提示

只需配置一个 AI 提供商(Server 或 BYOK 任选其一)即可开始使用。

5. 配置语音转写

语音转写(STT)默认使用 macOS 内置语音识别,通常无需额外配置。

提供商支持模式说明
macOS 内置免费Apple Speech Framework,无需密钥
OpenAI Whisper APIServer + BYOK云端高精度转写
腾讯云 ASRServer + BYOK中文优化,适合正式面试

6. 完成第一次面试辅助

1

创建面试会话

应用启动后自动创建新会话,左侧侧边栏可见「新会话」。点击会话标题可重命名。

注意

必须先创建会话,后续所有功能(简历提取、问答记录、回放)才会激活。每个会话独立保存,互不干扰。
2

准备简历和职位信息

会话创建成功后,主界面上方出现「面试上下文」面板。粘贴简历文本,AI 自动提取结构化信息;同理添加目标职位描述。提取结果均可手动编辑修正。

3

开始语音转写

点击右上角控制条选择麦克风设备,点击话筒图标开始录音。面试官说话时,底部「待处理问题面板」会实时显示转写文字。

说明

如需在视频面试中捕获对方声音,请阅读下方「音频捕获配置」。
4

获取 AI 回答建议

确认问题文本后,点击「获取答案」。AI 将生成结构化回答:摘要 → 要点 → 解释 → 推理过程。回答以卡片形式展示,流式输出实时刷新。

三层音频过滤

在语音转写过程中,系统会对音频进行三层实时过滤,确保每一段音频都是有效的人声内容:

  • 能量门控— 设定固定能量阈值,自动过滤掉完全没有声音的静音片段
  • 动态降噪— 实时学习环境噪声底(空调声、键盘声等),自动调整触发阈值
  • 语音状态机— 检测到语音后等待悬停时间避免句中停顿被截断,过滤咳嗽、清嗓、键盘鼠标敲击等噪音

配合 60 秒窗口机制,系统持续保留最近 60 秒的音频缓冲,转写时自动裁剪前导静音。面试官说的每一句有效的话都会被送去转写,而沉默、呼吸、环境噪声都不会浪费你的点数。

提示

如果你使用的是按次计费的云端 STT 服务(如 OpenAI Whisper、腾讯云 ASR),这个机制能确保每次转写请求里几乎全是有效人声,最大程度降低无效扣费。

提词器

面试进行中,随时打开提词器面板——面试舱 的核心亮点功能之一:

  • 免低头看笔记 — AI 回答要点以适合阅读的方式展示,保持眼神交流
  • 自动滚动 — 速度可调(1-20 档),鼠标悬停暂停,手动滚动自动暂停
  • 个性化排版 — 三档字号、三档行高,根据阅读习惯调节
  • 一键切换视图 — 要点模式 / 全文模式快速切换
  • ESC 键关闭 — 随时隐藏提词器,恢复纯净界面

音频捕获配置

常规语音转写使用麦克风捕获你的声音即可。但如果你需要在视频面试(腾讯会议、Zoom 等)中捕获对方说话的声音,需要配置虚拟音频驱动。

安装 BlackHole 音频驱动

BlackHole 是 macOS 上的开源虚拟音频设备,可将系统播放的音频路由为输入源。

  1. 访问 BlackHole GitHub,下载 2ch 版本
  2. 安装完成后,打开 macOS「音频 MIDI 设置」,确认已看到 BlackHole 2ch 设备
  3. 在 面试舱 右上角控制条的音频设备下拉菜单中,选择 BlackHole 2ch 作为输入源
创建聚合设备(推荐)

将会议软件输出直接设为 BlackHole 会导致扬声器静音。因此推荐创建「多输出设备」,让声音同时输出到扬声器和 BlackHole,两全其美。

  1. 打开 macOS「音频 MIDI 设置」
  2. 点击左下角「+」号,选择「创建多输出设备
  3. 勾选「内建输出」(你的扬声器/耳机)和「BlackHole 2ch
  4. 将「内建输出」设为主设备,并勾选「漂移校正」
  5. 在「系统设置 > 声音 > 输出」中,将系统默认输出设为这个「多输出设备」
  6. 在会议软件中,将输出也设置为这个「多输出设备」
  7. 回到 面试舱,选择 BlackHole 2ch 作为输入源

提示

配置完成后,只需在面试开始时确认 面试舱 的音频输入选的是 BlackHole。聚合设备只需创建一次。

客户端使用教程

深入了解各功能模块的使用方法

1. 主界面布局

┌──────────────────────────────────────────────┐
│  侧边栏     │  面试上下文面板(简历+职位)     │
│             │  ────────────────────────────    │
│  会话列表   │                                  │
│  (可搜索)   │  问答卡片区域                     │
│             │  (摘要 / 要点 / 解释 / 推理)      │
│             │                                  │
│  ─────────  │  ────────────────────────────    │
│  新建会话   │  待处理问题面板(实时转写)        │
├─────────────┴──────────────────────────────────┤
│  状态栏:🎤 麦克风 | 🔊 STT | 🤖 AI | 💾 记忆    │
└──────────────────────────────────────────────┘

快捷控制面板(右上角浮动):音频设备选择、透明度滑块(60%-100%)、窗口置顶开关。

右键菜单:窗口任意位置右键,可快速进入「设置」页面。

2. 面试准备

创建会话:应用启动时自动创建新会话。建议重命名为有意义的名称(如「某某公司 - 前端工程师一面」)。

简历与职位信息卡:会话创建后,主界面上方出现「面试上下文」面板。粘贴文本后 AI 自动提取结构化信息,生成一句话摘要和词云预览。提取过程实时展示,所有结果均可手动编辑。

检查设备状态:底部状态栏确认三个指示灯均为绿色:麦克风、STT、AI。

3. 面试中

1

在右上角控制条选择正确的麦克风设备,点击话筒图标开始录音

2

面试官的问题实时转写为文字,显示在底部「待处理问题面板」中

3

确认问题文本正确后,点击「获取答案」。回答以流式方式逐字输出到新生成的卡片中

4

每轮问答生成一张独立卡片,可继续下一轮问答

5

面试结束后点击「结束面试」,系统记录结束时间并自动保存

4. 问答卡片

每张卡片包含:问题原文、AI 回答(摘要 / 要点 / 解释 / 推理过程)、AI 提供商和模型名称、Token 用量细分、性能指标(总耗时、首 token 延迟)。

操作:搜索过滤、上一张/下一张切换、标记为已完成(done)或部分回答(partial)。

5. 面试回放与复盘

侧边栏导航:列出所有历史面试会话,支持搜索和按标签过滤。

查看回放:点击任意会话,加载该会话的所有问答卡片,按时间顺序排列。

提词器模式:浮动面板,可调宽度、字体大小、行间距、自动滚动速度与聚焦模式。

说明

所有会话数据存储在本地 SQLite 数据库中,位于 ~/Library/Application Support/ai-interviewer/,不会上传到云端。

6. 记忆与知识库

短期记忆

保留最近 N 张卡片作为上下文跟进(默认 3 张),适合追问和递进式问题

长期记忆

基于本地向量数据库的跨会话检索,需要配置 Embedding 提供商

知识库

支持文件导入,自动向量化存储,面试时 RAG 检索辅助回答

7. 截图功能

点击截图按钮后,拖动鼠标选择屏幕区域进行截取。截取的图片会作为多模态输入发送给 AI,适合面试官展示的图表、架构图、代码片段等视觉内容。

8. 设置详解

供应商配置 必需

AI 提供商、Embedding 提供商、STT 提供商、BYOK 配置档案

高级设置

STT 自动提交、句子窗口、VAD 引擎、AI 请求超时

流式输出性能

自适应节流、三档预设(平滑/均衡/性能)

记忆与知识

短期记忆、长期记忆、面试上下文、自动发送

提示词

自定义 AI 系统提示词

UI 控制

覆盖层透明度、窗口置顶、快捷键提示、语言偏好

9. 常见问题排查

麦克风无法使用
检查系统设置 > 隐私与安全性 > 麦克风,确认已授权。在客户端状态栏查看麦克风状态指示。
AI 回答不生成
确认 AI 提供商已配置且验证通过。检查 API Key 是否有效、额度是否充足。如使用 Ollama,确认服务正在运行。
语音转写不准确
检查麦克风是否正常收音。尝试切换 STT Tuning 预设(嘈杂环境 / 轻声细语)。可手动编辑转写结果后再提交。
STT 无响应
确认 STT 提供商已配置。macOS 内置 STT 首次使用需授权「语音识别」权限。
长期记忆不工作
确认已开启长期记忆并配置 Embedding 提供商。Qdrant 服务随应用自动启动。
客户端与 Web 端账号不通用
使用同一套后端账号体系。确保使用相同的邮箱和密码登录。

快捷参考

状态指示灯

绿色 — 就绪/正常
黄色 — 加载中/等待
红色 — 错误/不可用
灰色 — 未配置/未启用

数据存储位置

面试会话 — ~/Library/Application Support/ai-interviewer/

BYOK 密钥 — 系统加密钥匙串

Qdrant 向量库 — 随应用自动启动

下载

macOS Apple Silicon 与 Intel 版本现已可用

前往下载页

文档还有疑问?