面试舱 使用文档
面试舱 是一款 Electron 桌面应用,在面试过程中为用户提供实时 AI 辅助。应用以独立窗口运行,不干扰面试界面,通过语音转写捕获面试官问题,AI 即时生成回答建议供参考。
准备阶段
粘贴简历与职位描述,AI 自动提取结构化信息
面试中
实时语音转文字捕获问题,AI 根据上下文生成回答建议
面试后
回放所有问答记录,查看完整面试纪要,复盘提升
新用户入门指南
从零开始,完成下载、安装、配置,开启第一次面试辅助
1. 下载与安装
macOS(Apple Silicon / Intel)
- 访问下载页面,按 Mac 芯片类型选择 Apple Silicon 或 Intel 版本
- 下载完成后解压
.zip文件 - 将
面试舱.app拖入「应用程序」文件夹 - 首次打开时,系统可能提示“来自未识别的开发者”,请在「系统设置 > 隐私与安全性」中点击「仍要打开」
说明
2. 注册账号
应用内登录通过邮箱 + 密码完成。注册需在 Web 端进行:
访问网站,点击导航栏「注册」
输入邮箱地址,点击「发送验证码」
填写收到的验证码
设置密码(至少 8 个字符)
注册成功后自动登录,可直接跳转至购买页面
提示
3. 首次启动
双击 面试舱 图标启动应用:
- 应用启动后直接进入主界面
- 首次启动时,主界面显示引导文案「开启一次高质量面试」
- 点击右下角的设置按钮(齿轮图标),或右键点击窗口选择「设置」
首次启动权限请求
- 麦克风权限:macOS 系统会弹出权限请求对话框,点击「允许」以启用语音转写功能
- 语音识别权限:使用 macOS 内置语音转写时,系统会额外请求语音识别权限
如果尚未登录,在设置页面顶部会显示登录表单:输入邮箱密码登录,勾选「记住会话」(默认已勾选)。
4. 配置 AI 提供商(必需)
应用需要连接 AI 服务才能生成回答建议。
两种提供模式
Server 模式(平台托管)
- API Key 由平台统一管理,无需配置密钥
- 服务端只鉴权,不代理请求,直连运营商保证速度
- 从账户余额(点数)中自动扣费
- 适合:没有 API Key 或不想管理密钥的用户
BYOK 模式(自带密钥)
- 使用你自己的 API Key(OpenAI / Claude / 阿里云等)
- 请求直连 AI 服务商,不消耗平台点数
- 密钥通过系统加密钥匙串安全存储
- 适合:已有 API 账号、希望控制成本的用户
支持的 AI 提供商:
| 提供商 | 支持模式 | 可用模型 |
|---|---|---|
| OpenAI | Server + BYOK | GPT-4o / GPT-4.1 系列 |
| Claude | Server + BYOK | 3.5 Sonnet / Haiku |
| 阿里云 | Server + BYOK | 通义千问 Turbo / Plus / Max / Flash |
| 火山引擎 | BYOK | 豆包系列 |
| Ollama | BYOK | 本地模型,无需 API Key |
提示
5. 配置语音转写
语音转写(STT)默认使用 macOS 内置语音识别,通常无需额外配置。
| 提供商 | 支持模式 | 说明 |
|---|---|---|
| macOS 内置 | 免费 | Apple Speech Framework,无需密钥 |
| OpenAI Whisper API | Server + BYOK | 云端高精度转写 |
| 腾讯云 ASR | Server + BYOK | 中文优化,适合正式面试 |
6. 完成第一次面试辅助
创建面试会话
应用启动后自动创建新会话,左侧侧边栏可见「新会话」。点击会话标题可重命名。
注意
准备简历和职位信息
会话创建成功后,主界面上方出现「面试上下文」面板。粘贴简历文本,AI 自动提取结构化信息;同理添加目标职位描述。提取结果均可手动编辑修正。
开始语音转写
点击右上角控制条选择麦克风设备,点击话筒图标开始录音。面试官说话时,底部「待处理问题面板」会实时显示转写文字。
说明
获取 AI 回答建议
确认问题文本后,点击「获取答案」。AI 将生成结构化回答:摘要 → 要点 → 解释 → 推理过程。回答以卡片形式展示,流式输出实时刷新。
三层音频过滤
在语音转写过程中,系统会对音频进行三层实时过滤,确保每一段音频都是有效的人声内容:
- 能量门控— 设定固定能量阈值,自动过滤掉完全没有声音的静音片段
- 动态降噪— 实时学习环境噪声底(空调声、键盘声等),自动调整触发阈值
- 语音状态机— 检测到语音后等待“悬停时间”避免句中停顿被截断,过滤咳嗽、清嗓、键盘鼠标敲击等噪音
配合 60 秒窗口机制,系统持续保留最近 60 秒的音频缓冲,转写时自动裁剪前导静音。面试官说的每一句有效的话都会被送去转写,而沉默、呼吸、环境噪声都不会浪费你的点数。
提示
提词器
面试进行中,随时打开提词器面板——面试舱 的核心亮点功能之一:
- 免低头看笔记 — AI 回答要点以适合阅读的方式展示,保持眼神交流
- 自动滚动 — 速度可调(1-20 档),鼠标悬停暂停,手动滚动自动暂停
- 个性化排版 — 三档字号、三档行高,根据阅读习惯调节
- 一键切换视图 — 要点模式 / 全文模式快速切换
- ESC 键关闭 — 随时隐藏提词器,恢复纯净界面
音频捕获配置
常规语音转写使用麦克风捕获你的声音即可。但如果你需要在视频面试(腾讯会议、Zoom 等)中捕获对方说话的声音,需要配置虚拟音频驱动。
安装 BlackHole 音频驱动
BlackHole 是 macOS 上的开源虚拟音频设备,可将系统播放的音频路由为输入源。
- 访问 BlackHole GitHub,下载 2ch 版本
- 安装完成后,打开 macOS「音频 MIDI 设置」,确认已看到 BlackHole 2ch 设备
- 在 面试舱 右上角控制条的音频设备下拉菜单中,选择 BlackHole 2ch 作为输入源
创建聚合设备(推荐)
将会议软件输出直接设为 BlackHole 会导致扬声器静音。因此推荐创建「多输出设备」,让声音同时输出到扬声器和 BlackHole,两全其美。
- 打开 macOS「音频 MIDI 设置」
- 点击左下角「+」号,选择「创建多输出设备」
- 勾选「内建输出」(你的扬声器/耳机)和「BlackHole 2ch」
- 将「内建输出」设为主设备,并勾选「漂移校正」
- 在「系统设置 > 声音 > 输出」中,将系统默认输出设为这个「多输出设备」
- 在会议软件中,将输出也设置为这个「多输出设备」
- 回到 面试舱,选择 BlackHole 2ch 作为输入源
提示
客户端使用教程
深入了解各功能模块的使用方法
1. 主界面布局
┌──────────────────────────────────────────────┐ │ 侧边栏 │ 面试上下文面板(简历+职位) │ │ │ ──────────────────────────── │ │ 会话列表 │ │ │ (可搜索) │ 问答卡片区域 │ │ │ (摘要 / 要点 / 解释 / 推理) │ │ │ │ │ ───────── │ ──────────────────────────── │ │ 新建会话 │ 待处理问题面板(实时转写) │ ├─────────────┴──────────────────────────────────┤ │ 状态栏:🎤 麦克风 | 🔊 STT | 🤖 AI | 💾 记忆 │ └──────────────────────────────────────────────┘
快捷控制面板(右上角浮动):音频设备选择、透明度滑块(60%-100%)、窗口置顶开关。
右键菜单:窗口任意位置右键,可快速进入「设置」页面。
2. 面试准备
创建会话:应用启动时自动创建新会话。建议重命名为有意义的名称(如「某某公司 - 前端工程师一面」)。
简历与职位信息卡:会话创建后,主界面上方出现「面试上下文」面板。粘贴文本后 AI 自动提取结构化信息,生成一句话摘要和词云预览。提取过程实时展示,所有结果均可手动编辑。
检查设备状态:底部状态栏确认三个指示灯均为绿色:麦克风、STT、AI。
3. 面试中
在右上角控制条选择正确的麦克风设备,点击话筒图标开始录音
面试官的问题实时转写为文字,显示在底部「待处理问题面板」中
确认问题文本正确后,点击「获取答案」。回答以流式方式逐字输出到新生成的卡片中
每轮问答生成一张独立卡片,可继续下一轮问答
面试结束后点击「结束面试」,系统记录结束时间并自动保存
4. 问答卡片
每张卡片包含:问题原文、AI 回答(摘要 / 要点 / 解释 / 推理过程)、AI 提供商和模型名称、Token 用量细分、性能指标(总耗时、首 token 延迟)。
操作:搜索过滤、上一张/下一张切换、标记为已完成(done)或部分回答(partial)。
5. 面试回放与复盘
侧边栏导航:列出所有历史面试会话,支持搜索和按标签过滤。
查看回放:点击任意会话,加载该会话的所有问答卡片,按时间顺序排列。
提词器模式:浮动面板,可调宽度、字体大小、行间距、自动滚动速度与聚焦模式。
说明
~/Library/Application Support/ai-interviewer/,不会上传到云端。6. 记忆与知识库
短期记忆
保留最近 N 张卡片作为上下文跟进(默认 3 张),适合追问和递进式问题
长期记忆
基于本地向量数据库的跨会话检索,需要配置 Embedding 提供商
知识库
支持文件导入,自动向量化存储,面试时 RAG 检索辅助回答
7. 截图功能
点击截图按钮后,拖动鼠标选择屏幕区域进行截取。截取的图片会作为多模态输入发送给 AI,适合面试官展示的图表、架构图、代码片段等视觉内容。
8. 设置详解
供应商配置 必需
AI 提供商、Embedding 提供商、STT 提供商、BYOK 配置档案
高级设置
STT 自动提交、句子窗口、VAD 引擎、AI 请求超时
流式输出性能
自适应节流、三档预设(平滑/均衡/性能)
记忆与知识
短期记忆、长期记忆、面试上下文、自动发送
提示词
自定义 AI 系统提示词
UI 控制
覆盖层透明度、窗口置顶、快捷键提示、语言偏好
9. 常见问题排查
麦克风无法使用
AI 回答不生成
语音转写不准确
STT 无响应
长期记忆不工作
客户端与 Web 端账号不通用
快捷参考
状态指示灯
数据存储位置
面试会话 — ~/Library/Application Support/ai-interviewer/
BYOK 密钥 — 系统加密钥匙串
Qdrant 向量库 — 随应用自动启动