ThunderPhone 2.0 正式上线。全程自助,低至2美分/分钟。查看发布公告
ThunderPhone 团队的产品更新

更新日志

日期反映变更上线生产环境的时间。

v2.2.0 —— 2026 年 9 月 21 日

  • 结构化通话后数据提取可生成带有每个值对应转录证据的类型化记录,并通过 call.complete 或 call.data_extracted 交付;已结束的通话可重新提取。
  • 智能体可通过 send_sms 工具和 SMS API,使用其自身运营商账户中支持短信的号码发送短信。
  • 采用 PKCE 和设备流程的 OAuth 2.1 授权,让 MCP 客户端和 CLI 可通过浏览器同意登录,而非使用 API 密钥。指南。
  • MCP 服务器与 REST API 功能对等,提供 62 个带注释的工具、提示词和资源;执行删除或拨号的工具需要进行确认令牌交换。指南。
  • 开发者工具包括 thunderphone CLI、Python 和 TypeScript SDK,以及 @thunderphone/mcp stdio 软件包;Agent Skills 和文档 MCP 服务器支持编程智能体。开发者。
  • 在控制台、API 和 Copilot 中提供 Webhook 投递历史记录。
  • 智能体范围的 Webhook 端点会投递带有智能体身份的通话事件。
  • Realtime API:通过 call_events=1 提供已保存智能体的通话事件,在 response.created 中回显 response.metadata,通过 conversation.item.done 确认 function_call_output,并使用 32 个字符的通话 ID。
  • 新增 GET /v1/whoami 连接检查、campaign.completed 事件、外呼资格和电话号码响应中的原因代码,以及示例 Webhook 负载。
  • 支持智能体级别的最大通话时长和最大响铃时长,并为已保存的智能体提供每次通话变量。
  • Twilio:一次连接父账户,并在同一流程中选择其子账户;每个子账户都会成为独立连接。
  • 日历预订默认发送宾客邀请,可按连接控制,并在 calendar_update_event 中支持参会者。
  • 客户门户自定义域名在 DNS 验证后会自动绑定其 HTTPS 证书。
  • ThunderPhone 提供的号码初始仅支持呼入,外呼权限需经使用场景审核。
  • 自定义语音:性别为可选项;对于第一人称语法存在性别区分的语言,会显示警告。
  • Copilot:提供主动关注提醒、欢迎更新,以及供从其他平台迁移的团队使用的导入链接。
  • 自动充值在银行卡扣款被拒后会延长重试间隔,并且只通知客户一次,而不会反复重试。
  • Webhook 测试发送会重试一次,且绝不会将端点标记为失败。
  • 在运行客户工具前,会规范化并验证电子邮件工具参数。

v2.1.0 —— 2026 年 9 月 11 日

  • 从 Vapi、Retell、ElevenLabs Agents 或 Bland 导入您的智能体:粘贴 API 密钥或 JSON 导出文件,检查映射后的提示词、语音、工具和知识库,然后一次完成导入。工作原理。
  • 在 /guides 下提供各平台的迁移指南。

v2.0.1 —— 2026 年 9 月 2 日

  • 推出 TranslateMyCall:一条免费的公共电话线——(228) 888-8666——可在 70 多种语言之间实时口译通话。可将其并入任何通话或使用免提通话;无需应用,无需账户。阅读公告。
  • Flux Interpreting 现为 ThunderPhone Interpreting ——同一款面向语言服务提供商的白标电话口译平台,现以 ThunderPhone 名义提供。
  • 为 TranslateMyCall 公共线路新增用量峰值监控。

v2.0.0 —— 2026 年 8 月 24 日

  • ThunderPhone 现已向所有人开放:自助注册已上线——无需先联系我们,即可构建语音智能体、连接电话服务并投入生产。阅读公告。
  • 推出公开状态页面:status.thunderphone.com。
  • 在用户定义的工具运行期间新增可选键盘音效。
  • 工具等待提示现在会与工具实际执行的操作相匹配。
  • 改进确认回应行为的自然度。
  • 改进 Storm 的拼写复述。
  • 开场轮次补全现在会从内容过滤器拒绝中恢复,而不会让通话陷入静音。
  • Realtime API:每个来电者项目恰好对应一个 completed 事件;延迟到达的转写修正会保留在通话记录中,而不会以删除形式到达。

v1.9.2 —— 2026 年 8 月 17 日

  • Realtime API:新增 session.live_transcripts ——来电者转写片段会在完成时通过会话套接字流式传输,而不再仅出现在通话后的记录中。
  • 将高级语音阵容迁移至最新一代合成模型;重新选配乌尔都语语音。
  • 多语言智能体现在会在来电者切换语言的同一轮次切换语音语言,不再延迟一轮。
  • 将静音线路挂机超时公开为智能体构建器设置项。
  • 当实时回复在接听竞争中胜出时,外呼问候语现在会让出——人工在问候语过程中接听时不再出现双重说话。
  • 修复受邀请成员的同意门控重定向循环:所属组织现在会贯穿接受流程。

v1.9.1 —— 2026 年 8 月 12 日

  • 新增 send_email 智能体工具——在通话过程中向已配置的收件人发送电子邮件。
  • 在实质性工具结果之后的轮次中,回答质量更高。
  • 对姓名、地址和确认码的拼写复述更快、更准确。

v1.9.0 —— 2026 年 8 月 6 日

  • POST /v1/call 可快速返回持久化拨号记录并支持幂等重试;拨号进程继续异步执行。
  • 使 max_duration 成为权威设置:智能体会在达到上限前结束通话,而不是由媒体层强制断开。
  • 工具调用与响应严格一一配对——孤立的工具调用不再会阻塞后续消息的传递。
  • 新增 additional_audio_context(三态),用于控制模型能听到多少此前轮次的音频;已在构建器高级设置中提供。
  • 外呼会前音频现在基于 SIP 接听状态,而非实际时间计时。
  • 加强集成凭据的存储方式。

v1.8.2 —— 2026 年 8 月 5 日

  • 发布全部 47 种支持语言的文档——超过 1,100 个本地化页面,包含 hreflang 配对和本地化站点地图。
  • 录音告知默认开启,支持按智能体覆盖并显示生效状态;运行时在任何配置歧义下都会安全地回退为“告知”。
  • 缩短通话开始时流式首段音频的延迟。

v1.8.1 —— 2026 年 8 月 3 日

  • 支持按智能体选择不录音;同意声明会混入保留的录音中,使录音文件具备自说明性。
  • 新增一次性、按组织执行的 TCPA 确认机制,用于启用外呼功能。
  • 修复粤语被以普通话口音播读的问题。
  • 将 CJK 回复调整为对话式长度——长篇回答在 TTS 语速下效果不佳。
  • 合成停滞不再导致静音——轮次会自动恢复。

v1.8.0 —— 2026 年 7 月 31 日

  • 自定义语音克隆。
  • 区域同意制度:EEA/英国/瑞士需选择加入告知,其他地区默认开启并可选择退出,按每个通话线路分别判定。
  • 保留:删除级联、擦除墓碑记录,以及用于数据主体请求的计划 dsar_sweep 任务。
  • ToS v2.0,包含带版本和证据的接受记录。
  • 支持在线状态:基于心跳的会话在线状态,并提供主动式支持聊天。

v1.7.4 —— 2026 年 7 月 29 日

  • 知识库:通过具备 SSRF 防护的服务器端获取器导入 URL。
  • 新增忘记密码流程。
  • 控制台已采用新设计系统重新设计。
  • Widget 1.2.1:回铃期间麦克风不再持续开启。

v1.7.3 —— 2026年7月28日

  • 重新设计网站。

v1.7.2 —— 2026年7月27日

  • 推出高级语音层级,并提供按口音分组的目录。
  • 高级语音合成失败时,现在会在当前轮次中切换至标准语音,而不是直接中断该轮次。
  • 修复流式合成输出中的 PCM 帧未对齐问题。

v1.7.1 —— 2026年7月24日

  • 工具等待安抚:智能体会在长时间工具调用期间说明进度,而不会保持静默;调整占位提示节奏以消除填充语循环。
  • 支持通过拖放上传知识库文件。
  • macOS 应用自动更新。
  • 修复通话开始时双重问候的竞态问题。

v1.7.0 —— 2026年7月22日

  • 控制台和网站本地化为 47 种区域设置:按命名空间拆分的目录、ICU 复数规则(包括阿拉伯语的六种类别)、区域设置 Cookie、按账户保存的偏好设置。
  • 交易邮件和系统提示词也已本地化以保持一致。

v1.6.5 —— 2026年7月22日

  • 已存储的提供商凭据使用轮换密钥重新加密,并可在线轮换且无需停机。
  • 会话令牌现在会在密码更改或重置时撤销;新增管理员紧急访问路径。
  • 支持按设备管理会话并单独撤销。
  • 强化计费流程:在并发场景下强制执行消费上限、自动充值具备幂等性、正确处理乱序的退款撤销。

v1.6.4 —— 2026年7月20日

  • 全面强化授权范围、导出验证和出站请求防护。
  • 从日志和存储工件中脱敏 DTMF 数字。
  • Webhook 出站请求固定 IP 并防护 SSRF。
  • 通话导出现在会遍历完整的筛选结果集,而非仅导出第一页。

v1.6.3 —— 2026年7月17日

  • 在通话准入时按预留语义强制执行组织消费限额——通话会在超出预算前被拒绝,而不会在超额后继续计费。
  • 实时 WebSocket API:提供双向音频和事件帧,用于构建自定义通话前端。
  • Webhook 平台:基于规范载荷字节的 HMAC 签名、指数退避重试阶梯,覆盖所有通话事件。
  • 支持幂等充值,并加强支付 Webhook 验证。
  • 在智能体构建器中新增实时提示词大小计量器。

v1.6.2 —— 2026年7月16日

  • 客户门户:通过电子邮件发送的登录代码,为您的客户提供受限的只读访问权限。
  • 应用内智能体:语音模式、逐步引导 UI 操作的交互式指南、人工转接。
  • 知识库:支持文档上传、分块导入和基于内容的检索。
  • 支持为每个智能体设置接通提示音和进度提示音。

v1.6.1 —— 2026年7月13日

  • 控制台内号码生命周期:搜索 → 订购 → 配置 → 分配。
  • 新增智能体选项:静默确认关闭开关;通话开始时播放接通提示音。
  • 配置失败现在返回结构化 JSON 错误,而非原始 500 错误。
  • 原始音频通道的流读取器失效时,可在通话中途恢复。

v1.6.0 —— 2026年7月9日

  • 热转接(有人接听的转接):保持当前通话线路、与双方进行对话式确认、确认后合并通话。
  • 支持安装到 iPhone 主屏幕(PWA)。
  • 来电者停止说话后,现在会立即发送确认回应。

v1.5.3 —— 2026年6月27日

  • 不再由 TTS 朗读按键音。
  • Storm 工具调用新增模型回退路径,以应对上游减速。

v1.5.2 —— 2026年6月18日

  • 减少 Storm 在话未说完时的中断:轮次结束检测已改进,不再仅依赖简单的停顿阈值。已在发布前完成基准测试。
  • 支持在 Storm 上配置回应提示。

v1.5.1 —— 2026年6月15日

  • 修复外呼中的保持处理和 IVR 菜单导航问题。
  • 更新网站。

v1.5.0 —— 2026年6月9日

  • 提升歧义片段的拼写回读准确性。
  • 语言检测在整个通话期间保持启用;新增短语句切换检测器,并降低配置语言的置信度下限。
  • 修复额外智能体语言的自动保存问题。

v1.4.3 —— 2026年5月28日

  • 在传入音频尚未确认是语音时暂停 TTS——不再打断犹豫中的来电者。
  • 多项通话质量修复。

v1.4.2 —— 2026 年 5 月 21 日

  • 围绕多种声学信号重构 VAD —— 改善嘈杂环境中语音检测的精确率与召回率平衡。
  • VAD 区间现可输出完整内容——不再截断话语的开头部分。
  • 修复问候语回声导致的自身抢话问题:智能体不再在自己的开场白中打断自身。

v1.4.1 —— 2026 年 5 月 13 日

  • 语音系统全面升级:以统一命名重构目录。

v1.4.0 —— 2026 年 5 月 5 日

  • 通话进行期间向控制台实时流式传输转录文本。
  • 自动检测语言,并支持在通话中途切换。
  • A/B 实验框架:并行运行不同的智能体版本并比较结果。

v1.3.1 —— 2026 年 4 月 28 日

  • 自动问题调查:被标记的通话将获得结构化、可审核的调查记录。
  • 草稿部署:基于初始化快照暂存智能体编辑内容,并原子化发布。
  • 设置重新设计;引导式入门指导。
  • 将通话成功评分重新定义为围绕任务完成情况,而非通话完成情况。
  • 可配置的通话结束静默尾音。

v1.3.0 —— 2026 年 4 月 23 日

  • 场景生成:生成具有人设和目标的模拟来电者,可在上线前针对智能体运行。
  • 测试通话和问题页面全面升级。

v1.2.1 —— 2026 年 4 月 21 日

  • 导出通话记录。
  • 重写 API 文档。
  • 按需在通话中途切换语言。
  • 根据来电者的语言本地化确认回应。
  • 跨通话和号码提供可组合、可保存的筛选条件。

v1.2.0 —— 2026 年 4 月 17 日

  • 智能体构建器重新设计。
  • 多语言智能体无需重新提示即可在对话中途切换语言。
  • 为保持一致性,重命名语音目录。
  • 针对复杂请求重构 Storm 输出。

v1.1.1 —— 2026 年 4 月 14 日

  • 评分信号质量优化:缺失转录文本不再被评为失败;评分器输入已去重。
  • 支持跨通话批次的流水线报告。

v1.1.0 —— 2026 年 4 月 8 日

  • 电话号码标签。
  • 转接和告别语可被打断,且不会损坏通话状态。
  • 为每个智能体提供用于 IVR 导航的断句配置。

v1.0.4 —— 2026 年 3 月 30 日

  • 升级通话记录详情视图。
  • 可配置外呼通话的完成提示。
  • 在上游 API 响应缓慢时,Storm 会优雅降级而非阻塞当前轮次。

v1.0.3 —— 2026 年 3 月 23 日

  • DTMF 发送:智能体可按键操作 IVR 并输入代码,同时提供逐位确认。
  • 保持状态支持明确的等待保持触发器——智能体会等待保持音乐结束,并在人声出现时恢复。
  • 可配置说话与执行顺序。
  • 修复输入 DTMF 后无声的后续回应。

v1.0.2 —— 2026 年 3 月 18 日

  • 新增高清语音。
  • 修复组件中的通话成本显示。
  • 现可检测并清理过期的 in_progress 通话。

v1.0.1 —— 2026 年 3 月 16 日

  • 降低通话接通延迟。
  • 组件:回铃音不再混入会话音频。
  • 电话号码管理 API。

v1.0.0 —— 2026 年 3 月 10 日

  • 完整通话录音,可在控制台中归档和播放。
  • 浏览器测试通话。
  • 通过注册邀请团队成员。
  • 每次通话的成本明细。

v0.9.2 —— 2026 年 3 月 8 日

  • Bolt 会在生成 TTS 令牌时进行流式输出,而非等待完整生成结果——缩短首词时间。
  • Bolt 转录速度更快,且更能应对转录器变慢的情况。
  • 支持通行密钥登录及组织级强制执行。
  • 通话记录显示每次通话的实际计费成本。

v0.9.1 —— 2026 年 3 月 5 日

  • 组件快速接通,并为浏览器通话提供内置降噪功能。
  • 降低 Spark 轮次延迟,并改善从失败轮次中的恢复能力。
  • 修复长静默尾音后的句子重启问题。

v0.9.0 —— 2026 年 3 月 2 日

  • 多语言对话。
  • 生产就绪性加固优化。

v0.8.0 —— 2026 年 2 月 26 日

  • 在模型后端之间增加冗余——单个后端故障不再会在通话中途暴露。

v0.7.1 —— 2026 年 2 月 25 日

  • Storm 支持可配置的推理深度。
  • 工具调用占位回应:智能体会在执行较长操作前予以确认。
  • 挂断时机记录精确到断开瞬间。
  • Webhook 投递去重。

v0.7.0 —— 2026 年 2 月 20 日

  • 面向来电者和用户的同意控制。
  • 基于令牌流式传输的 TTS 路径——在句子完成前开始合成。
  • 环境背景音与智能体语音增益解耦。

v0.6.2 —— 2026 年 2 月 18 日

  • 根据智能体配置重新生成提示词。
  • 修复配置按钮状态。

v0.6.1 —— 2026 年 2 月 12 日

  • 发布开发者文档。

v0.6.0 —— 2026 年 2 月 11 日

  • 可嵌入小组件:通过脚本标签在您自己的网站中使用语音智能体,并通过可发布密钥进行身份验证。
  • 推出三引擎产品阵容——Spark、Bolt、Storm——在模型大小、延迟和每分钟费率方面有所不同。
  • 基于集成的工具路由:工具调用通过已连接集成的端点解析。

v0.5.0 —— 2026 年 2 月 10 日

  • ThunderPhone 控制台:在浏览器中构建、测试和管理智能体。
  • 支持通过电子邮件邀请组织和团队成员。
  • 自带运营商的 SIP 中继和统一号码管理。
  • 集成界面。
  • 环境背景音选项。
  • Google OAuth 登录。

v0.4.2 —— 2026 年 1 月 27 日

  • 在一系列边缘情况断连后强化通话传输。
  • 声学事件分类移出响应关键路径——噪声检测不再增加延迟。

v0.4.1 —— 2026 年 1 月 14 日

  • 扩充音色阵容。
  • 修复可能导致单轮交互中播放冻结的音频泵停滞问题。
  • 降低实时响应路径的延迟。

v0.4.0 —— 2026 年 1 月 6 日

  • 使用情况日志和单次通话成本报告。
  • 将每轮模型往返合并为一次请求,从每次回复中移除一次网络往返。
  • 修复丢失的转写片段。

v0.3.3 —— 2025 年 12 月 18 日

  • 生成完成不再等待缓慢的转写器。
  • 修复转写最终确定超时问题。
  • 修复合并通话音频中的伪影。

v0.3.1 —— 2025 年 12 月 12 日

  • 添加声学噪声分类器,以减少背景噪声引发的误触发语音;并根据录制通话调优其置信度阈值。
  • 通话结束检测:添加告别意图和告别后静默信号,以改善精确率/召回率权衡——减少过早挂断,减少长时间无声线路。
  • 为安静的来电者添加宽松 VAD 模式——降低起始阈值,但会增加部分误接受。
  • 更快派发确认回应。

v0.3.0 —— 2025 年 12 月 4 日

  • 实时转写。
  • 录音整合为每通电话一个混合音频文件。
  • 修复整个管道中的延迟问题。

v0.2.4 —— 2025 年 11 月 24 日

  • 确认回应会与待完成的回复进行核对,以避免与最终答案矛盾。
  • 提高确认回应超时时间,以避免过早再次提示。
  • 修复较长回复中的音频故障。
  • 修复对来电者长时间静默的处理。

v0.2.3 —— 2025 年 11 月 20 日

  • 通话录音。
  • 等待和转接期间的保持音乐。
  • Spark 初始版本:将简单通话流程迁移至更小、延迟更低的模型。
  • 扩展可用电话号码。

v0.2.2 —— 2025 年 11 月 14 日

  • 通话完成 Webhook 现在会在通话状态最终确定后再触发。
  • 降低模型在简单轮次中的推理强度,以减少响应延迟。

v0.2.1 —— 2025 年 11 月 11 日

  • 插话打断:来电者开始说话时,智能体停止讲话。
  • 限制失控的音频缓冲区。
  • 降低响应延迟。
  • 新增音色。

v0.2.0 —— 2025 年 11 月 5 日

  • 确认回应现会根据来电者请求生成,而非使用通用填充语。
  • 改进通话结束 Webhook。
  • 当单轮交互停滞超过五秒时,可更快恢复。

v0.1.4 —— 2025 年 10 月 31 日

  • 中断处理。
  • 智能体会在挂断前完成告别语——不再出现说到一半被截断的情况。
  • 电话号码会以适合语音表达的格式呈现。

v0.1.3 —— 2025 年 10 月 29 日

  • 支持通话事件的 Webhook。
  • 在连接短暂中断时支持通话中恢复。

v0.1.2 —— 2025 年 10 月 28 日

  • 支持姓名和确认号码的拼写复述。
  • 减少由背景噪音引发的误语音触发。
  • 提供更多语音和口音。

v0.1.0 —— 2025 年 10 月 8 日

  • 首次发布:支持真实电话通话的 AI 语音智能体,支持呼入和呼出。