Product updates from the ThunderPhone team

更新日志

日期反映变更上线生产环境的时间。

v1.9.2 —— 2026年8月17日

  • Realtime API:新增 session.live_transcripts —— 来电者转录片段会在定稿后通过会话套接字流式传输,而不再仅出现在通话后记录中。
  • 将高级语音系列迁移至最新一代合成模型;乌尔都语语音已重新选配。
  • 多语言智能体现在会在来电者切换语言的同一轮次切换语音语言,不再延迟一轮。
  • 将静音线路挂断超时公开为智能体构建器设置。
  • 当实时回复在接听竞争中抢先时,外呼问候语现在会让出发言权——人工在问候语中途接听时不再出现双向抢话。
  • 修复受邀成员的同意门控重定向循环:所属组织现会贯穿整个接受流程。

v1.9.1 —— 2026年8月12日

  • 新增 send_email 智能体工具——可在通话过程中向已配置的收件人发送电子邮件。
  • 在紧随实质性工具结果的轮次中提升回答质量。
  • 针对姓名、地址和确认码的拼写复述更快且更准确。

v1.9.0 —— 2026年8月6日

  • POST /v1/call 会快速返回持久化拨号记录并支持幂等重试;拨号进程继续异步执行。
  • max_duration 设为唯一准则:智能体会在时长上限触发前结束通话,而不是由媒体层强制中断。
  • 确保工具调用与响应恰好配对一次——孤立的工具调用不再会阻塞后续消息的投递。
  • 新增 additional_audio_context(三态),用于控制模型可听到多少前序轮次音频;已在构建器高级设置中提供。
  • 外呼通话前音频现在基于 SIP 应答监督,而非墙钟时间。
  • 强化集成凭据的存储方式。

v1.8.2 —— 2026年8月5日

  • 所有 47 种支持的语言均已上线文档——超过 1,100 个本地化页面,包含 hreflang 配对和本地化站点地图。
  • 录音披露默认开启,可按智能体覆盖,并提供生效状态读数;任何配置存在歧义时,运行时都会安全降级为“披露”。
  • 缩短通话开始时流式首段音频的延迟。

v1.8.1 —— 2026年8月3日

  • 支持按智能体选择不录音;同意声明会混入保留录音中,使录音产物可自说明。
  • 新增每个组织一次性的 TCPA 确认机制,用于启用外呼功能。
  • 修复粤语以普通话口音播报的问题。
  • 将 CJK 回复调整为对话长度——长篇回答在 TTS 语速下的朗读效果不佳。
  • 合成停顿不再导致静音——该轮次会自动恢复。

v1.8.0 —— 2026年7月31日

  • 自定义语音克隆。
  • 区域同意制度:EEA/UK/CH 需选择开启声明,其他地区默认开启且可选择退出,按每个通话链路确定。
  • 数据保留:删除级联、擦除墓碑记录,以及用于处理数据主体请求的定时 dsar_sweep 任务。
  • 服务条款 v2.0,包含版本化、可举证的接受记录。
  • 支持在线状态:基于心跳的会话在线状态与主动支持聊天。

v1.7.4 —— 2026年7月29日

  • 知识库:通过受 SSRF 防护的服务端获取器导入 URL。
  • 新增忘记密码流程。
  • 控制台已更新为全新设计系统。
  • Widget 1.2.1:回铃期间麦克风不再保持开启。

v1.7.3 —— 2026年7月28日

  • 重新设计网站。

v1.7.2 —— 2026年7月27日

  • 高级语音层级,提供按口音分组的目录。
  • 高级合成失败时,现在会在轮次中途切换至标准语音,而不是丢弃该轮次。
  • 修复流式合成输出中的 PCM 帧错位问题。

v1.7.1 —— 2026年7月24日

  • 工具等待安抚:在长时间工具调用期间,智能体会说明进度而非保持沉默;已调整占位提示节奏以消除填充循环。
  • 支持知识库拖放上传。
  • macOS 应用自动更新。
  • 修复通话开始时的双重问候竞争问题。

v1.7.0 —— 2026年7月22日

  • 控制台和网站已本地化为 47 种区域设置:按命名空间拆分的目录、ICU 复数规则(包括阿拉伯语的六种类别)、区域设置 Cookie、按账户设置偏好。
  • 事务性电子邮件和系统提示词也已本地化以保持一致。

v1.6.5 —— 2026年7月22日

  • 已存储的提供商凭据已使用轮换密钥重新加密,并可在线轮换,无需停机。
  • 会话令牌现在会在密码更改或重置时撤销;新增管理员紧急绕过路径。
  • 支持按设备管理会话,并可单独撤销。
  • 计费流水线加固:在并发情况下强制执行消费上限,自动充值具备幂等性,并正确处理乱序退款撤销。

v1.6.4 —— 2026年7月20日

  • 全面强化授权范围、导出验证和出站请求防护。
  • DTMF 按键数字已从日志和存储的工件中脱敏。
  • Webhook 出站请求已固定 IP 并提供 SSRF 防护。
  • 通话导出现在会遍历完整的筛选结果集,而非仅处理第一页。

v1.6.3 —— 2026年7月17日

  • 在呼叫准入时按预留语义执行组织消费限额——在超出预算前拒绝呼叫,而非在超出后继续计费。
  • 实时 WebSocket API:提供双向音频和事件帧,用于构建自定义通话前端。
  • Webhook 平台:基于规范化负载字节的 HMAC 签名、指数退避重试机制,覆盖所有通话事件。
  • 充值操作具备幂等性,并强化了支付 Webhook 验证。
  • 在智能体构建器中新增实时提示词大小计量器。

v1.6.2 —— 2026年7月16日

  • 客户门户:通过电子邮件发送的登录代码,为您的客户提供范围受限的只读访问权限。
  • 应用内智能体:语音模式、可逐步操作 UI 的引导式演练、人工转接。
  • 知识库:支持文档上传、分块摄取和有依据的检索。
  • 支持按智能体配置接通提示音和进度提示音。

v1.6.1 —— 2026年7月13日

  • 控制台内号码生命周期:搜索 → 订购 → 开通 → 分配。
  • 新增智能体选项:静默确认停用开关;通话开始时播放接通提示音。
  • 开通失败现在返回结构化 JSON 错误,而非原始 500 错误。
  • 原始音频通道的流读取器失效时,可在通话过程中恢复。

v1.6.0 —— 2026年7月9日

  • 预热转接(有人接听):保持通话支路、与双方进行对话式确认、确认后合并。
  • iPhone 主屏幕安装(PWA)。
  • 来电者停止说话后,确认回应现在会立即发送。

v1.5.3 —— 2026年6月27日

  • 已禁止 TTS 朗读按键音。
  • Storm 工具调用新增模型回退路径,以应对上游变慢。

v1.5.2 —— 2026年6月18日

  • Storm 减少了话未说完时的中断:轮次结束检测已改进,不再仅依赖简单的停顿阈值。已在发布前完成基准测试。
  • Storm 支持配置响应提示音。

v1.5.1 —— 2026年6月15日

  • 修复了外呼中的保持处理和 IVR 菜单导航问题。
  • 网站更新。

v1.5.0 —— 2026年6月9日

  • 提升了歧义片段的拼写回读准确性。
  • 语言检测在整个通话期间保持启用;新增短语句切换检测器,并降低了已配置语言的置信度下限。
  • 修复了额外智能体语言的自动保存问题。

v1.4.3 —— 2026年5月28日

  • 当传入音频尚未确认是语音时,TTS 会等待——不再打断犹豫中的来电者。
  • 多项通话质量修复。

v1.4.2 —— 2026年5月21日

  • 基于多种声学信号重构 VAD——提升嘈杂环境中语音检测的精确率与召回率平衡。
  • VAD 片段现在会完整发出——不再截断语句的开头部分。
  • 修复开场白回声导致的自我插话:智能体不再因自己的开场白而中断自身。

v1.4.1 —— 2026年5月13日

  • 语音系统全面升级:重建目录并统一命名。

v1.4.0 —— 2026年5月5日

  • 在通话进行期间将实时转录流式传输到控制台。
  • 自动语言检测,并支持通话中切换。
  • A/B 实验框架:并行运行智能体变体并比较结果。

v1.3.1 —— 2026 年 4 月 28 日

  • 自动问题调查:被标记的通话会生成结构化、可审查的调查记录。
  • 草稿部署:以初始化快照为基准暂存智能体编辑,并原子化发布。
  • 设置重新设计;引导式入门指导。
  • 通话成功评分改为以任务完成情况为核心,而非通话完成情况。
  • 可配置的通话结束静音尾段。

v1.3.0 —— 2026 年 4 月 23 日

  • 场景生成:使用生成的人设和目标模拟来电者,可在智能体上线前对其进行测试。
  • 测试通话和问题页面全面升级。

v1.2.1 —— 2026 年 4 月 21 日

  • 通话记录导出。
  • API 文档重写。
  • 可按请求在通话中切换语言。
  • 确认回应会按来电者的语言提供。
  • 适用于通话和号码的可组合、可保存筛选器。

v1.2.0 —— 2026 年 4 月 17 日

  • 智能体构建器重新设计。
  • 多语言智能体可在对话中切换语言,无需重新提示。
  • 为保持一致性,语音目录已更名。
  • Storm 输出针对复杂请求进行了重构。

v1.1.1 —— 2026 年 4 月 14 日

  • 评分信号质量改进:缺失转录不再被判定为失败;评分器输入已去重。
  • 支持跨通话批次的流水线报告。

v1.1.0 —— 2026 年 4 月 8 日

  • 电话号码标签。
  • 转接和结束语可被打断,且不会影响通话状态。
  • 用于 IVR 导航的每智能体端点检测配置。

v1.0.4 —— 2026 年 3 月 30 日

  • 通话记录详情视图升级。
  • 外呼通话支持可配置的完成提示。
  • 当上游 API 响应缓慢时,Storm 会优雅降级,而非阻塞当前轮次。

v1.0.3 —— 2026 年 3 月 23 日

  • DTMF 发送:智能体可按键操作 IVR 并输入代码,且每位数字都会得到确认。
  • 保持状态支持明确的等待保持触发器——智能体会等待保持音乐结束,并在人声出现后恢复。
  • 可配置说话和操作的顺序。
  • 修复 DTMF 输入后无声的后续回应。

v1.0.2 —— 2026 年 3 月 18 日

  • 新增高清语音。
  • 修复组件中的通话费用显示。
  • 现可检测并清理过期的 in_progress 通话。

v1.0.1 —— 2026 年 3 月 16 日

  • 降低通话接通延迟。
  • 组件:回铃音不再混入会话音频。
  • 电话号码管理 API。

v1.0.0 —— 2026 年 3 月 10 日

  • 完整通话录音,可在控制台中归档和播放。
  • 浏览器测试通话。
  • 可在注册时邀请团队成员。
  • 每通电话的费用明细。

v0.9.2 —— 2026 年 3 月 8 日

  • Bolt 会随着令牌生成流式输出 TTS,而非等待完整生成完成——缩短首词时间。
  • Bolt 转录速度更快,并且更能应对转录服务变慢的情况。
  • 支持通行密钥登录和组织级强制启用。
  • 通话记录显示每通电话的实际计费费用。

v0.9.1 —— 2026 年 3 月 5 日

  • 组件快速接通,并为浏览器通话提供内置降噪。
  • 降低 Spark 轮次延迟,并改进从失败轮次中的恢复能力。
  • 修复长静音尾段后的句子重启问题。

v0.9.0 —— 2026 年 3 月 2 日

  • 多语言对话。
  • 生产就绪性强化改进。

v0.8.0 —— 2026 年 2 月 26 日

  • 为模型后端增加冗余——单一后端故障不再在通话中暴露。

v0.7.1 —— 2026 年 2 月 25 日

  • Storm 支持可配置的推理深度。
  • 工具调用占位回应:智能体会在执行耗时较长的操作前先作出确认。
  • 挂断时间记录至精确的断开瞬间。
  • Webhook 投递去重。

v0.7.0 —— 2026 年 2 月 20 日

  • 面向来电者和用户的同意控制。
  • 令牌流式 TTS 路径——在句子完成前即可开始合成。
  • 背景环境音与智能体语音增益解耦。

v0.6.2 —— 2026 年 2 月 18 日

  • 根据智能体配置重新生成提示。
  • 修复配置开通按钮状态。

v0.6.1 —— 2026 年 2 月 12 日

  • 开发者文档上线。

v0.6.0 —— 2026年2月11日

  • 可嵌入小组件:通过脚本标签在您自己的网站上部署语音智能体,使用可发布密钥进行身份验证。
  • 推出三款引擎产品阵容——Spark、Bolt、Storm——在模型大小、延迟和每分钟费率方面有所不同。
  • 基于集成的工具路由:工具调用通过已连接集成的端点执行。

v0.5.0 —— 2026年2月10日

  • ThunderPhone 控制台:在浏览器中构建、测试和管理智能体。
  • 支持通过电子邮件邀请的组织和团队。
  • 自带运营商 SIP 中继和统一号码管理。
  • 集成 UI。
  • 环境背景音选项。
  • Google OAuth 登录。

v0.4.2 —— 2026年1月27日

  • 在一系列边缘情况断连后强化通话传输。
  • 声学事件分类移出响应关键路径——噪声检测不再增加延迟。

v0.4.1 —— 2026年1月14日

  • 扩展语音产品阵容。
  • 修复了可能导致播放在单轮对话中途卡死的音频泵停滞问题。
  • 降低实时响应路径的延迟。

v0.4.0 —— 2026年1月6日

  • 使用情况日志和单通话成本报告。
  • 将每轮模型往返合并为单个请求,从每次回复中移除一次网络往返。
  • 修复丢失的转录片段。

v0.3.3 —— 2025年12月18日

  • 完成不再受慢速转录器阻塞。
  • 修复转录最终化超时问题。
  • 修复合并通话音频中的伪影。

v0.3.1 —— 2025年12月12日

  • 新增声学噪声分类器,以减少背景噪声引发的误触发语音;并根据录制通话调整其置信度阈值。
  • 通话结束检测:新增告别意图和告别后静默信号,以改善精确率和召回率之间的权衡——更少过早挂断,更少持续占线的死线路。
  • 为安静的来电者新增宽松 VAD 模式——以一些误接受为代价降低起始阈值。
  • 更快地发送确认回应。

v0.3.0 —— 2025年12月4日

  • 实时转录。
  • 录音整合为每通电话一个混合音频文件。
  • 修复整个流水线中的延迟问题。

v0.2.4 —— 2025年11月24日

  • 确认回应会根据待完成内容进行检查,因此不会与最终答案相矛盾。
  • 提高确认回应超时时间,以避免过早再次提示。
  • 修复较长回复中的音频故障。
  • 修复对来电者长时间静默的处理。

v0.2.3 —— 2025年11月20日

  • 通话录音。
  • 等待和转接期间播放保持音乐。
  • Spark 首个版本:将简单通话流程迁移到更小、延迟更低的模型。
  • 扩展电话号码可用范围。

v0.2.2 —— 2025年11月14日

  • 通话完成 webhook 现在会在触发前等待最终确定的通话状态。
  • 降低简单轮次中的模型推理力度,以减少响应延迟。

v0.2.1 —— 2025年11月11日

  • 插话打断:来电者开始讲话时,智能体停止说话。
  • 限制失控音频缓冲区。
  • 降低响应延迟。
  • 新增语音。

v0.2.0 —— 2025年11月5日

  • 确认回应现在会基于来电者的请求,而非使用通用填充语。
  • 改进通话结束 webhook。
  • 当单轮对话停滞超过五秒时,可更快恢复。

v0.1.4 —— 2025年10月31日

  • 中断处理。
  • 智能体会在挂断前完成结束语——不再出现话说到一半被切断的情况。
  • 电话号码已针对语音正确格式化。

v0.1.3 —— 2025年10月29日

  • 通话事件 webhook。
  • 连接短暂波动时支持通话中恢复。

v0.1.2 —— 2025年10月28日

  • 对姓名和确认号码进行拼写复述。
  • 减少背景噪声引发的误触发语音。
  • 更多语音和口音。

v0.1.0 —— 2025年10月8日

  • 首个版本:在真实电话通话中使用 AI 语音智能体,支持呼入和呼出。