Product updates from the ThunderPhone team
更新日志
日期反映变更上线生产环境的时间。
v1.9.2 —— 2026年8月17日
- Realtime API:新增
session.live_transcripts—— 来电者转录片段会在定稿后通过会话套接字流式传输,而不再仅出现在通话后记录中。 - 将高级语音系列迁移至最新一代合成模型;乌尔都语语音已重新选配。
- 多语言智能体现在会在来电者切换语言的同一轮次切换语音语言,不再延迟一轮。
- 将静音线路挂断超时公开为智能体构建器设置。
- 当实时回复在接听竞争中抢先时,外呼问候语现在会让出发言权——人工在问候语中途接听时不再出现双向抢话。
- 修复受邀成员的同意门控重定向循环:所属组织现会贯穿整个接受流程。
v1.9.1 —— 2026年8月12日
- 新增
send_email智能体工具——可在通话过程中向已配置的收件人发送电子邮件。 - 在紧随实质性工具结果的轮次中提升回答质量。
- 针对姓名、地址和确认码的拼写复述更快且更准确。
v1.9.0 —— 2026年8月6日
POST /v1/call会快速返回持久化拨号记录并支持幂等重试;拨号进程继续异步执行。- 将
max_duration设为唯一准则:智能体会在时长上限触发前结束通话,而不是由媒体层强制中断。 - 确保工具调用与响应恰好配对一次——孤立的工具调用不再会阻塞后续消息的投递。
- 新增
additional_audio_context(三态),用于控制模型可听到多少前序轮次音频;已在构建器高级设置中提供。 - 外呼通话前音频现在基于 SIP 应答监督,而非墙钟时间。
- 强化集成凭据的存储方式。
v1.8.2 —— 2026年8月5日
- 所有 47 种支持的语言均已上线文档——超过 1,100 个本地化页面,包含 hreflang 配对和本地化站点地图。
- 录音披露默认开启,可按智能体覆盖,并提供生效状态读数;任何配置存在歧义时,运行时都会安全降级为“披露”。
- 缩短通话开始时流式首段音频的延迟。
v1.8.1 —— 2026年8月3日
- 支持按智能体选择不录音;同意声明会混入保留录音中,使录音产物可自说明。
- 新增每个组织一次性的 TCPA 确认机制,用于启用外呼功能。
- 修复粤语以普通话口音播报的问题。
- 将 CJK 回复调整为对话长度——长篇回答在 TTS 语速下的朗读效果不佳。
- 合成停顿不再导致静音——该轮次会自动恢复。
v1.8.0 —— 2026年7月31日
- 自定义语音克隆。
- 区域同意制度:EEA/UK/CH 需选择开启声明,其他地区默认开启且可选择退出,按每个通话链路确定。
- 数据保留:删除级联、擦除墓碑记录,以及用于处理数据主体请求的定时
dsar_sweep任务。 - 服务条款 v2.0,包含版本化、可举证的接受记录。
- 支持在线状态:基于心跳的会话在线状态与主动支持聊天。
v1.7.4 —— 2026年7月29日
- 知识库:通过受 SSRF 防护的服务端获取器导入 URL。
- 新增忘记密码流程。
- 控制台已更新为全新设计系统。
- Widget 1.2.1:回铃期间麦克风不再保持开启。
v1.7.3 —— 2026年7月28日
- 重新设计网站。
v1.7.2 —— 2026年7月27日
- 高级语音层级,提供按口音分组的目录。
- 高级合成失败时,现在会在轮次中途切换至标准语音,而不是丢弃该轮次。
- 修复流式合成输出中的 PCM 帧错位问题。
v1.7.1 —— 2026年7月24日
- 工具等待安抚:在长时间工具调用期间,智能体会说明进度而非保持沉默;已调整占位提示节奏以消除填充循环。
- 支持知识库拖放上传。
- macOS 应用自动更新。
- 修复通话开始时的双重问候竞争问题。
v1.7.0 —— 2026年7月22日
- 控制台和网站已本地化为 47 种区域设置:按命名空间拆分的目录、ICU 复数规则(包括阿拉伯语的六种类别)、区域设置 Cookie、按账户设置偏好。
- 事务性电子邮件和系统提示词也已本地化以保持一致。
v1.6.5 —— 2026年7月22日
- 已存储的提供商凭据已使用轮换密钥重新加密,并可在线轮换,无需停机。
- 会话令牌现在会在密码更改或重置时撤销;新增管理员紧急绕过路径。
- 支持按设备管理会话,并可单独撤销。
- 计费流水线加固:在并发情况下强制执行消费上限,自动充值具备幂等性,并正确处理乱序退款撤销。
v1.6.4 —— 2026年7月20日
- 全面强化授权范围、导出验证和出站请求防护。
- DTMF 按键数字已从日志和存储的工件中脱敏。
- Webhook 出站请求已固定 IP 并提供 SSRF 防护。
- 通话导出现在会遍历完整的筛选结果集,而非仅处理第一页。
v1.6.3 —— 2026年7月17日
- 在呼叫准入时按预留语义执行组织消费限额——在超出预算前拒绝呼叫,而非在超出后继续计费。
- 实时 WebSocket API:提供双向音频和事件帧,用于构建自定义通话前端。
- Webhook 平台:基于规范化负载字节的 HMAC 签名、指数退避重试机制,覆盖所有通话事件。
- 充值操作具备幂等性,并强化了支付 Webhook 验证。
- 在智能体构建器中新增实时提示词大小计量器。
v1.6.2 —— 2026年7月16日
- 客户门户:通过电子邮件发送的登录代码,为您的客户提供范围受限的只读访问权限。
- 应用内智能体:语音模式、可逐步操作 UI 的引导式演练、人工转接。
- 知识库:支持文档上传、分块摄取和有依据的检索。
- 支持按智能体配置接通提示音和进度提示音。
v1.6.1 —— 2026年7月13日
- 控制台内号码生命周期:搜索 → 订购 → 开通 → 分配。
- 新增智能体选项:静默确认停用开关;通话开始时播放接通提示音。
- 开通失败现在返回结构化 JSON 错误,而非原始 500 错误。
- 原始音频通道的流读取器失效时,可在通话过程中恢复。
v1.6.0 —— 2026年7月9日
- 预热转接(有人接听):保持通话支路、与双方进行对话式确认、确认后合并。
- iPhone 主屏幕安装(PWA)。
- 来电者停止说话后,确认回应现在会立即发送。
v1.5.3 —— 2026年6月27日
- 已禁止 TTS 朗读按键音。
- Storm 工具调用新增模型回退路径,以应对上游变慢。
v1.5.2 —— 2026年6月18日
- Storm 减少了话未说完时的中断:轮次结束检测已改进,不再仅依赖简单的停顿阈值。已在发布前完成基准测试。
- Storm 支持配置响应提示音。
v1.5.1 —— 2026年6月15日
- 修复了外呼中的保持处理和 IVR 菜单导航问题。
- 网站更新。
v1.5.0 —— 2026年6月9日
- 提升了歧义片段的拼写回读准确性。
- 语言检测在整个通话期间保持启用;新增短语句切换检测器,并降低了已配置语言的置信度下限。
- 修复了额外智能体语言的自动保存问题。
v1.4.3 —— 2026年5月28日
- 当传入音频尚未确认是语音时,TTS 会等待——不再打断犹豫中的来电者。
- 多项通话质量修复。
v1.4.2 —— 2026年5月21日
- 基于多种声学信号重构 VAD——提升嘈杂环境中语音检测的精确率与召回率平衡。
- VAD 片段现在会完整发出——不再截断语句的开头部分。
- 修复开场白回声导致的自我插话:智能体不再因自己的开场白而中断自身。
v1.4.1 —— 2026年5月13日
- 语音系统全面升级:重建目录并统一命名。
v1.4.0 —— 2026年5月5日
- 在通话进行期间将实时转录流式传输到控制台。
- 自动语言检测,并支持通话中切换。
- A/B 实验框架:并行运行智能体变体并比较结果。
v1.3.1 —— 2026 年 4 月 28 日
- 自动问题调查:被标记的通话会生成结构化、可审查的调查记录。
- 草稿部署:以初始化快照为基准暂存智能体编辑,并原子化发布。
- 设置重新设计;引导式入门指导。
- 通话成功评分改为以任务完成情况为核心,而非通话完成情况。
- 可配置的通话结束静音尾段。
v1.3.0 —— 2026 年 4 月 23 日
- 场景生成:使用生成的人设和目标模拟来电者,可在智能体上线前对其进行测试。
- 测试通话和问题页面全面升级。
v1.2.1 —— 2026 年 4 月 21 日
- 通话记录导出。
- API 文档重写。
- 可按请求在通话中切换语言。
- 确认回应会按来电者的语言提供。
- 适用于通话和号码的可组合、可保存筛选器。
v1.2.0 —— 2026 年 4 月 17 日
- 智能体构建器重新设计。
- 多语言智能体可在对话中切换语言,无需重新提示。
- 为保持一致性,语音目录已更名。
- Storm 输出针对复杂请求进行了重构。
v1.1.1 —— 2026 年 4 月 14 日
- 评分信号质量改进:缺失转录不再被判定为失败;评分器输入已去重。
- 支持跨通话批次的流水线报告。
v1.1.0 —— 2026 年 4 月 8 日
- 电话号码标签。
- 转接和结束语可被打断,且不会影响通话状态。
- 用于 IVR 导航的每智能体端点检测配置。
v1.0.4 —— 2026 年 3 月 30 日
- 通话记录详情视图升级。
- 外呼通话支持可配置的完成提示。
- 当上游 API 响应缓慢时,Storm 会优雅降级,而非阻塞当前轮次。
v1.0.3 —— 2026 年 3 月 23 日
- DTMF 发送:智能体可按键操作 IVR 并输入代码,且每位数字都会得到确认。
- 保持状态支持明确的等待保持触发器——智能体会等待保持音乐结束,并在人声出现后恢复。
- 可配置说话和操作的顺序。
- 修复 DTMF 输入后无声的后续回应。
v1.0.2 —— 2026 年 3 月 18 日
- 新增高清语音。
- 修复组件中的通话费用显示。
- 现可检测并清理过期的
in_progress通话。
v1.0.1 —— 2026 年 3 月 16 日
- 降低通话接通延迟。
- 组件:回铃音不再混入会话音频。
- 电话号码管理 API。
v1.0.0 —— 2026 年 3 月 10 日
- 完整通话录音,可在控制台中归档和播放。
- 浏览器测试通话。
- 可在注册时邀请团队成员。
- 每通电话的费用明细。
v0.9.2 —— 2026 年 3 月 8 日
- Bolt 会随着令牌生成流式输出 TTS,而非等待完整生成完成——缩短首词时间。
- Bolt 转录速度更快,并且更能应对转录服务变慢的情况。
- 支持通行密钥登录和组织级强制启用。
- 通话记录显示每通电话的实际计费费用。
v0.9.1 —— 2026 年 3 月 5 日
- 组件快速接通,并为浏览器通话提供内置降噪。
- 降低 Spark 轮次延迟,并改进从失败轮次中的恢复能力。
- 修复长静音尾段后的句子重启问题。
v0.9.0 —— 2026 年 3 月 2 日
- 多语言对话。
- 生产就绪性强化改进。
v0.8.0 —— 2026 年 2 月 26 日
- 为模型后端增加冗余——单一后端故障不再在通话中暴露。
v0.7.1 —— 2026 年 2 月 25 日
- Storm 支持可配置的推理深度。
- 工具调用占位回应:智能体会在执行耗时较长的操作前先作出确认。
- 挂断时间记录至精确的断开瞬间。
- Webhook 投递去重。
v0.7.0 —— 2026 年 2 月 20 日
- 面向来电者和用户的同意控制。
- 令牌流式 TTS 路径——在句子完成前即可开始合成。
- 背景环境音与智能体语音增益解耦。
v0.6.2 —— 2026 年 2 月 18 日
- 根据智能体配置重新生成提示。
- 修复配置开通按钮状态。
v0.6.1 —— 2026 年 2 月 12 日
- 开发者文档上线。
v0.6.0 —— 2026年2月11日
- 可嵌入小组件:通过脚本标签在您自己的网站上部署语音智能体,使用可发布密钥进行身份验证。
- 推出三款引擎产品阵容——Spark、Bolt、Storm——在模型大小、延迟和每分钟费率方面有所不同。
- 基于集成的工具路由:工具调用通过已连接集成的端点执行。
v0.5.0 —— 2026年2月10日
- ThunderPhone 控制台:在浏览器中构建、测试和管理智能体。
- 支持通过电子邮件邀请的组织和团队。
- 自带运营商 SIP 中继和统一号码管理。
- 集成 UI。
- 环境背景音选项。
- Google OAuth 登录。
v0.4.2 —— 2026年1月27日
- 在一系列边缘情况断连后强化通话传输。
- 声学事件分类移出响应关键路径——噪声检测不再增加延迟。
v0.4.1 —— 2026年1月14日
- 扩展语音产品阵容。
- 修复了可能导致播放在单轮对话中途卡死的音频泵停滞问题。
- 降低实时响应路径的延迟。
v0.4.0 —— 2026年1月6日
- 使用情况日志和单通话成本报告。
- 将每轮模型往返合并为单个请求,从每次回复中移除一次网络往返。
- 修复丢失的转录片段。
v0.3.3 —— 2025年12月18日
- 完成不再受慢速转录器阻塞。
- 修复转录最终化超时问题。
- 修复合并通话音频中的伪影。
v0.3.1 —— 2025年12月12日
- 新增声学噪声分类器,以减少背景噪声引发的误触发语音;并根据录制通话调整其置信度阈值。
- 通话结束检测:新增告别意图和告别后静默信号,以改善精确率和召回率之间的权衡——更少过早挂断,更少持续占线的死线路。
- 为安静的来电者新增宽松 VAD 模式——以一些误接受为代价降低起始阈值。
- 更快地发送确认回应。
v0.3.0 —— 2025年12月4日
- 实时转录。
- 录音整合为每通电话一个混合音频文件。
- 修复整个流水线中的延迟问题。
v0.2.4 —— 2025年11月24日
- 确认回应会根据待完成内容进行检查,因此不会与最终答案相矛盾。
- 提高确认回应超时时间,以避免过早再次提示。
- 修复较长回复中的音频故障。
- 修复对来电者长时间静默的处理。
v0.2.3 —— 2025年11月20日
- 通话录音。
- 等待和转接期间播放保持音乐。
- Spark 首个版本:将简单通话流程迁移到更小、延迟更低的模型。
- 扩展电话号码可用范围。
v0.2.2 —— 2025年11月14日
- 通话完成 webhook 现在会在触发前等待最终确定的通话状态。
- 降低简单轮次中的模型推理力度,以减少响应延迟。
v0.2.1 —— 2025年11月11日
- 插话打断:来电者开始讲话时,智能体停止说话。
- 限制失控音频缓冲区。
- 降低响应延迟。
- 新增语音。
v0.2.0 —— 2025年11月5日
- 确认回应现在会基于来电者的请求,而非使用通用填充语。
- 改进通话结束 webhook。
- 当单轮对话停滞超过五秒时,可更快恢复。
v0.1.4 —— 2025年10月31日
- 中断处理。
- 智能体会在挂断前完成结束语——不再出现话说到一半被切断的情况。
- 电话号码已针对语音正确格式化。
v0.1.3 —— 2025年10月29日
- 通话事件 webhook。
- 连接短暂波动时支持通话中恢复。
v0.1.2 —— 2025年10月28日
- 对姓名和确认号码进行拼写复述。
- 减少背景噪声引发的误触发语音。
- 更多语音和口音。
v0.1.0 —— 2025年10月8日
- 首个版本:在真实电话通话中使用 AI 语音智能体,支持呼入和呼出。