Developer API
通过 API 构建和部署 PAL,组合感知、理解、语音和渲染能力,创建可进行实时互动的 AI 角色。
Tavus
你从未见过这样的 AI。Tavus 的 PAL 是能够实时看见、听见、行动并理解情绪的类人 AI 角色,可用于客户支持、销售、医疗接待、培训、招聘和内部运营等场景。
Tavus 将感知、理解、记忆、语音和实时渲染组合为可部署的 PAL,支持通过 API、无代码工具或定制化企业方案落地。
通过 API 构建和部署 PAL,组合感知、理解、语音和渲染能力,创建可进行实时互动的 AI 角色。
在 PAL Maker 中输入一句话或与 Charlie 对话即可创建 PAL,并将其部署到网站或应用中。
PAL 能够看、听、理解、说话并自然回应,支持面向实时对话的语音和视频体验。
官方文档列出 Memory 与 Knowledge Base 能力,用于支持对话记忆和基于资料的交互。
Raven-1 处理表情、语气、视线和环境信息,Sparrow-2 处理打断、背景噪声、说话人身份及对话节奏。
Tavus 公开发布了面向实时人机交互的模型与研究内容,覆盖对话轮次、视觉呈现和多模态感知。
Tavus 介绍 Sparrow-2,这是面向实时语音和视频 AI 的新一代对话轮次模型,专注于嘈杂、多说话人环境中的自然交流。
Phoenix-4 是实时人类渲染模型,用于生成高保真面部行为,并呈现与上下文相关的情绪、表情和动作。
Raven-1 是多模态感知模型,帮助机器实时看见、听见并理解表情、语气、视线、情绪和环境信息。
通过官方开发文档、API 参考、研究页面和博客,了解 PAL 构建方式、模型能力及产品更新。