📖 产品简介
Eclatira 是 2026 年 9 月 27 日前后发布的实时语音+视频+动作对话 Agent 平台,面向需要「看屏幕并动手」能力的开发者与产品团队。
它的核心是把语音对语音、实时视觉与跨 API/MCP 的动作执行合并到同一个双向会话里:全双工语音端到端延迟压在 800ms 以内,视频以最高 30fps 在同一延迟预算内连续处理,Agent 既能通过摄像头「看见」现场,也能读取共享屏幕、对打印页/屏幕做 OCR、识别物体,并据此实时引导用户或调用工具。平台提供可视化 Agent Builder(用自然语言描述任务即可配置)与版本化 REST API 两种构建路径,可部署为网页小组件、电话(接 Twilio/Telnyx 自有号码)或 API 嵌入。集成层面支持自有 API、MCP 服务器以及 3,000+ 第三方应用,采用信用点计费(语音与文本共用一个余额)。其差异化在于将音频与视频收敛进单一协调管线,而非语音聊天机器人外挂视觉模块,也不像静态图像 CV API 那样只看快照。
定位
实时语音+视频+动作对话 Agent 平台,全双工 <800ms、30fps 视觉,连接 API/MCP/3000+ apps
适合人群
需要嵌入式可视化客服/引导的 SaaS 与产品团队
现场服务、远程协助与视觉验证场景
希望给应用接入会看、会听、能动手的对话智能体的开发者
支持平台
Web 小组件、电话(Twilio/Telnyx)、REST/WebSocket API
开源
否
✨ 核心功能
- 原生语音对语音引擎:双向音频流、可随时插话、端到端 <800ms 响应延迟
- 实时视觉管线:摄像头/共享屏幕以最高 30fps 连续处理,与语音同一延迟预算内同步
- OCR 与物体识别:读取画面/打印页文本并据此行动,识别产品与包装用于排障验证
- 全渠道部署:网页小组件、电话(Twilio/Telnyx)、版本化 REST/WebSocket API
- 集成中枢:自有 REST API、MCP 服务器、3,000+ 第三方应用,无需写集成代码
⚖️ 优缺点分析
👍 优点
- 语音与视觉在同一双向管线内处理,Agent 可边说边评论所见
- 语音/视频均 <800ms,交互自然无尴尬停顿
- Builder 自然语言配置 + API 双路径,上手快
- 支持自托管敏感视频流与细粒度权限边界(社区关注点)
👎 缺点
- 30fps 视频处理对带宽与算力要求较高
- 实时视觉带来隐私考量(需自行配置录制与留存策略)
- 底层基础模型厂商未公开,能力边界以官方为准
- 作为新平台,长期稳定性与生态规模待观察
📊 评分详情
功能完整
8.5
易用程度
8
安全可靠
8
性价比
7.5
💬 用户评价
Eclatira 把语音和视频收敛进同一条实时管线,Agent 能边看屏幕边开口引导——不是会说话的截图识别器,而是真正「看得到、做得了」的对话式视频 Agent。
📝 更新日志
-
2026-09-27公开发布Eclatira 于 2026-09-27 前后公开发布并登上 Product Hunt(约 305–315 票)。定位实时语音+视频+动作对话 Agent 平台:全双工语音 <800ms、视频 30fps 连续视觉、OCR 与物体识别,同一双向管线内融合语音与视觉;提供 Builder 与版本化 REST API,可部署为网页小组件/电话/API,连接自有 API、MCP 与 3,000+ 应用,信用点计费(Free $0/1,350 信用点,Solo $35/月)。