Dograh

Dograh

开源语音智能体基础设施,支持自托管、模型自由替换与 MCP 原生集成,打造可审计、低延迟的语音对话工作流。

访问官网

编辑点评

"Dograh 以开源与自托管为核心,提供灵活可插拔的语音智能体管线,兼顾低延迟、数据主权与 MCP 原生开发体验,适合对合规与可控性要求高的团队。"

优势

  • 开源 BSD-2 协议,支持完整自托管与私有云部署,数据不出域
  • 支持 Speech-to-Speech 端到端音频直连与预录制+TTS 混合模式,显著降低延迟并提升拟真度
  • 内置 MCP 服务器,可直接在 IDE 中创建与部署语音智能体,开发效率高

局限

  • 自托管版本需自行维护基础设施与模型服务,运维门槛较高
  • 官方托管云按分钟计费,高并发场景需联系销售获取定制报价
  • LLM 自由替换功能仍处于 Beta 阶段,部分模型适配稳定性待验证

Q&A

快速了解这个工具的常见问题与答案

Q
这个工具是否提供免费版?
Answer

是的,Dograh 的开源版本(BSD-2 协议)可永久免费自托管使用。官方托管云服务为付费模式,无免费试用层,但提供 $5 起的预充值账户用于快速启动。

Q
这个工具如何收费?
Answer

自托管版本免费。托管云服务采用按量付费模式,平台费约 1 美分/分钟起,支持预充值与用量折扣;企业私有部署与高并发需求需联系销售获取定制报价。

Q
这个工具支持哪些访问方式?
Answer

支持通过网页端(app.dograh.com)使用托管云服务。自托管版本可通过 Docker Compose 在本地或私有云中运行,无需依赖外部平台。

Q
这个工具是否支持中文或多语言?
Answer

平台底层支持 70 余种语言的语音识别与合成(取决于所选 STT/TTS 模型),但当前用户界面与文档均为英文,暂未提供中文本地化支持。

Q
这个工具是否支持 API?
Answer

Dograh 支持通过 Model Context Protocol(MCP)与 Claude Code、Cursor 等 IDE 工具集成,实现语音智能体的开发与部署;自托管版本可通过 Docker 和配置文件进行本地部署,不提供传统 REST API 作为主要接入方式。

Q
这个工具是否适合团队使用?
Answer

非常适合。Dograh 提供团队协作功能,包括 Slack 社区支持、共享工作区、审计日志与权限管理(企业版),支持从单个开发者到百人技术团队的规模化落地。

工具介绍

产品简介

Dograh 是一款开源语音智能体(Voice Agent)基础设施平台,定位为 Vapi 与 Retell 的开源替代方案。它提供无代码工作流构建器,支持语音转文本(STT)、大语言模型(LLM)、文本转语音(TTS)及电话通信模块的自由组合,并支持 Speech-to-Speech 端到端音频直连模式。平台采用 BSD-2 开源协议,允许用户 Fork 代码、接入自有模型并部署在本地服务器或私有云中,确保数据不出域、满足金融、医疗、国防等强监管行业的合规要求。

核心功能

  • 开源 BSD-2 协议,支持完整自托管与私有云部署,数据不出域
  • 支持 Speech-to-Speech 端到端音频直连与预录制+TTS 混合模式,显著降低延迟并提升拟真度
  • 内置 MCP 服务器,可直接在 IDE 中创建与部署语音智能体,开发效率高
  • 覆盖音频与语音相关需求
  • 覆盖自动化与智能体相关需求

适用场景

  • 客服问答
  • 销售支持
  • 流程自动化

适合谁用

  • 开发者
  • 技术团队
  • 需要集成 AI 能力的产品团队

选择参考

  • 适合场景:销售支持 / 自动响应。
  • 外部参考:公开工具目录中的收录还比较少;GitHub 项目 dograh-hq/dograh,约 5,312 个 star;可找到 11 个相关视频或教程。
  • 使用建议:更适合直接进入同类工具对比,重点看输出质量、价格和团队协作细节。

核心能力

主能力
音频与语音
次要能力
自动化与智能体

适用场景

客服问答
销售支持
流程自动化
价格与版本
SubscriptionEnterprise Quote
访问方式
Web App
支持语言
English