huggingface

@huggingface

speech-to-speech

huggingface/speech-to-speech

Build local voice agents with open-source models

STARS10,692
FORKS1,311
ISSUES128
LANGUAGEPython

HISTORICAL INTELLIGENCE

历史情报摘要

按周期独立统计
日榜当前未记录
历史最佳#1最近排名#8

当前未进入本站记录范围

记录天数
4 天
记录期 Star
+3.1k
本站共 12 天日榜快照 · 最近记录 2026-08-01
月榜持续记录
历史最佳#11当前排名#11

与上一期排名持平

记录天数
7 天
记录期 Star
+3k
本站共 12 天月榜快照 · 最近记录 2026-08-04
本站最早记录:2026-07-28

指标仅基于本站已保存快照,不代表项目在 GitHub 的首次上榜时间;同日多次抓取保留当日最新结果,负向 Star 差值按样本校正处理。

日榜历史趋势

2026-07-28 至 2026-08-01,掉榜日期保留为空缺。

排名,数字越小越靠前当日新增 Star
折线表示历史榜单排名,柱形表示相同快照记录的新增 Star。排名纵轴已反向,越靠上排名越高。 #1 #3 #5 #6 #8 2026-07-28:新增 177 Star 2026-07-29:新增 837 Star 2026-07-30:新增 627 Star 2026-08-01:新增 1275 Star 2026-07-28:排名 #6,新增 177 Star2026-07-29:排名 #4,新增 837 Star2026-07-30:排名 #1,新增 627 Star2026-08-01:排名 #8,新增 1275 Star 07-28 08-01 +1.3k
图表仅使用本站保存的快照,不补零、不推算掉榜期间数据;下方历史明细继续保留原始日期、排名与 Star 数。

VERIFIABLE HEALTH SIGNALS

项目健康证据

维护、响应、交付与采用风险分开观察,不生成虚假的单一总分。
部分样本
MAINTENANCE

维护活性

核对提交
近 90 天 Commit
≥202
已采集下限
活跃贡献者
≥13
按公开提交账号去重
近 12 月活跃月份
5/12
基于已采集提交
RESPONSE

社区响应

核对样本
Issue 关闭率
44%
14/32 个同期新 Issue
Issue 关闭中位数
1.0 天
仅统计已关闭样本
PR 合并率
62%
69/112 个同期新 PR
PR 合并中位数
4.9 小时
仅统计已合并样本
DELIVERY

持续交付

核对发布
近 12 月正式 Release
3
排除草稿与预发布
最近正式 Release
2026-08-03
以公开发布时间为准
发布间隔中位数
89.0 天
至少两次正式发布才计算
ADOPTION

采用风险

查看仓库
仓库状态
正常开放
未发现归档标记
开源协议
Apache-2.0
仍需核对完整协议与依赖
Security Policy
未发现
仅检查 GitHub 社区资料

统计窗口 90 天快照样本 3 天计算规则 health-v1采集于 2026-08-04 02:05

高活跃数据触及分页上限,数值以已采集下限展示。 这些信号不替代代码审计、安全测试和真实生产验证。

AI-ASSISTED PROJECT BRIEF

项目定位与辅助解读

来源边界与风险表述检查

AI 解读仅作初评参考,技术落地请以 GitHub 源码、README 和完整协议为准。

项目资料AI 整理

模块化语音代理管线,VAD-STT-LLM-TTS级联,OpenAI Realtime兼容API,支持本地开源模型部署,Apache-2.0许可,由Hugging Face开发。

speech-to-speech是Hugging Face开发的开源Python项目,基于VAD-STT-LLM-TTS级联构建模块化语音代理,提供OpenAI Realtime兼容API。各组件可替换,支持连接本地或托管模型。从公开资料看,该项目声称用于数千台Reachy Mini机器人,提供CLI与快速启动,强调低延迟与本地部署。

核心亮点

项目最值得关注的能力

AI 推断
  • VAD→STT→LLM→TTS级联架构,各组件可替换
  • 支持OpenAI Realtime兼容WebSocket API
  • 可对接llama.cpp、vLLM等本地模型服务

适用场景

它可以解决哪些实际问题

AI 推断
  • 构建本地语音助手或对话代理
  • 为机器人提供语音交互后端
  • 隐私敏感场景下的全本地语音处理

技术观察

从公开资料提炼的实现特征

AI 推断
  • 使用Silero VAD v5、Parakeet TDT和Qwen3-TTS等模型
  • Python 3.10+,通过PyPI安装,平台依赖自动处理
  • CLI支持切换STT、LLM、TTS后端及API端点

优势判断

相对明确的项目价值

AI 推断
  • 高度模块化设计,便于定制与扩展
  • 支持完全本地部署,增强数据隐私

局限与注意

评估和采用前需要留意

AI 推断
  • 组件依赖较多,部署配置可能复杂
  • 官方未提供独立第三方安全验证,需自行评估

适用人群

哪些开发者和团队值得关注

AI 推断
  • 语音AI研究者与开发者
  • 需要集成语音交互的应用工程师
综合参考
该仓库为语音代理开发提供灵活的模块化框架,OpenAI兼容接口降低了接入成本。本地部署能力是显著亮点,但性能与安全性需自行验证。建议结合具体场景评估模型依赖和部署复杂度。
由 AI 基于 GitHub 公开资料辅助生成,不构成安全审计、生产选型或专业建议。

依据与内容边界

区分可验证事实、项目方自述与 AI 推断

GitHub 可验证事实

Star、Fork、License、更新时间及健康证据样本来自 GitHub 公开接口。

项目方自述

功能与使用方式主要来自仓库描述和 README,未经本站独立验证。

AI 推断

适用场景、优势与局限属于辅助解读,应结合原始文档独立判断。

  • GitHub事实:仓库显示Apache-2.0许可,10,650星,1,304分叉,128个开放issue。
  • 项目方自述:README声称该管线在生产中支撑数千台Reachy Mini机器人。
生成于 2026-08-04 02:20 规则版本 2026-07-v3
内容有误或您是项目作者?提交纠错
仅保存处理所需内容,不记录原始 IP;可信项目作者的高风险申诉会优先处理。