微信扫码
和创始人交个朋友
我要投稿
百聆是强大的开源 AI 语音对话助手,时延低,功能全。这是小贤看到的关于语音助手最好的推荐,没有之一。 核心内容: 1. 百聆的技术核心与功能亮点 2. 百聆适用的多种应用场景 3. 百聆的主要功能及技术原理
百聆(Bailing)是一款开源的语音对话助手,基于语音识别(ASR)、语音活动检测(VAD)、大语言模型(LLM)和语音合成(TTS)技术,能够与用户进行自然的语音对话。百聆的端到端时延低至800ms,无需GPU即可运行,适用于各种边缘设备和低资源环境。
百聆通过模块化设计,支持记忆功能、工具调用和任务管理,提供高质量的语音对话体验。其核心目标是在低资源环境下实现类GPT-4o的对话效果,适用于智能家居、个人助理、车载系统等多种场景。
git clone https://github.com/wwbin2017/bailing.git
cd bailing
pip install -r requirements.txt
config/config.yaml
文件,配置ASR、LLM等相关参数。SenseVoiceSmall
模型到 models/SenseVoiceSmall
目录。deepseek
的 api_key
并配置到项目中。cd server
python server.py # 启动后端服务
python main.py
启动后,系统会等待语音输入,通过FunASR将语音转为文本,silero-vad进行语音活动检测,deepseek生成回复,最后通过edge-tts将文本转换为语音输出。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-02-23
官方报告:DeepSeek-V3 模型是如何炼成的!
2025-02-23
16.3K star! 微软开源AI Agent神器 OmniParser,让AI成为你的电脑操作专家
2025-02-23
DeepSeek本地最轻量化部署,支持联网以及知识库
2025-02-23
开源VS闭源,DeepSeek是最好选择吗?
2025-02-22
本地部署Ollama与DeepSeek R1:安装、优化与应用实测
2025-02-22
DeepSeek R1 全系列模型部署指南
2025-02-22
DeepSeek 满血版在 IDEA 中怎么用?手把手教程来了
2025-02-22
开源力量!轻松上手 Xinference:让DeepSeek-V3/R1满血私有化推理触手可及
2025-01-01
2024-07-25
2024-05-06
2025-01-21
2024-09-20
2024-07-20
2024-08-13
2024-06-12
2024-12-26
2024-07-11
2025-02-23
2025-02-18
2025-02-15
2025-02-15
2025-02-12
2025-02-07
2025-01-22
2025-01-16