微信扫码
与创始人交个朋友
我要投稿
百聆是强大的开源 AI 语音对话助手,时延低,功能全。这是小贤看到的关于语音助手最好的推荐,没有之一。 核心内容: 1. 百聆的技术核心与功能亮点 2. 百聆适用的多种应用场景 3. 百聆的主要功能及技术原理
百聆(Bailing)是一款开源的语音对话助手,基于语音识别(ASR)、语音活动检测(VAD)、大语言模型(LLM)和语音合成(TTS)技术,能够与用户进行自然的语音对话。百聆的端到端时延低至800ms,无需GPU即可运行,适用于各种边缘设备和低资源环境。
百聆通过模块化设计,支持记忆功能、工具调用和任务管理,提供高质量的语音对话体验。其核心目标是在低资源环境下实现类GPT-4o的对话效果,适用于智能家居、个人助理、车载系统等多种场景。
git clone https://github.com/wwbin2017/bailing.git
cd bailing
pip install -r requirements.txt
config/config.yaml
文件,配置ASR、LLM等相关参数。SenseVoiceSmall
模型到 models/SenseVoiceSmall
目录。deepseek
的 api_key
并配置到项目中。cd server
python server.py # 启动后端服务
python main.py
启动后,系统会等待语音输入,通过FunASR将语音转为文本,silero-vad进行语音活动检测,deepseek生成回复,最后通过edge-tts将文本转换为语音输出。
53AI,企业落地大模型首选服务商
产品:场景落地咨询+大模型应用平台+行业解决方案
承诺:免费场景POC验证,效果验证后签署服务协议。零风险落地应用大模型,已交付160+中大型企业
2025-01-22
DeepSeek v3为何爆火?如何用其集成Milvus搭建RAG?
2025-01-22
DeepSeek-R1-Distill-Qwen-1.5B 在某些基准测试中超越了 GPT-4o
2025-01-22
专业法律知识问答智能体|Crew.ai 项目分享
2025-01-22
一个智能的AI操作系统OS,开源!
2025-01-22
腾讯混元3D上新!轻松制作一个3D模型
2025-01-22
「夜袭」 OpenAI!DeepSeek 开源最强推理模型 R1,再震欧美同行
2025-01-21
万字详解DeepSeek-R1,引爆AI圈的又一力作,大模型爆发势不可挡!
2025-01-21
11K+ Star!2025年最火AI+RPA网页操作神器
2024-07-25
2024-05-06
2024-08-13
2024-06-12
2024-07-11
2024-07-20
2024-09-20
2024-06-16
2025-01-01
2024-06-10
2025-01-22
2025-01-16
2024-12-24
2024-12-20
2024-12-19
2024-11-22
2024-11-19
2024-11-13