标签:语音识别
包含标签「语音识别」的全部资源
共 62 个结果
语音日历管理工具
一个基于Express的应用程序,通过语音识别和MCP协议提供日历管理功能,支持与CalDAV服务器交互和OpenAI兼容的API调用。
语音聊天系统
SpeakerMan是一个基于人工智能的完整语音聊天系统,结合语音识别(Whisper)、自然语言处理(Gemini)和语音合成(gTTS)技术,提供流畅的对话体验。
语音交互服务
mcp-claude-say 是一个为 Claude Code 提供的语音交互服务,支持文本到语音(TTS)和语音到文本(STT)功能,实现完整的语音对话体验。
语音处理组件
一组用于语音合成(TTS)、语音识别(STT)和检索增强生成(RAG)的轻量级组件,适用于小型项目和个人开发。
语音产品搜索助手
一个基于语音输入的多模态产品搜索助手,利用LangGraph进行多步骤代理编排,结合RAG和网络搜索功能,通过语音输入和输出提供产品搜索服务。
语音转文本服务
一个基于Rust和OpenAI Whisper的语音转文本MCP服务器,支持macOS、Linux和Windows的硬件加速。
语音转文本工具
claude-stt是一款本地化、隐私保护的语音转文本工具,专为Claude Code设计,支持跨平台使用,提供两种录音模式:静音检测和按键通话。
语音识别与合成服务
一个集成了语音识别(STT)和语音合成(TTS)功能的Web服务器,支持REST API和MCP协议,适用于AI助手集成和音频处理。
语音转录服务器
MCP Whisper转录服务器是一款基于MLX优化的Whisper模型的音频/视频转录服务,专为Apple Silicon设备设计,提供超快速性能。
AI面试代理
一个本地智能代理,通过实时语音翻译和自然语音合成技术,支持技术面试场景下的多语言交流。
语音笔记转换工具
一款利用AI技术将语音录音转换为可操作任务、日历事件和结构化笔记的工具,支持Claude AI和MCP协议。
语音转文字插件
MCP-Audio是一款符合AIO-2030标准的MCP插件,通过Audio语音识别API实现语音到文字的转换,支持多格式输入和JSON-RPC结构化输出。
语音日历工具
一个结合语音识别和日历管理的工具,通过语音指令管理日历事件并与CalDAV服务器交互。
语音转文字会议记录工具
Discord语音频道实时语音转文字工具,支持说话人识别、自动会议记录生成和MCP服务器集成,适用于韩英双语会议团队。
语音日历管理工具
一个结合语音识别和人工智能的日历管理工具,支持通过语音或文本指令管理日历事件,并与CalDAV服务器集成。
语音对话应用
基于WebSocket的双向音频流应用,集成Amazon Nova Sonic模型实现实时语音对话,支持多语言界面和多种AI语音角色。
语音日历工具
一个结合语音识别和日历管理的工具,通过语音指令管理日程并与CalDAV服务器交互。
语音识别服务
基于GLM-ASR-Nano的高精度语音识别服务,支持17种语言,提供Web UI、REST API和SSE流式传输功能。
语音MCP服务器
一个为Claude Code和其他MCP客户端添加语音功能的服务器,支持高质量的文本转语音(TTS)和语音转文本(STT)功能。
语音转录服务
Deepgram的模型上下文协议服务器,为AI编辑器提供直接访问Deepgram的语音、转录和音频智能工具的服务。
语音转录服务
通过本地或远程服务器上的Whisper进行语音转录,支持Claude Code通过SSH/tmux环境进行远程语音输入。
视频转录工具
一款基于 whisper.cpp 的高性能视频转录服务器,支持从 1000+ 平台下载并转录视频,适用于离线语音转文字场景。
语音交互MCP服务器
为Claude Code提供双向语音交互功能,通过本地运行的语音转文本和文本转语音工具实现与Claude的自然语言对话。
Teams MCP服务器
一个独立的MCP服务器,提供Microsoft Teams、日历、语音/STT和Persona会议功能,支持原生模式(Graph API)和Persona模式(基于浏览器,无需Azure注册)。
