标签:语音转文字
包含标签「语音转文字」的全部资源
共 15 个结果
字幕生成与翻译工具
一款基于MCP服务器的AI字幕生成工具,提供音频转SRT字幕、多语言翻译、双语字幕生成及SRT转ASS格式的功能,适用于视频字幕处理和本地化工作。
会议数据分析服务器
Gong MCP Server 是一个模型上下文协议服务器,提供对Gong.io数据的访问,包括通话记录、转录、用户信息等,适用于客户沟通分析和团队协作。
音频AI插件
Deepgram Audio AI插件为Cursor IDE提供语音转文字、文字转语音及音频智能分析功能,适用于开发者和内容创作者的多语言音频处理需求。
会议管理协议服务器
Fathom MCP服务器是一个模型上下文协议服务器,使LLMs能够通过Fathom.video API进行会议录制管理、转录、摘要和数据分析。
语音转文字MCP服务
一个面向Agent的高质量语音转文字MCP服务,支持长音频分块、上下文传递和时间戳分段,适用于会议记录、通话分析、字幕草稿和语音备忘录转录等场景。
语音转文字工具
一个基于Groq Whisper模型的音频和视频文件转录服务,支持多种文件格式和MCP集成。
音频转录服务
一个基于OpenAI API的MCP服务器,提供音频文件转录功能,支持多种语言和保存选项。
会议记录处理服务
Fathom AI MCP Server 是一个基于模型上下文协议(MCP)的服务器,用于与 Fathom AI API 交互,提供会议记录、摘要、转录、团队和Webhook访问工具。
语音转文字服务器
ElevenLabs Scribe MCP Server 是一个基于模型控制协议(MCP)的语音转文字服务器,提供实时转录、文件转录和上下文管理功能。
会议管理协议服务器
Meeting BaaS MCP Server是一个模型上下文协议(MCP)服务器,提供管理会议数据的工具,包括转录、录音、日历事件和搜索功能。
电影音频转录工具
一个模块化系统,用于从电影中提取音频并将其转录为Markdown文件。
语音处理服务器
一个基于Python的服务器,提供语音转文字、说话人分离、翻译和文本摘要等功能的Whissle API端点访问。
会议转录MCP服务器
Fathom会议转录MCP服务器提供对会议录音、摘要和转录的访问,适用于需要会议内容管理和分析的场景。
文档处理AI助手
一个基于Python的Telegram机器人,具备文档和音频处理能力,集成AI模型提供文本提取、摘要和语音转文字等智能功能。
音频转录服务
一个基于AssemblyAI API的MCP服务器,用于将MP3音频文件转录为带有时间戳和说话人标签的JSON文本,适用于播客制作者、内容创作者、教育工作者和商业团队。
