标签:多模态处理
包含标签「多模态处理」的全部资源
共 26 个结果
多模态RAG文档处理服务器
一个基于MCP协议的服务器,提供全面的检索增强生成(RAG)能力,支持多模态文档处理与查询。
多模态内容处理平台
Mindual是一个多模态内容处理平台,支持文本和图像的多向转换及与谷歌日历的集成。
多模态费用处理系统
Agentic Multimodal Expense Processing (AMEP) 是一个端到端的GenAI流程,利用多模态LLMs从发票图像中零样本提取数据,通过Agentic MCP服务器实现自主分类,将非结构化文档实时转换为结构化费用报告并同步到Google Sheets进行分析。
多模态输入处理服务器
一个支持文本、图像、音频和视频输入的多模态处理服务器,具备文本提取、图像标注、音频转文本和背景噪声分类等功能。
多模态内容处理平台
Amazon Nova MCP是一个基于Amazon Bedrock的多模态内容处理平台,支持文本、图像等多种数据类型的高效处理和分析。
AI代理工具
Cortex-R是一款基于模型上下文协议(MCP)的高级AI代理,具备多模态感知、持久记忆和工具使用能力,适用于复杂任务的分步解决和Telegram集成对话。
多模态文档检索处理服务器
基于MCP协议的RAG-Anything服务,提供多模态文档处理与智能检索功能,适用于知识管理和信息查询场景。
AI开发助手系统
Luna Services是一个基于Google Gemini AI和Supabase数据库的通用模型上下文协议(MCP)系统,提供智能开发辅助、多模态处理和实时代码生成功能,适用于开发效率提升和团队协作。
图像编辑模型
Step1X-Edit是一款先进的图像编辑模型,支持多模态指令处理和高质量图像生成,适用于各种真实用户编辑场景。
多模态模型路由服务
omni-mcp是一种多模态MCP服务器,能够根据输入类型(文本、图像或音频)自动将请求路由到合适的本地模型,适用于需要处理多种输入类型的本地AI应用场景。
多模态内容分析工具
一款结合RAG和MCP技术的AI内容分析工具,支持文件上传、URL分析和文本输入,提供智能交互式聊天界面。
Gemini MCP 智能代理服务器
一个基于Google Gemini模型的智能MCP服务器,提供多模态输入支持、自动工具选择、多轮推理及跨MCP委派功能,适用于AI助手开发和多场景智能化应用。
智能对话系统
基于Spring AI框架开发的智能对话系统,集成MCP协议和RAG技术,支持多模态处理和工具调用。
AI模型协议服务器
用于连接Venice API的模型上下文协议服务器,提供31种跨模态AI工具的无审查私有化部署方案。
高级Gemini MCP服务器
一个提供10种高级AI功能的多模态处理服务器,支持文本生成、文件分析、实时搜索等,适用于全球开发者社区。
多模态文档处理服务
RAG-Anything MCP Server是一个基于模型上下文协议的多模态文档处理系统,支持PDF、图像、表格等多种文档类型的处理,集成知识图谱和多种查询模式。
LangChain MCP集成工具
LangChain MCP是一个为LangChain应用提供MCP服务器集成的工具,支持工具发现、多模态内容处理和实时监控等功能,适用于AI工作流增强和自动化任务处理。
Claude智能代理服务器
一个支持多模态输入、会话管理和MCP协议连接的Claude智能代理服务器,提供AI辅助查询、多轮对话和工具集成功能。
Gemini多工具协作协议服务器
Gemini MCP服务器实现了多工具协作协议(MCP),使主AI模型能与Google的Gemini Pro模型协作,提供增强的代码审查、问题解答、创意构思等功能。
AI编排系统
企业级AI编排系统,用于管理AI模型、代理和自动化工作流程,具有企业级安全性。
多模态AI代理服务器
OpenRouter MCP Multimodal是一个生产级的模型上下文协议(MCP)服务器,支持文本、视觉、音频和视频AI工具的分析和生成。
检索增强生成服务器
一个提供全面检索增强生成(RAG)能力的MCP服务器,支持多模态文档处理与查询。
智能图像分析服务
Gemini MCP 是一个基于 Google Gemini 2.0 Flash 模型的智能图像分析服务,提供多模态分析、灵活输入、流式响应和智能存储等功能,适用于各种AI助手集成。
多模态媒体生成工具包
基于Rust构建的模型上下文协议(MCP)服务器,提供图像、视频、音乐和语音的统一生成接口。
