共 2 个结果
CV_Robot_MCP是一个基于Python的项目,通过集成视觉语言模型(VLM)使机器人能够视觉解读其环境,并与HuggingFace Space中的CV_MCP_Server通信以分析机器人摄像头捕获的图像并提供有意义的对象描述。
一个基于InternVL3模型的图像分析服务器,用于评估图像与查询的相关性并生成基于视觉内容的文本响应。