cascade-img
v0.1.1
io.github.laffeyp/cascade-img
LLM-operable Midjourney pipeline: 21 MCP tools to compose, generate, curate with vision, and log.
“Vision” 共 98 个结果
v0.1.1
io.github.laffeyp/cascade-img
LLM-operable Midjourney pipeline: 21 MCP tools to compose, generate, curate with vision, and log.
v1.1.0
io.github.Samuelfmedeiros/arachne
Web scraping, browser RAG, vision, transcription, and 20 AI tools. Universal data intelligence.
v0.2.0
io.github.codeChap/grok-chat
MCP server for the xAI Grok API — chat, vision, search, and embeddings
v0.1.0
io.github.codeChap/gpt-chat
MCP server for the OpenAI ChatGPT API — chat, vision, and embeddings
v0.1.0
io.github.codeChap/claude-chat
Anthropic Claude Messages API MCP server — chat, vision, web search, extended thinking
v3.2.3
io.github.sena-labs/replicate-mcp-server
Replicate 的 MCP 服务器,共 36 个工具:图像、视频、音频、语音、大模型、视觉、超分、3D 与训练。
v0.4.0
io.github.hoainho/podium-mcp
移动端 E2E MCP(51 个工具):覆盖 iOS 与 Android、原生 UI 与 canvas/WebGL,无需视觉模型,支持 RN 调试。
v0.29.10
io.github.tosin2013/helmdeck
自托管 MCP 服务,为任意智能体提供沙箱浏览器、桌面、视觉与代码编辑工具包。
v0.2.1
io.github.afferens/mcp-server
面向 AI 智能体的实时物理感知——视觉、空间、声学与环境影响。
v0.1.5
io.github.perceptdot/sentry
面向 AI 智能体的 Sentry 错误追踪视角——附带 ROI 度量,详见 perceptdot.com
v0.1.5
io.github.perceptdot/github
面向 AI 智能体的 GitHub 仓库监控视角——附带 ROI 度量。
v0.1.6
io.github.perceptdot/vercel
面向 AI 智能体的 Vercel 部署视角——附带 ROI 度量,详见 perceptdot.com
v0.2.6
io.github.perceptdot/ga4
面向 AI 智能体的 Google Analytics 4 视角——附带 ROI 度量,详见 perceptdot.com
v1.10.0
io.github.felixgeelhaar/scout
具备 84 个工具的浏览器自动化 MCP server:纯 CDP 实现,支持 DOM 差分与视觉混合模式。
v0.1.0
ai.roc/mcp
ROC 生物识别与计算机视觉能力:人脸、车牌、OCR、行人、车辆与枪支检测。
v0.1.0
app.contendeo/contendeo
多模态视频分析 MCP —— 对任意视频 URL 进行转写、视觉理解与 OCR。
v1.0.3
com.roboflow/roboflow-mcp
面向 AI 智能体的 Roboflow 计算机视觉:数据集、标注、版本、工作流与推理。
v1.0.0
io.github.mlintangmz2765/scholar
面向深度学术研究的加固版 Scholar MCP,接入 Scopus、OpenAlex、Unpaywall 并支持 PDF 视觉解析。
v0.2.0
io.github.ykshah1309/stealth-agent-browser-mcp
隐身 Chromium MCP 服务器,融合 AOM 与 Set-of-Mark 视觉方案,并用 Readability 提取正文。
v1.0.1
io.github.divitkashyap/auto-skill-loader
自动将技能加载到智能体会话中,并提供 MiniMax 视觉与搜索代理。
v0.9.27
io.github.ndjordjevic/pinrag
MCP 版 RAG:索引 PDF、代码仓库、YouTube、Discord 与文本,可选 YouTube 视觉解析,检索结果附引用。
v0.2.9
io.github.saranshbamania/mobile-device-mcp
AI 控制 Android/iOS 设备:截图、UI 树、AI 视觉、Flutter、视频,共 49 个工具。
v0.1.2
io.github.AdonaiVera/fiftyone-mcp-server
通过 AI 助手以 80 多个算子控制 FiftyOne 计算机视觉数据集。
v1.0.2
io.github.PyJudge/pdf4vllm
面向视觉 LLM 的 PDF 阅读器,可自动检测文本损坏并切换为图像模式。