mcp-video-analyzer
活跃·★ 60·MIT·更新于 2026-09-10
★ 宝藏工具
该工具是一个用于全面视频分析的MCP服务器,可从各种在线平台和本地文件中提取转录文本、关键帧、OCR文本和元数据。它独特地将视觉和文本信息组合成带注释的时间线,提供视频内容的统一视图。
mcp-video-analyzer 当前归类于 Vision / Multimodal,更适合那些希望围绕具体工作流而不是单一功能点来选型的团队。从当前资料来看,它尤其强调 从各种视频源提取带有时间戳和说话人信息的转录文本。、分析视频错误报告(例如Loom录制),以提取错误消息和UI上下文。 这类能力。如果你关心许可证与可二次使用性,当前页面记录的许可证是 MIT。同时它也具备一定社区热度,当前 GitHub Stars 为 60。
#视频分析#转录#光学字符识别#帧提取#多模态#命令行工具#Node.js#YouTube下载器
01
功能特性
01从各种视频源提取带有时间戳和说话人信息的转录文本。
02通过场景变化检测提取关键帧,对于静态内容则回退到统一时间采样。
03对视频帧进行光学字符识别(OCR),以捕获屏幕上的文本,如代码、错误消息和UI元素。
04生成一个合并转录文本、帧和OCR的注释时间线,提供统一的按时间顺序视图。
05支持多种视频源,包括Loom、YouTube、Vimeo、TikTok、Instagram、X/Twitter、Twitch、Dailymotion、Facebook、直接视频URL和本地文件。
02
为什么选择它
+从各种视频源提取带有时间戳和说话人信息的转录文本。
+分析视频错误报告(例如Loom录制),以提取错误消息和UI上下文。
+覆盖 4 个兼容环境或平台,更适合需要跨端部署的团队。
+提供公开仓库并标注 MIT 许可证,便于评估可维护性与采用成本。
03
权衡点
!同分类下还有 8 个相关工具可比较,最终选择更适合在同类对比后决定。
04
兼容性
Node.js 18+
运行时
已通过文档验证
Python
依赖(yt-dlp)
已通过文档验证
Chrome/Chromium
备用(帧提取)
已通过文档验证
MCP Clients
集成
已通过文档验证
05
快速开始
1
$ pip install yt-dlp
2
$ npx mcp-video-analyzer@latest
06
使用场景
↳分析视频错误报告(例如Loom录制),以提取错误消息和UI上下文。
↳批量处理本地视频文件夹,以获取转录文本和视觉摘要。
↳深入分析特定视频片段,以了解在特定时刻发生的事情。
↳从平台视频快速获取摘要或转录文本,无需完整下载。
↳与AI助手(例如Claude)集成,以实现自然语言视频分析功能。
07
同类对比
≈mcp-video-analyzer 属于 Vision / Multimodal 分类,适合与 ragflow 等同类工具一起比较,而不是单独判断。
≈如果你的核心需求更接近“分析视频错误报告(例如Loom录制),以提取错误消息和UI上下文。”,那么这类场景会比泛用型工具对比更有参考价值。
≈mcp-video-analyzer 采用 MIT 许可证,社区热度都应该与同类项目一起看。
08
同类工具
相关搜索
评论
登录后发表评论
暂无评论,来发表第一条吧