PDF 处理
io.github.MervinPraison/PraisonAI/pdf-processing
处理 PDF 文档并提取信息。当用户要求读取、分析或从 PDF 文件中提取数据时使用此技能。
“Video Processing” 共 106 个结果
io.github.MervinPraison/PraisonAI/pdf-processing
处理 PDF 文档并提取信息。当用户要求读取、分析或从 PDF 文件中提取数据时使用此技能。
io.github.davila7/claude-code-templates/pdf-processing-pro
可用于生产的 PDF 处理方案,支持表单、表格、OCR、校验与批量操作。适用于在生产环境中处理复杂的 PDF 工作流、大批量处理 PDF,或需要健壮错误处理与校验的场景。
io.github.NVIDIA-AI-Blueprints/video-search-and-summarization/vss-deploy-detection-tracking-3d
以 MV3DT 模式(`MODE=mv3dt`)部署和运维 RTVI-CV-3D 微服务:逐相机 DeepStream 感知,加上基于标定相机的 BEV 融合。支持内置示例数据集、自定义视频文件与 RTSP 流,并在缺少标定时链式调用 `vss-generate-video-calibration`。完整仓库蓝图请用 `vss-deploy-profile`,单相机 2D 检测请用 `vss-deploy-detection-tracking-2d`
io.github.nexu-io/html-video/vfx-text-cursor
光标拖尾光迹、色散光线与方向耀光,用于视频片头的逐词文字揭示效果。
io.github.NVIDIA-AI-Blueprints/video-search-and-summarization/deploy
使用以 compose 为中心的工作流部署、调试或拆除任意 VSS profile——带 env 覆盖的 config(dry-run)、审阅解析后的 compose,然后 compose up。当用户说“deploy vss”“deploy `profile`”“debug deploy”“verify deployment”或“why is my vss deploy broken”时使用本技能
io.github.videojs/v10/refactor-behavior
以目标优先(purpose-first)的纪律重构既有的 SPF 行为。强制先阐明该行为的目的与业务规则,再分析代码,然后映射到 internal/design/spf/conventions/ 中的成文模式。触发语:refactor behavior、refactor this behavior、clean up behavior、apply conventions to behavior、review behavior for refactor。
io.github.videojs/v10/css-to-tailwind
将原生 CSS、CSS Modules、SCSS 或 styled-component 样式迁移到 Tailwind v4 工具类。优先使用由 @theme 承载的设计令牌和语义化工具类;记录任意值与还原度差距。做审查时加载 review/workflow.md。触发语:CSS to Tailwind、migrate to Tailwind、tailwind migration、styled-components to Tailwind、SCSS to Tailwind、review Tailwind classes、tailwind parity。
io.github.divinevideo/divine-mobile/docker-buildx-stale-rust-binary
修复使用 docker buildx 时部署的 Rust 二进制未反映代码变更的问题。 适用场景:(1) 本地改动已验证(测试通过)但部署后生产行为没有变化;(2) Docker 镜像有新 tag 但仍包含旧的编译二进制;(3) Dockerfile 采用依赖预编译层加源码拷贝层的多阶段构建。 Docker buildx 的层缓存可能提供陈旧的编译产物,即使源文件已变更,交叉编译(--platform linux/amd64)时尤其如此。
io.github.android/skills/leanback-to-compose-tv-migration
为 Android TV 应用提供从旧版 Leanback UI Toolkit、Android Views 或 Support Fragments 迁移到 Jetpack Compose for TV(androidx.tv)的指令与架构模式。用于 Leanback 到 Compose 的迁移,包括浏览页、设置页、认证页、登录页或视频播放页的迁移;或将 BrowseSupportFragment、LeanbackSettingsFragment、PreferenceFragment、BaseLeanbackPreferenceFragmentCompat、VideoSupportFragment、GuidedStepSupportFragment、SearchSupportFragment、VerticalGridSupportFragment、Presenter、ArrayObjectAdapter、CursorMapper 替换为现代 Compose 等价物;或实现带焦点记忆的沉浸式轮播、基于 PlayerSurface 的 Media3 视频播放、自定义 10 英尺客厅布局。
io.github.anthropics/knowledge-work-plugins/build-zoom-meeting-app
构建或嵌入 Zoom 会议流程。用于实现 Meeting SDK 加入、Web 或移动端会议嵌入、会议生命周期流程,或在 Meeting SDK 与 Video SDK 之间做选型时。
io.github.benchflow-ai/skillsbench/pdf
处理 PDF 文件时务必使用此技能而非 Read 工具。Read 工具无法正确提取 PDF 中的表格。适用场景:(1) 读取任意 PDF 文件;(2) 从 PDF 提取表格;(3) 将 PDF 表格转换为 pandas DataFrame;(4) 处理多页 PDF。
io.github.heygen-com/hyperframes/embedded-captions
Add captions or subtitles to an existing single-subject talking-head video without editing the footage. Use for plain verbatim captions, cinematic captions embedded behind the subject, VFX captions, “炸/特效/酷炫字幕,” or a named identity from the 35-style catalog. Route by visual identity, not by backend engine. The quiet `anchor` rail is the default; embed every word only when the user explicitly wants a fully cinematic treatment. The workflow runs locally end to end, including transcription and subject matting; split multi-shot footage before applying it.
io.github.heygen-com/hyperframes/hyperframes-keyframes
当 HyperFrames 合成需要推近、拉出、缩放、改构图、Ken Burns 效果、运镜、视觉匹配/甩镜交接,或其他 seek-safe 的 2D/3D 关键帧时使用;也用于 GSAP、CSS keyframes、Anime.js、WAAPI、FLIP、路径、遮罩、SVG morph/draw、文字拖尾、3D 纵深,或 `hyperframes keyframes` 诊断。不要用于宽泛的场景策略、品牌设计、素材获取、字幕或一般视频规划。
io.github.heygen-com/hyperframes/motion-graphics
以运动本身传递信息的短设计型 motion graphic——动态字体、数字滚动、图表/数据可视化呈现、logo 片头/品牌定格、下三分之一字幕条/浮层/社媒 overlay、动画地图(区域高亮、地点连线、缩放到某地)、推文/新闻文章/标题动画、网页/UI 动画(滚动、光标、callout),或将真实图片的几何结构融入图表。通常 10 秒以内(最长约 30 秒),无旁白与真人实拍;渲染为 MP4 或透明 overlay。更长的/有旁白的/多场景的用 /general-video;不明确的用 /hyperframes。
io.github.pytorch/pytorch/triaging-issues
对 GitHub issue 进行分诊:路由到值班团队、打标签并关闭咨询类问题。在处理新的 PyTorch issue 或被要求分诊 issue 时使用。
io.github.affaan-m/ECC/fal-ai-media
通过 fal.ai MCP 统一生成媒体——图像、视频和音频。覆盖文生图(Nano Banana)、文/图生视频(Seedance、Kling、Veo 3)、文生语音(CSM-1B)以及视频生音频(ThinkSound)。当用户想用 AI 生成图像、视频或音频时使用。
io.github.Panniantong/Agent-Reach/skill
当用户想要调研/research/搜索/search/查/找/look up 互联网上的任何内容时务必使用——例如“全网调研 X”“帮我调研一下 X”“查一下 X”“搜搜 X”“看看大家怎么评价 X”“X 上有什么讨论”“research this topic”。当用户提到任何平台或分享任何 URL/链接时也务必使用:小红书/xiaohongshu/xhs、Twitter/推特/X、B站/bilibili、Reddit、Facebook、Instagram、V2EX、LinkedIn/领英/招聘/求职/jobs、YouTube、GitHub code search、小宇宙播客、雪球/股票行情、RSS feeds 或任意网页 URL。覆盖 15 个平台、多后端路由(OpenCLI / 各平台 CLI / API),6 个渠道零配置。运行 `agent-reach doctor --json` 查看当前各平台的后端。不适用于:写报告/数据分析/翻译等内容加工(本 skill 只负责从互联网获取内容)、发帖/评论/点赞等写操作、已有专门 skill 的平台(应先用专门 skill)。【路由方式】SKILL.md 包含路由表和常用命令,复杂场景需按需阅读对应分类的 references/*.md。分类:search / social(小红书/推特/B站/V2EX/Reddit/Facebook/Instagram)/ career(LinkedIn) / dev(github) / web(网页/文章/RSS) / video(YouTube/B站/播客) / finance(雪球/股票)。
io.github.heygen-com/hyperframes/motion-doctrine
网关技能——编排任何 HyperFrames 动画或视频之前必须最先加载。让多场景视频像一次连续运镜、而非一堆各自独立的动画幻灯片拼接的高层运动法则。涵盖向量法则(如何出场决定如何入场,含 Z 轴缩放符号法则)、影片的当下(film's current)、承载元素、因果运动、Seam Gate(构建门禁执行)、禁止空闲摆动(运动必须表演而非呼吸)、先静止后高潮,以及持续运动路线。路由到低层技巧技能(cut-the-curve——完整目录含瀑布式入场与 nudge 曲线、oversized-cursor、seam-craft)。这些规则取代通用的上游运动指南。[continuity, direction, vector, momentum, seam, transition, ease, performance, idle-motion, narrative-motion, film-grammar]
io.github.K-Dense-AI/scientific-agent-skills/geomaster
Comprehensive geospatial science skill covering remote sensing, GIS, spatial analysis, machine learning for earth observation, and 30+ scientific domains. Supports satellite imagery processing (Sentinel, Landsat, MODIS, SAR, hyperspectral), vector and raster data operations, spatial statistics, point cloud processing, network analysis, cloud-native workflows (STAC, COG, Planetary Computer), and 8 programming languages (Python, R, Julia, JavaScript, C++, Java, Go, Rust) with 500+ code examples. Use for remote sensing workflows, GIS analysis, spatial ML, Earth observation data processing, terrain analysis, hydrological modeling, marine spatial analysis, atmospheric science, and any geospatial computation task.
io.github.affaan-m/ECC/fal-ai-media
通过 fal.ai MCP 统一生成媒体——图像、视频和音频。覆盖文生图(Nano Banana)、文/图生视频(Seedance、Kling、Veo 3)、文生语音(CSM-1B)以及视频生音频(ThinkSound)。当用户想用 AI 生成图像、视频或音频时使用。
io.github.K-Dense-AI/scientific-agent-skills/gtars
在 Python、Rust 与 CLI 中使用 Gtars 完成本地基因组区间模型与集合代数、重叠与计数、consensus 与覆盖度、tokenization、片段处理,以及 refget/BEDbase 规划。
io.github.K-Dense-AI/scientific-agent-skills/polars
面向 Python ETL、分析与 pandas 迁移的高性能 DataFrame 库。适用于基于表达式的数据操作,支持惰性查询优化、并行执行、流式跨核处理、Arrow 互操作与可选的 GPU 执行。
io.github.K-Dense-AI/scientific-agent-skills/optimize-for-gpu
将科学 Python 工作负载加速到 NVIDIA GPU 上,并验证结果正确且更快。适用于 CUDA/GPU 优化;CPU 受限的 NumPy、SciPy、pandas、scikit-learn、NetworkX、scikit-image、向量检索、图像处理、图、仿真或文件 I/O 负载;CuPy、cuDF、cuML、cuGraph、cuVS、cuCIM、KvikIO、Warp、Newton、Numba-CUDA、RAFT 相关问题;以及性能剖析、内存搬运、kernel 或多 GPU 瓶颈。当大规模数据并行的 Python 代码很慢且 GPU 加速是合理选项时也应使用,即使用户没有提到 CUDA。
io.github.K-Dense-AI/scientific-agent-skills/datamol
RDKit 的 Pythonic 封装,接口更简单、默认值更合理。标准药物发现任务的首选:SMILES 解析、标准化、描述符、指纹、聚类、3D 构象、并行处理。返回原生 rdkit.Chem.Mol 对象。需要高级控制或自定义参数时直接使用 rdkit。