O que vision-tool faz?
Image & video analysis for AI coding assistants without native vision. Works with any model - CLI, MCP, or opencode skill. 12 vision backends (Gemini, GPT-4o, Claude, etc.). Zero hardcoded secrets.
Ferramenta de análise de imagem e vídeo para assistentes de codificação AI que não possuem visão nativa. Funciona com qualquer modelo, seja como CLI, MCP ou skill opencode.
O farhanic017/vision-tool é uma habilidade versátil que permite que assistentes de codificação AI (como Claude Code, Cursor, Codex, etc.) realizem análise de imagens e vídeos, mesmo sem suporte nativo a visão. Ele funciona com qualquer modelo e pode ser utilizado via interface de linha de comando (CLI), protocolo MCP (Model Context Protocol) ou como skill do opencode. A ferramenta oferece suporte a 12 backends de visão, incluindo Gemini, GPT-4o, Claude e outros, garantindo ampla compatibilidade. Um dos principais diferenciais é a segurança: nenhum segredo (API keys, tokens) é codificado diretamente no arquivo, utilizando variáveis de ambiente ou métodos seguros de configuração. Isso torna a habilidade ideal para equipes que precisam de análise visual em seus fluxos de desenvolvimento de software sem comprometer a segurança ou a flexibilidade de escolha do modelo AI subjacente.
npx skills add farhanic017/vision-toolImage & video analysis for AI coding assistants without native vision. Works with any model - CLI, MCP, or opencode skill. 12 vision backends (Gemini, GPT-4o, Claude, etc.). Zero hardcoded secrets.
Extract frames or short clips from videos using ffmpeg.
Summarize or transcribe URLs, YouTube/videos, podcasts, articles, transcripts, PDFs, and local files.
Production-ready animation patterns for React / Next.js — button, modal, toast, stagger, page transitions, exit animations, scroll, and layout — built on motion-foundations tokens and springs.
Advanced motion patterns for React / Next.js — drag & drop, gestures, text animations, SVG path drawing, custom hooks, imperative sequences (useAnimate), loaders, and the full API decision tree. Requires motion-foundations.
Production-ready UI motion system for React/Next.js. Use when implementing animations, transitions, or motion patterns.
Generates Angular code and provides architectural guidance. Trigger when creating projects, components, or services, or for best practices on reactivity (signals, linkedSignal, resource), forms, dependency injection, routing, SSR, accessibility (ARIA), animations, styling (component styles, Tailwind CSS), testing, or CLI tooling.