Media & Creative
Generation et manipulation de contenu visuel : video, audio, images, illustration.
| # | Skill | Source | Description | Maj | |
|---|---|---|---|---|---|
| 1 | speech-to-text | elevenlabs/skills | Transcrire de l'audio en texte avec détection de locuteurs et horodatage précis. | 415 | 9h |
| 2 | remotion-multimedia | remotion-dev/skills | Manipuler audio et vidéo dans le navigateur avec la bibliothèque Mediabunny. | 4 271 | 18h |
| 3 | remotion-maps | remotion-dev/skills | Créer des animations cartographiques vidéo avec différentes techniques de rendu géospatial. | 4 271 | 18h |
| 4 | remotion-best-practices | remotion-dev/skills | Orchestrer des projets vidéo Remotion via des skills spécialisés modulaires. | 4 271 | 18h |
| 5 | remotion-captions | remotion-dev/skills | Gérer, afficher et importer des sous-titres vidéo au format JSON. | 4 271 | 18h |
| 6 | remotion-create | remotion-dev/skills | Créer et configurer un nouveau projet vidéo Remotion avec composition React. | 4 271 | 18h |
| 7 | remotion-interactivity | remotion-dev/skills | Ajouter de l'interactivité à des composants vidéo avec Remotion Studio. | 4 271 | 18h |
| 8 | remotion-markup | remotion-dev/skills | Créer des animations React pour Remotion avec interpolation, séquences et assets multimédias. | 4 271 | 18h |
| 9 | remotion-render | remotion-dev/skills | Rendre des vidéos ou images fixes avec Remotion via ligne de commande. | 4 271 | 18h |
| 10 | remotion-saas | remotion-dev/skills | Intégrer Remotion dans une app React, Vue, Angular ou Svelte pour rendre des vidéos. | 4 271 | 18h |
| 11 | remotion-studio | remotion-dev/skills | Lancer le studio Remotion et récupérer son URL d'accès local. | 4 271 | 18h |
| 12 | remotion-docs | remotion-dev/skills | Rechercher et lire la documentation Remotion à jour via Algolia et Markdown. | 4 271 | 18h |
| 13 | art-direct | divinevideo/divine-mobile | Transformer n'importe quel contenu en direction artistique visuelle concrète et exécutable. | 262 | 4j |
| 14 | divine-relay-video-requirements | divinevideo/divine-mobile | Diagnostiquer et corriger les rejets d'événements vidéo sur les relays Nostr divine. | 262 | 4j |
| 15 | vine-oembed-metadata-recovery | divinevideo/divine-mobile | Récupérer les métadonnées de vidéos Vine archivées via l'endpoint oEmbed encore actif. | 262 | 4j |
| 16 | dubbing | elevenlabs/skills | Doubler audio ou vidéo dans d'autres langues en préservant les voix originales. | 415 | 5j |
| 17 | pr-walkthrough | tldraw/tldraw | Générer une vidéo narrée de présentation d'une pull request GitHub avec sous-titres et diapositives. | 49 728 | 6j |
| 18 | voice-changer | elevenlabs/skills | Transformer la voix d'un enregistrement audio en préservant émotion et intonation. | 415 | 7j |
| 19 | text-to-speech | elevenlabs/skills | Convertir du texte en parole naturelle multilingue via l'API ElevenLabs. | 415 | 7j |
| 20 | figma-generate-library | figma/mcp-server-guide | Construire des systèmes de design Figma professionnels en orchestrant des workflows multi-phases structurés. | 1 879 | 12j |
| 21 | omniverse-usd-performance-tuning | nvidia/skills | Optimiser les performances d'une scène USD dans NVIDIA Omniverse de bout en bout. | 2 859 | 13j |
| 22 | music | elevenlabs/skills | Générer de la musique originale à partir de texte, vidéos ou plans de composition détaillés. | 415 | 19j |
| 23 | compose | factory-ai/factory-plugins | Assembler et rendre des vidéos polish à partir de clips bruts via Remotion. | 101 | 19j |
| 24 | i4h-catheter-navigation-render-drr | nvidia/skills | Générer une radiographie numérique reconstruite (DRR) depuis un CT ou fantôme synthétique. | 2 859 | 21j |
| 25 | i4h-catheter-navigation-viewport | nvidia/skills | Lancer un viewport interactif de navigation cathéter avec physique temps réel et fluoroscopie. | 2 859 | 21j |
| 26 | vss-generate-video-calibration | nvidia/skills | Calibrer automatiquement des caméras via fichiers locaux, flux RTSP ou données d'exemple. | 2 859 | 27j |
| 27 | vss-generate-video-report | nvidia/skills | Générer un rapport d'analyse vidéo via clip ou incidents selon le contexte. | 2 859 | 27j |
| 28 | vss-summarize-video | nvidia/skills | Produire un résumé narratif horodaté d'un clip vidéo via API VLM ou microservice LVS. | 2 859 | 27j |
| 29 | vss-generate-video-calibration | nvidia-ai-blueprints/video-search-and-summarization | Calibrer automatiquement des caméras via fichiers vidéo, flux RTSP ou données d'exemple. | 1 792 | 27j |
| 30 | vss-summarize-video | nvidia-ai-blueprints/video-search-and-summarization | Générer un résumé narratif horodaté d'un clip vidéo via API de summarization. | 1 792 | 27j |
| 31 | vss-generate-video-report | nvidia-ai-blueprints/video-search-and-summarization | Générer des rapports d'analyse vidéo ou d'incidents via deux backends VSS distincts. | 1 792 | 27j |
| 32 | image-annotations | github/awesome-copilot | Annoter visuellement des images avec callouts, flèches et étiquettes via PIL. | 37 704 | 1mo |
| 33 | video-interaction-mapper | figma/mcp-server-guide | Convertir un enregistrement vidéo UI en storyboard Figma annoté automatiquement. | 1 879 | 1mo |
| 34 | drawio-skill | agents365-ai/drawio-skill | Générer et exporter des diagrammes draw.io précis en PNG, SVG, PDF ou JPG. | 7 472 | 1mo |
| 35 | deepstream-generate-pipeline | nvidia/skills | Générer des pipelines GStreamer prêts à l'emploi pour NVIDIA DeepStream via questionnaire interactif. | 2 859 | 1mo |
| 36 | speech-engine | elevenlabs/skills | Intégrer une interface vocale temps réel à un agent LLM via WebSocket ElevenLabs. | 415 | 1mo |
| 37 | gemini-omni-flash-api | google-gemini/gemini-skills | Générer et éditer des vidéos à partir de texte ou d'images via Gemini Flash. | 3 896 | 1mo |
| 38 | vss-manage-video-io-storage | nvidia/skills | Gérer caméras, flux RTSP, snapshots et stockage vidéo via l'API VIOS. | 2 859 | 2mo |
| 39 | omniverse-realtime-viewer | nvidia/skills | Construire des viewers 3D USD temps réel avec rendu, streaming et interaction. | 2 859 | 2mo |
| 40 | rhino3d-scripts | github/awesome-copilot | Scripter pour Rhinoceros 3D en Python, VBScript ou C# via RhinoCommon. | 37 704 | 2mo |
| 41 | adobe-illustrator-scripting | github/awesome-copilot | Automatiser Adobe Illustrator via ExtendScript pour manipuler, exporter et générer des fichiers vectoriels. | 37 704 | 2mo |
| 42 | screen-recording | github/awesome-copilot | Créer des GIFs animés de démos UI avec annotations et timing variable. | 37 704 | 2mo |
| 43 | figma-generate-diagram | figma/mcp-server-guide | Générer des diagrammes FigJam en syntaxe Mermaid.js selon le type adapté. | 1 879 | 2mo |
| 44 | generate-image | github/awesome-copilot | Générer et sauvegarder des images via OpenAI ou Google Gemini. | 37 704 | 2mo |
| 45 | hatch-pet | openai/skills | Créer un pet animé compatible Codex depuis un concept ou des images de référence. | 24 823 | 3mo |
| 46 | remotion | google-labs-code/stitch-skills | Créer des vidéos de présentation d'applications en combinant Stitch et Remotion. | 8 021 | 3mo |
| 47 | gpt-image | wuyoscar/gpt-image2-skill | Générer, éditer et inpeindre des images via GPT-Image-2 en CLI. | 4 398 | 3mo |
| 48 | visual-content | mkurman/zorai | Planifier, formater et réutiliser des visuels sur tous les canaux digitaux. | 321 | 3mo |
| 49 | ray-so-code-snippet | mkurman/zorai | Générer des images élégantes de code via ray.so pour le partage. | 321 | 3mo |
| 50 | infographics | mkurman/zorai | Générer des infographies visuelles précises avec collecte automatique de données intégrée. | 321 | 3mo |
À propos de cette sélection
Quand un agent doit produire une vidéo explicative, retailler une série d'images pour une campagne ou synthétiser une voix off en plusieurs langues, les skills génériques atteignent vite leurs limites. Cette section regroupe ce qui couvre réellement ces besoins : piloter Runway pour la génération vidéo, appeler ElevenLabs pour cloner une voix ou en produire une à partir d'un script, générer des visuels programmatiquement, manipuler du canvas ou appliquer des brand guidelines dans un workflow automatisé.
Les skills media & creative ici s'adressent aux devs qui intègrent du contenu généré dans un produit. L'outillage reste hétérogène, mais un socle solide couvre déjà la majorité des cas d'usage courants, du GIF Slack automatique au diagramme généré à la volée.