Canevas infini pour réseaux de neurones — comment AI CanvasPro transforme le travail avec l'IA en créativité visuelle
Imaginez que vous travaillez sur un projet complexe : vous devez générer un personnage, écrire un script pour lui, enregistrer les répliques et tout transformer en courte vidéo. Habituellement, cela se transforme en cauchemar d'onglets de navigateur : ChatGPT ici, Midjourney là-bas, ElevenLabs dans une troisième fenêtre, et montage dans une quatrième application. Un développeur chinois sous le pseudonyme ashuoAI a décidé que ça suffit et a créé AI CanvasPro.
Il s'agit d'une application desktop Electron qui transforme le processus génératif en travail avec des nœuds sur un canevas infini. Si vous avez déjà ouvert Blender (Geometry Nodes) ou DaVinci Resolve (Fusion), vous comprendrez immédiatement la logique.
https://raw.githubusercontent. com/ashuoAI/AI-CanvasPro/master/images/favicon.svg
Qu'est-ce que c'est exactement
AI CanvasPro est un éditeur visuel où des nœuds sont utilisés à la place des calques ou des conversations. Vous placez un nœud pour le texte, le connectez à un nœud de génération d'images, et envoyez le résultat vers un nœud vidéo ou d'upscaling. Le projet ne cherche pas à remplacer lui-même les réseaux de neurones — il sert de « colle » entre différentes API et outils locaux.
Le plus intéressant est que le projet supporte non seulement les API cloud comme OpenAI ou Gemini, mais s'intègre aussi profondément avec ComfyUI. Cela signifie que vous pouvez importer vos workflows locaux directement sur le canevas et les combiner avec des modèles cloud.
Comment ça marche en pratique
La fonctionnalité principale ici est la connectivité des données. Dans un chatbot classique, le contexte est limité à une seule conversation. Dans AI CanvasPro, vous pouvez utiliser le symbole @ directement dans le champ de saisie du prompt pour référencer la sortie de n'importe quel autre nœud du canevas. Par exemple, prenez une description de personnage depuis un bloc de texte et transmettez-la à un générateur d'images.
Types de nœuds principaux
Vous pouvez placer une douzaine de types de nœuds différents sur le canevas. Voici ceux qui m'ont semblé les plus utiles :
- Source de matériau. Vous pouvez simplement y glisser-déposer un fichier du disque — une image, un son ou une vidéo.
- Générateurs. Des blocs séparés pour le texte (GPT-4, Gemini), les images (via RunningHub ou APImart), et la vidéo.
- Nœud navigateur. Permet d'extraire du contenu directement du web et de l'envoyer directement pour traitement.
- Outils d'édition. Des mini-éditeurs intégrés pour le découpage vidéo, la suppression d'arrière-plan des photos, et même le travail avec des panoramas à 360 degrés.
Le travail audio est implémenté de manière intéressante. Il y a un « studio audio » séparé où vous pouvez cloner une voix ou séparer les voix et la musique de fond. Tout cela se fait dans un seul projet, sans exports et imports interminables.
Aspect technique et installation
L'application est construite sur Electron, elle est donc multiplateforme. Il existe des versions pour Windows et macOS (y compris Apple Silicon).
Une note importante sur l'« ouverture » : l'auteur a publié le projet sur GitHub, mais ce n'est pas de l'Open Source au sens classique. La licence interdit l'utilisation commerciale sans permission et la revente de l'application en tant que SaaS. Il n'y a pas de restrictions pour un usage personnel et les expérimentations.
Pour commencer, vous devez :
- Télécharger
.exeou.dmgdepuis la section Releases. - Aller dans les paramètres (icône profil en bas à gauche).
- Entrer vos clés API. Les fournisseurs chinois spécifiques (RunningHub, Volcano Engine) et le format standard de l'API OpenAI sont tous deux supportés.
À qui c'est destiné
Je vois deux cas d'utilisation principaux. Le premier est la création de contenu pour les réseaux sociaux ou YouTube. Quand vous devez exécuter rapidement une idée à travers la chaîne « texte -> image -> voix -> vidéo », un canevas visuel fait gagner beaucoup de temps.
Le deuxième cas d'utilisation est le prototypage de pipelines complexes. Si vous êtes développeur et voulez tester rapidement comment une combinaison de plusieurs modèles va fonctionner, disposer des nœuds sur un canevas est beaucoup plus rapide que d'écrire un script Python.
AI CanvasPro est un outil solide pour ceux qui sont fatigués des interfaces de chatbot. Le projet a ses imperfections — par exemple, une partie de l'interface et de la documentation est en chinois (bien que les fonctions principales soient intuitivement compréhensibles), et la licence est assez stricte. Mais le concept de « système d'exploitation IA » sur un canevas est très bien implémenté.
Si vous utilisez activement ComfyUI ou travaillez souvent avec plusieurs réseaux de neurones simultanément, ça vaut définitivement le coup d'essayer. Au minimum, c'est un excellent moyen d'organiser vos générations.
Vous pouvez consulter le projet et télécharger la dernière version dans le dépôt ashuoAI/AI-CanvasPro.
Projets similaires