>_ DevTrendsnl

Taal

Home

Talen

Secties

Frontend Backend Mobiel DevOps AI / ML GameDev Blockchain Embedded Beveiliging
Unknown

Oneindig canvas voor neurale netwerken — hoe AI CanvasPro werken met AI omzet in visuele creativiteit

Stel je voor dat je aan een complex project werkt: je moet een personage genereren, een script voor ze schrijven, de dialogen inspreken en alles omzetten in een kort video. Meestal verandert dit in een nachtmerrie van browsertabs: ChatGPT hier, Midjourney daar, ElevenLabs in een derde venster en bewerken in een vierde app. Een Chinese ontwikkelaar onder de nickname ashuoAI vond dat het nu genoeg was en bouwde AI CanvasPro.

Dit is een Electron-desktopapplicatie die het generatieve proces omzet in werken met nodes op een oneindig canvas. Als je ooit Blender (Geometry Nodes) of DaVinci Resolve (Fusion) hebt geopend, begrijp je de logica direct.

https://raw. githubusercontent. com/ashuoAI/AI-CanvasPro/master/images/favicon. svg

Wat is het eigenlijk

AI CanvasPro is een visuele editor, waar nodes worden gebruikt in plaats van lagen of chats. Je plaatst een node voor tekst, verbindt deze met een beeldgeneratie-node en stuurt het resultaat naar een video- of upscaler-node. Het project probeert neurale netwerken niet zelf te vervangen—het werkt als een "lijm" voor verschillende API's en lokale tools.

Het mooiste is dat het project niet alleen cloud-API's zoals OpenAI of Gemini ondersteunt, maar ook diep integreert met ComfyUI. Dit betekent dat je je lokale workflows rechtstreeks op het canvas kunt plaatsen en combineren met cloudmodellen.

Hoe het in de praktijk werkt

De belangrijkste functie hier is dataconnectiviteit. In een gewone chatbot is de context beperkt tot één dialoog. In AI CanvasPro kun je het symbool @ rechtstreeks in het promptinvoerveld gebruiken om de uitvoer van elke andere node op het canvas te refereren. Neem bijvoorbeeld een karakterbeschrijving uit een tekstblok en geef deze door aan een beeldgenerator.

Belangrijkste node-typen

Je kunt een dozijn verschillende node-typen op het canvas plaatsen. Hier zijn degenen die het meest nuttig leken:

  • Materiaalbron. Je kunt eenvoudig een bestand van schijf hiernaartoe slepen—een afbeelding, geluid of video.
  • Generatoren. Afzonderlijke blokken voor tekst (GPT-4, Gemini), beelden (via RunningHub of APImart) en video.
  • Browser-node. Hiermee kun je inhoud rechtstreeks van het web halen en direct voor verwerking verzenden.
  • Bewerkingshulpmiddelen. Ingebouwde mini-editors voor videotrimming, achtergrondverwijdering uit foto's en zelfs werken met 360-graden panorama's.

Audio-werk is interessant uitgevoerd. Er is een aparte "audiostudio" waar je een stem kunt klonen of zang en achtergrondmuziek kunt scheiden. Dit alles gebeurt binnen één project, zonder eindeloze export- en importprocessen.

Technische kant en installatie

De app is gebouwd op Electron, dus het is cross-platform. Er zijn builds voor Windows en macOS (inclusief Apple Silicon).

Een belangrijke noot over "openheid": de auteur heeft het project op GitHub geplaatst, maar het is niet Open Source in de klassieke zin. De licentie verbiedt commercieel gebruik zonder toestemming en doorverkoop van de app als SaaS. Er zijn geen beperkingen voor persoonlijk gebruik en experimenteren.

Om te beginnen moet je:

  1. Download .exe of .dmg uit het Releases-gedeelte.
  2. Ga naar instellingen (profielpictogram linksonder).
  3. Voer je API-sleutels in. Zowel specifieke Chinese providers (RunningHub, Volcano Engine) als het standaard OpenAI API-formaat worden ondersteund.

Waar is dit voor

Ik zie twee hoofdgebruiksscenario's. De eerste is contentcreatie voor sociale media of YouTube. Wanneer je snel een idee door de keten "tekst -> beeld -> voice-over -> video" moet laten lopen, bespaart een visueel canvas veel tijd.

Het tweede gebruiksscenario is het prototypen van complexe pipelines. Als je ontwikkelaar bent en snel wilt testen hoe een combinatie van verschillende modellen zal werken, is nodes op een canvas gooien veel sneller dan een Python-script schrijven.

AI CanvasPro is een solide tool voor wie genoeg heeft van chatbot-interfaces. Het project heeft zijn ruwe randjes—bijvoorbeeld, een deel van de interface en documentatie is in het Chinees (hoewel de hoofdfuncties intuïtief te begrijpen zijn), en de licentie is vrij strikt. Maar het concept van een "AI-besturingssysteem" op een canvas is heel goed uitgevoerd.

Als je actief ComfyUI gebruikt of vaak met meerdere neurale netwerken tegelijk werkt, is het zeker de moeite waard om te proberen. Ten minste is het een geweldige manier om je generaties te organiseren.

Je kunt het project bekijken en de nieuwste versie downloaden in de ashuoAI/AI-CanvasPro repository.

Gerelateerde projecten