>_ DevTrendsnl

Taal

Home

Talen

Secties

Frontend Backend Mobiel DevOps AI / ML GameDev Blockchain Embedded Beveiliging
TypeScript

Hoe 60 neurale netwerken in één tabblad uitvoeren en waarom hackers dit nodig hebben

Onlangs kwam ik de G0DM0D3-repository tegen van een ontwikkelaar bekend als Pliny the Prompter. Als je je bezighoudt met jailbreaks en neurale netwerk "red teaming," is deze naam je waarschijnlijk bekend. Het project lijkt een terugblik op chatrooms van de jaren negentig: ASCII-art in de console, vette slogans over "cognitieve vrijheid," en geen registratie vereist.

Dit is in wezen een geavanceerde interface voor het gelijktijdig werken met tientallen LLMs. Maar in tegenstelling tot typische chatbots ligt de focus hier op het verkennen van de grenzen van wat is toegestaan en het testen van modelrobuustheid.

Wat er onder de motorkap van deze all-in-one tool zit

Het belangrijkste kenmerk van het project is de mogelijkheid om met aggregators en lokale engines te werken. Je hoeft je niet te binden aan één provider. G0DM0D3 kan de OpenRouter API aanroepen (die toegang geeft tot 60+ modellen), Venice, en het beste van alles: verbinding maken met je lokale instanties via Ollama, LM Studio of vLLM.

De hele interface is verpakt in één bestand index.html. Geen zware frameworks, geen npm builds, geen eindeloze afhankelijkheden. Je hoeft alleen de repository te klonen en het bestand in je browser te openen.

Daarna hoef je alleen maar een API-sleutel of lokale serveradres in te stellen, en je kunt beginnen met experimenteren.

Modi voor wie het heet wil

De ontwikkelaar heeft verschillende gespecialiseerde tools aan de interface toegevoegd die je zelden ziet in typische ChatGPT "wrappers."

Parallelle races in Godmode Classic

In deze modus voert het systeem vijf verschillende model + prompt combinaties gelijktijdig uit. Elke combinatie gebruikt zijn eigen methoden voor het omzeilen van restricties — van semantische grensomkering tot l33t-achtige opmaak. Je schrijft één query en krijgt vijf antwoorden van Claude, Grok, Gemini en GPT-4. De winnaar is de variant die het meest complete en ongefilterde antwoord gaf.

Grootschalige evaluatie in Ultraplinian

Als vijf modellen niet genoeg zijn, is er de Ultraplinian modus. Hiermee kun je tot 60 modellen parallel bevragen (afhankelijk van het geselecteerde niveau). Het systeem evalueert reacties automatisch op een schaal van 100 punten en geeft het beste resultaat. Dit is handig wanneer je snel wilt uitzoeken welke architectuur een specifieke nichetaak beter afhandelt.

Linguïstische marteling met Parseltongue

Dit is waarschijnlijk het interessantste onderdeel voor beveiligingsonderzoekers. Parseltongue is een engine voor het modificeren van invoertekst. Het kan 33 obfuscatietechnieken toepassen: van het vervangen van tekens door vergelijkbare Unicode-tekens tot het coderen in Morsecode of fonetische transformaties. Dit is nodig om te testen op welk punt een model stopt met het begrijpen van context of, omgekeerd, wanneer veiligheidsfilters worden omzeild door ongebruikelijke spelling van woorden.

Privacy en gegevens

De auteur van het project nam een eerlijke positie in. In plaats van marketingslogans over "volledige anonimiteit," staat in de README duidelijk waar en wat wordt verzonden.

Chatgeschiedenis wordt alleen in je browser opgeslagen (localStorage). Cache gewist — gesprek kwijt. Er is geen cloud sync, en dat is een bewuste keuze. Telemetrie is standaard ingeschakeld, maar verzamelt alleen metadata (welk model werd gebruikt, hoe lang het antwoord duurde, tekstlengte). Je daadwerkelijke prompts en reacties gaan niet naar telemetrie tenzij je een speciale datasetdeelnamemodus inschakelt.

Als de paranoia je overheerst, kun je de Lokale modus inschakelen. In deze modus verbreekt de interface volledig de verbinding met externe API's en werkt alleen met je lokale Ollama-server.

Wie zal dit nuttig vinden

Het project is niche. Het is onwaarschijnlijk dat het geschikt is voor dagelijks brieven schrijven of vakantieplanning. Maar het zal zeker nuttig zijn in verschillende scenario's:

  1. Red Teaming en beveiligingsaudits. Als je je model of applicatie test op weerstand tegen injecties.
  2. Modelvergelijking. Wanneer je snel dezelfde complexe query door een dozijn verschillende architecturen wilt uitvoeren en een favoriet wilt kiezen.
  3. Lokaal werk. Als je krachtige hardware hebt en een handige UI voor je modellen wilt zonder gegevens naar de cloud te sturen.

G0DM0D3 scoort punten met zijn eenvoudige implementatie en gebrek aan onnodige tussenpersonen. Het is een tool voor degenen die het AI-interactieproces tot in de fijnste parameters willen controleren, inclusief temperatuur en herhalingsboetes, die hier worden geconfigureerd via het AutoTune-systeem.

Je kunt het project uitproberen via de officiële website (je hebt je eigen sleutels nodig) of gewoon index.html naar je machine downloaden. Vergeet alleen niet om je geschiedenis te back-uppen via export in de instellingen als je van plan bent de tool lang te gebruiken — localStorage is onbetrouwbaar.

Gerelateerde projecten