>_ DevTrendsfr

Langue

Accueil

Langages

Sections

Frontend Backend Mobile DevOps AI / ML GameDev Blockchain Embarqué Sécurité
TypeScript

Comment exécuter 60 réseaux neuronaux dans un seul onglet et pourquoi les hackers en ont besoin

Récemment, je suis tombé sur le dépôt G0DM0D3 d'un développeur connu sous le nom de Pliny the Prompter. Si vous suivez les jailbreaks et le "red teaming" des réseaux neuronaux, ce nom vous dit probablement quelque chose. Le projet ressemble à un retour aux salons de chat de pirates des années quatre-vingt-dix : art ASCII dans la console, slogans audacieux sur la "liberté cognitive", et aucune inscription requise.

Fondamentalement, c'est une interface avancée pour travailler avec des dizaines de LLMs simultanément. Mais contrairement aux chatbots typiques, l'accent est mis ici sur l'exploration des limites de ce qui est autorisé et les tests de robustesse des modèles.

Ce qui se cache sous le capot de cet outil tout-en-un

La principale caractéristique du projet est sa capacité à fonctionner avec des agrégateurs et des moteurs locaux. Vous n'avez pas besoin de vous lier à un seul fournisseur. G0DM0D3 peut appeler l'API OpenRouter (qui donne accès à plus de 60 modèles), Venice, et surtout, se connecter à vos instances locales via Ollama, LM Studio ou vLLM.

L'ensemble de l'interface est regroupé dans un seul fichier index.html. Pas de frameworks lourds, pas de builds npm, pas de dépendances infinies. Vous clonez simplement le dépôt et ouvrez le fichier dans votre navigateur.

Après cela, il vous suffit de fournir une clé API ou l'adresse de votre serveur local dans les paramètres, et vous êtes prêt à commencer à expérimenter.

Des modes pour ceux qui aiment les choses corsées

Le développeur a ajouté plusieurs outils spécialisés à l'interface que l'on voit rarement dans les "wrappers" ChatGPT typiques.

Courses parallèles dans Godmode Classic

Dans ce mode, le système exécute cinq combinaisons modèle + prompt différentes simultanément. Chaque combinaison utilise ses propres méthodes pour contourner les restrictions — de l'inversion des limites sémantiques au formatage de style l33t. Vous écrivez une seule requête, et vous obtenez cinq réponses de Claude, Grok, Gemini et GPT-4. Le gagnant est la variante qui a donné la réponse la plus complète et la moins filtrée.

Évaluation à grande échelle dans Ultraplinian

Si cinq modèles ne suffisent pas, il y a le mode Ultraplinian. Il vous permet d'interroger jusqu'à 60 modèles en parallèle (selon le niveau sélectionné). Le système évalue automatiquement les réponses sur une échelle de 100 points et affiche le meilleur résultat. C'est pratique quand vous avez besoin de déterminer rapidement quelle architecture gère mieux une tâche de niche spécifique.

Torture linguistique avec Parseltongue

C'est probablement la partie la plus intéressante pour les chercheurs en sécurité. Parseltongue est un moteur de modification du texte d'entrée. Il peut appliquer 33 techniques d'obfuscation : du remplacement de caractères par des caractères Unicode similaires à l'encodage en code Morse ou aux transformations phonétiques. Cela sert à tester à quel moment un modèle cesse de comprendre le contexte ou, au contraire, quand les filtres de sécurité sont contournés en raison d'orthographes inhabituelles.

Confidentialité et données

L'auteur du projet a adopté une position honnête. Au lieu de slogans marketing sur l'"anonymat complet", le README indique clairement où et quoi est envoyé.

L'historique des discussions est stocké uniquement dans votre navigateur (localStorage). Vous avez vidé le cache — vous avez perdu votre conversation. Il n'y a pas de synchronisation cloud, et c'est un choix délibéré. La télémétrie est activée par défaut, mais elle ne collecte que des métadonnées (quel modèle a été utilisé, combien de temps la réponse a pris, longueur du texte). Vos invites et réponses réelles ne sont pas incluses dans la télémétrie sauf si vous activez un mode de participation spécial au jeu de données.

Si la paranoïa prend le dessus, vous pouvez activer le mode Local uniquement. Dans ce mode, l'interface coupe complètement les API externes et fonctionne uniquement avec votre serveur Ollama local.

À qui cela sera utile

Le projet est de niche. Il est peu probable qu'il convienne à la rédaction quotidienne de lettres ou à la planification de vacances. Mais il sera certainement utile dans plusieurs scénarios :

  1. Red Teaming et audits de sécurité. Si vous testez votre modèle ou votre application pour sa résistance aux injections.
  2. Comparaison de modèles. Quand vous avez besoin d'exécuter rapidement la même requête complexe à travers une douzaine d'architectures différentes et de choisir votre préférée.
  3. Travail local. Si vous avez un matériel puissant et voulez une interface pratique pour vos modèles sans envoyer de données vers le cloud.

G0DM0D3 gagne des points grâce à son déploiement simple et l'absence d'intermédiaires inutiles. C'est un outil pour ceux qui veulent contrôler le processus d'interaction avec l'IA jusqu'aux moindres paramètres, y compris la température et les pénalités de répétition, qui sont configurés ici via le système AutoTune.

Vous pouvez essayer le projet soit via le site officiel (vous aurez besoin de vos propres clés) soit en téléchargeant simplement index.html sur votre machine. Juste, n'oubliez pas de sauvegarder votre historique via l'export dans les paramètres si vous prévoyez d'utiliser l'outil pendant longtemps — localStorage n'est pas fiable.

Projets similaires