La fiabilité des routes
À chaque étape d’un mandat, plusieurs chemins sont possibles. Notre recherche vise à ce que l’agent prenne le bon, et se rattrape vite quand ce n’est pas le cas.
The Spice Lab est notre groupe de recherche. Il ne bâtit pas des modèles; il bâtit de la fiabilité. Wasabe tourne sur un grand modèle américain de pointe, post-entraîné et affiné à travers Wasabe Spice Forge, notre harnais, jusqu’à ce qu’un seul agent puisse porter un mandat à travers des dizaines de milliers d’interactions.
Donnez une seule question à un modèle brillant et il éblouit. Donnez-lui un vrai mandat (une centaine d’étapes, une douzaine d’apps, des outils qui mordent), et chaque étape est une occasion de dériver. Les petites erreurs se composent; à la dix millième étape, « souvent correct », ce n’est pas assez.
C’est le problème que le Spice Lab existe pour résoudre. Notre recherche ne vise pas à rendre le modèle plus intelligent; l’intelligence brute vient d’un grand modèle américain. Elle vise à rendre l’agent fiable : choisir parmi plusieurs routes possibles, choisir parmi plusieurs outils possibles, et rester sur la trajectoire à travers des dizaines de milliers d’interactions.
Wasabe Spice Forge est notre harnais propriétaire : la stratégie de post-entraînement, d’affinage et d’exécution qui transforme un modèle de pointe en collègue fiable. Il orchestre la recherche, la découverte d’outils, l’utilisation d’outils et le raisonnement, et garde l’agent stable à travers des dizaines de milliers d’interactions. C’est la propriété intellectuelle de Wasabe, et là où la plus grande partie de la valeur est créée.
Cherche sur le web et dans votre espace ce dont la tâche a réellement besoin.
Choisit les bons outils et apps pour la tâche parmi tout ce qui est disponible.
Les appelle dans l’ordre : rédaction, requêtes et édition dans vos apps.
Raisonne sur les résultats, planifie la suite et garde l’objectif en vue.
Pour le travail critique, un second agent le remet en question et le vérifie de façon indépendante.
Remet un résultat fini et sourcé sur lequel vous pouvez agir.
Le modèle fournit l’intelligence brute. Tout ce que le Spice Lab étudie, c’est ce qu’il faut pour rendre cette intelligence fiable dans du vrai travail.
À chaque étape d’un mandat, plusieurs chemins sont possibles. Notre recherche vise à ce que l’agent prenne le bon, et se rattrape vite quand ce n’est pas le cas.
Plus d’une centaine d’outils, chacun avec ses pièges. Nous entraînons l’agent à découvrir, choisir et appeler le bon, avec les bons arguments, à chaque fois.
Un vrai mandat, ce n’est pas une seule requête. Le Forge garde un seul agent cohérent à travers des dizaines de milliers d’appels d’outils, de messages et de décisions.
Spice Forge est une stratégie d’entraînement autant qu’un moteur d’exécution. Nous post-entraînons et affinons sur les traces du harnais lui-même, pour que le modèle et le harnais s’emboîtent parfaitement.
L’intelligence brute vient d’un grand modèle américain de pointe : une capacité de classe mondiale, hébergée et contrôlée en Amérique du Nord.
Pour le travail critique, un second agent remet en question et vérifie le résultat avant la livraison.
Chaque agent Wasabe tourne déjà dans Spice Forge. Réservez votre place et confiez-lui votre pire mardi.