Pourquoi vous pouvez lui faire confiance
La fiabilité, inscrite dans l'architecture.
En bref
Le modèle d'aujourd'hui est un stagiaire brillant mais peu fiable. DeTars le rend digne de confiance grâce à six propriétés structurelles — pas des promesses, mais des mécanismes que vous pouvez vérifier.
Les six
- Elle pense par elle-même. Donnez-lui un objectif ; elle décompose le travail, forme une équipe de spécialistes, suit l'avancement, se met en pause pour attendre les résultats, puis reprend. Le comment est raisonné sur le moment, pas un script figé d'avance.
- Elle ne s'effondre pas. Quotas, délais dépassés, veille, plantages — elle traite chacun comme un fait à contourner : temporise, réessaie, point de reprise, reprend. Laissez-la tourner la nuit ; lisez les résultats au matin.
- Elle ne peut pas faire semblant. ‘Terminé’ est un reçu qui doit être honoré : livré, étayé par des preuves, revu par les pairs. Chaque citation est scellée par un hash de contenu — changez un seul caractère et elle est aussitôt invalidée.
- Elle a un système immunitaire. Elle traque ses propres erreurs et fait de chacune une couverture de non-régression permanente. Elle a déjà, par deux fois, débusqué des bugs dans ses propres outils d'auto-vérification.
- Elle est à vous. Elle vit sur votre machine ; ce qu'elle retient passe par votre accord et existe sous forme de fichiers sur votre disque. Personne ne peut la bloquer comme Rewind ou Humane ont bloqué leurs utilisateurs.
- Elle n'est pas captive. Elle dirige chaque tâche vers le cerveau le mieux adapté — modèles de pointe US/Chine ou un modèle local sur votre portable, ~50 entre lesquels basculer. Le moteur est le sien, pas une surcouche sur l'API d'un tiers.
Et elle évolue d'elle-même
La fiabilité ne se règle pas une fois pour toutes — elle se cumule. Trois cercles vertueux rendent chaque version plus dure à battre.
- Auto-durcissement. Elle traque ses propres erreurs et fait de chacune une couverture de non-régression permanente — si bien que chaque version est plus dure à casser que la précédente. Une fiabilité qui ne s'achète pas, seulement s'accumule.
- Mémoire auto-optimisée. Elle réorganise et élague en continu son propre système de mémoire pour garder un rappel précis à mesure qu'elle grandit — tandis que ce qu'elle retient de vous passe toujours par votre accord.
- Auto-extension. Quand une tâche réclame une capacité qui lui manque, elle génère, installe et gère ses propres outils et compétences — se forgeant de nouvelles capacités de façon autonome, sans attendre une mise à jour.
En dessous : l'ingénierie qui tient tout
Vous n'avez pas besoin des détails — mais chacun est vérifiable, même si l'implémentation est une propriété intellectuelle centrale que nous ne publions pas.
- Une discipline d'écriture de niveau base de données, pour qu'une équipe d'agents n'écrase jamais le travail des autres.
- Des preuves à empreinte de contenu : une source non lue ou modifiée ne peut pas être citée.
- Un routage conscient du cache garde le KV / prompt cache du modèle chaud — le contexte répété n'est pas facturé deux fois, donc les longues tâches coûtent bien moins de tokens, et la facture baisse à mesure que les prix des modèles baissent.
- Un million de mots de matière pré-digérés en un index avant que le modèle n'en lise un seul.
- Un registre de budget conservé, pour qu'elle ne puisse pas s'octroyer une portée ou une dépense infinie.
- Un second esprit en lecture seule qui relit l'exécution en plein vol et renvoie des corrections.
- Une reprise sur erreur typée — quota, délai dépassé et blocage empruntent chacun une voie différente.
- Les actions irréversibles (ordres, envoi, identifiants sensibles) verrouillées par défaut jusqu'à votre autorisation.