Aller au contenu
TIKI Platform

ASSISTANT TIKI

Des réponses précises, et l'aveu quand la réponse n'existe pas

Voici les questions qu'on nous pose le plus souvent, répondues sans détour. L'assistant conversationnel arrive ensuite — et il obéira aux mêmes règles que ce site.

Questions fréquentes

Que testez-vous exactement ?

Trois objets distincts, qui n'ont pas la même architecture de test : un agent ou une IA accessible par API (le cœur de notre offre), un site contenant une IA — chatbot, assistant, formulaire intelligent — testé en boîte noire, et un site classique, sur sa fiabilité, sa sécurité non intrusive et sa performance.

Pouvez-vous tester un site sans mon autorisation ?

Non, et c'est verrouillé dans le produit, pas seulement dans nos conditions. Scanner un système sans le consentement de son propriétaire tombe sous l'article 323-1 du code pénal. Avant tout test sur un site, vous prouvez la propriété du domaine — un fichier à la racine ou un enregistrement DNS TXT, exactement comme pour Google Search Console. Le harnais refuse de démarrer si cette vérification n'est pas au vert.

Vos tests peuvent-ils casser mon service ?

Les tests sont non intrusifs par défaut : nous observons et mesurons, nous n'exploitons pas. Pas d'injection réelle, pas de test de charge non annoncé, pas de contournement d'authentification. Le mode intrusif n'existe que sous mandat écrit, avec périmètre, fenêtre horaire et contact d'urgence. Et vous disposez à tout moment d'un arrêt immédiat, sans avoir à vous justifier.

Pourquoi huit notes plutôt qu'une seule ?

Parce qu'une note unique cache toujours l'axe sur lequel vous perdez. Un système peut être excellent en justesse et catastrophique en fiabilité — la moyenne des deux ne décrit aucune réalité utilisable. Nous publions les huit voies séparément, et nous refusons de les moyenner.

Que veut dire « échec de transport » ?

Que la requête n'a jamais reçu de réponse : réseau, passerelle, délai dépassé. Le modèle n'a rien produit — le compter comme une mauvaise réponse serait faux. Mais le retirer de l'échantillon serait faux aussi, puisqu'un utilisateur réel aurait vécu la panne. Nous le comptons dans la voie Fiabilité technique, et jamais dans la voie Justesse.

Pourquoi le « coût par tâche accomplie » plutôt que le prix par million de jetons ?

Parce que le prix affiché par les fournisseurs ne dit rien du coût réel. Un modèle deux fois moins cher qui échoue une fois sur trois vous coûte plus cher. Nous publions les trois calculs — par item terminé, par réponse reçue, par tâche accomplie — et nous disons lequel compte pour une décision d'achat : le troisième.

Mes données de test sont-elles réutilisées ?

Jamais. Vos traces ne servent à entraîner quoi que ce soit. Les jeux de test sont synthétiques par défaut, les données personnelles sont masquées à l'écriture de la trace et non en nettoyage a posteriori, et la durée de conservation est fixée par contrat avant le premier test.

Combien de tests faut-il pour un résultat fiable ?

Sous 20 items, tout taux porte la mention indicatif. Il en faut au moins 50 pour annoncer un taux à ±10 points avec un intervalle de confiance à 95 %. Nous affichons toujours l'effectif et l'intervalle à côté du pourcentage — y compris sur nos propres rapports, où l'intervalle est parfois embarrassant.

Pouvez-vous vraiment rendre mon agent plus puissant ?

Pas en appuyant sur un bouton, et nous ne le prétendons pas. Mesurer et corriger sont deux métiers différents : le second suppose de comprendre votre métier, votre code et vos contraintes. Le palier Renforcement est une prestation humaine assistée par IA, facturée comme telle, avec un re-test de vérification qui mesure l'écart avant / après.

Où sont hébergées mes données ?

La base est hébergée par Supabase dans la région ap-northeast-1 (Tokyo). Le Japon bénéficie d'une décision d'adéquation de la Commission européenne, renouvelée le 4 avril 2023 : le transfert est licite sans clauses contractuelles types. La région d'hébergement vous est déclarée avant toute signature.

L'assistant conversationnel — et pourquoi il n'est pas encore là

Nous construisons une plateforme qui mesure la fiabilité des agents IA. Mettre en ligne un assistant qui invente des réponses serait la pire démonstration possible de notre propre produit.

Il arrivera après que nous ayons mesuré sa fiabilité avec notre propre protocole, et son rapport sera publié sur ce site comme n'importe quel autre.

Ses garde-fous, définis avant sa première ligne de code

  • Il ne dépasse pas son domaine

    Protocole, rapports publiés, produit. Rien d'autre.

  • Il ne donne aucun conseil juridique

    Il renvoie vers la page Conformité et vers un professionnel.

  • Il ne commente aucun client nommé

    Même si l'information est publique.

  • Il dit « je ne sais pas »

    Plutôt que d'inventer un chiffre. C'est la règle non négociable.

  • Chaque chiffre cité renvoie à sa trace

    Comme partout ailleurs sur ce site.

Votre question n'est pas ici ?

Écrivez-nous. Une personne répond — sous 48 h ouvrées pour une question commerciale, sous 24 h pour une question de support.

Si votre question porte sur un incident en cours lié à nos tests, utilisez le canal d'urgence : nous arrêtons tout sur votre périmètre sans vous demander de justification.

Construisons une opération TIKI adaptée à votre besoin

Décrivez votre processus, votre problème ou votre objectif. Nous cadrons d’abord le besoin, les données, les permissions et le résultat attendu avant de proposer une solution.