Aller au contenu

Transparence IA

Cortex Foundation entraîne et publie ses propres modèles, et les sert dans ses produits. Cette page énonce clairement ce que ces modèles font, ce qu’ils ne font pas, ce qu’il advient du texte que vous leur envoyez et les usages que nous refusons. Elle est écrite pour être confrontée à notre comportement, pas pour vous rassurer.

Dernière mise à jour : [À REMPLIR PAR MATHIS : date de cette version]

Ceci est la version en vigueur depuis le [À REMPLIR PAR MATHIS : date de cette version]. Les versions antérieures sont disponibles sur demande ; la date en tête de cette page est celle qui s’applique.

1 Ce que font les modèles

Cortex Mini 1 est le modèle par défaut de Cortex Chat. Il génère du texte et du code en réponse à un prompt. Cortex propose aussi la génération d’images et la vérification d’origine comme fonctionnalités du produit.

Ce sont des modèles statistiques génératifs. Ils prédisent une continuation ; ils ne consultent pas une base de faits vérifiés et n’ont accès à aucune source de vérité, sauf si un produit leur en donne explicitement une — ce que fait Deep Research lorsqu’il cite les pages qu’il a lues.

Chaque fiche modèle indique l’architecture, le nombre de paramètres, la fenêtre des données d’entraînement, la longueur de contexte et les résultats d’évaluation. Elle est la description faisant autorité de ce modèle, et elle prévaut sur cette page.

2 Ce que les modèles ne font pas

Ils ne savent rien de ce qui s’est produit après leur fenêtre d’entraînement, sauf si un produit leur fournit un outil de recherche qui contient la date du jour. Ils ne vérifient pas une affirmation qu’on ne leur a pas demandé de vérifier. Ils n’ont pas de mémoire d’une conversation que vous avez fermée, sauf si vous l’avez enregistrée et que le produit la leur relit.

Ils n’agissent pas sur le monde de leur propre initiative. Cortex Code et Cortex CLI écrivent des fichiers et exécutent des commandes seulement là où vous les avez dirigés et seulement avec la permission que vous avez accordée. Cortex Security lit un dépôt et fait un rapport ; il ne le modifie pas au cours d’une revue.

Ils ne sont ni médecin, ni avocat, ni comptable, ni ingénieur signataire. Une sortie est un brouillon. Le jugement, la vérification et la signature restent à un humain.

3 Données d’entraînement

Les modèles sont entraînés sur [À REMPLIR PAR MATHIS : composition réelle du corpus — parts de données publiques, de données sous licence, de données produites en interne, et de retours utilisateurs, avec leurs ordres de grandeur].

Les conversations des utilisateurs ne sont pas utilisées pour l’entraînement par défaut. Lorsqu’une conversation est utilisée pour l’entraînement, c’est parce que l’utilisateur a activé cette option, pour cette conversation ou pour son compte, et le consentement peut être retiré à tout moment au même endroit. Nous ne considérons pas « la poursuite de l’usage du service » comme un consentement à entraîner sur votre contenu.

Nous respectons les directives robots et les conditions de licence attachées à une source. Publier une œuvre ouvertement ne la place pas dans le domaine public, et nous ne la traitons pas ainsi.

Les titulaires de droits peuvent obtenir [À REMPLIR PAR MATHIS : mécanisme réel — liste des sources, filtrage a posteriori, retrait des données], et demander le retrait de leur œuvre en écrivant à [À REMPLIR PAR MATHIS : adresse e-mail de contact droits d’auteur]. Ces demandes reçoivent la réponse d’une personne, et la réponse indique ce qui a réellement été retiré.

4 Conservation des prompts

Vos prompts et les sorties générées sont conservés tant que la conversation existe, pour que vous puissiez la rouvrir, et ils servent à faire fonctionner votre compte et à détecter les abus.

  • Donnée
    Prompts et sorties, entraînement désactivé (par défaut)
    Conservée
    durée de vie du compte, puis [À REMPLIR PAR MATHIS : délai de purge]
    Utilisée pour l’entraînement
    non
  • Donnée
    Prompts et sorties, entraînement activé
    Conservée
    [À REMPLIR PAR MATHIS : durée]
    Utilisée pour l’entraînement
    oui, jusqu’au retrait du consentement
  • Donnée
    Prompts sur un service utilisé sans compte
    Conservée
    [À REMPLIR PAR MATHIS : durée]
    Utilisée pour l’entraînement
    non
  • Donnée
    Journaux d’abus et de sécurité
    Conservée
    [À REMPLIR PAR MATHIS : durée, 12 mois par défaut]
    Utilisée pour l’entraînement
    non
  • Donnée
    Conversations supprimées
    Conservée
    [À REMPLIR PAR MATHIS : délai de purge en sauvegarde, 35 jours par défaut]
    Utilisée pour l’entraînement
    non

Vous pouvez supprimer une conversation depuis l’interface, et elle cesse immédiatement d’être lisible. Nous ne promettons pas qu’elle a quitté nos disques à la même seconde ; c’est ce que signifie la colonne de conservation ci-dessus.

5 Exactitude, limites et hallucinations

Un modèle génératif produit un texte fluide, qu’il soit correct ou non. Ce mode de défaillance — une affirmation assurée, bien formée et fausse — s’appelle une hallucination, et c’est une propriété de la méthode, pas un bogue qu’une version ultérieure supprimera.

Attendez-vous à en rencontrer surtout sur : les citations et références, les chiffres exacts, les dates, le contenu d’un document que le modèle n’a pas reçu, et les signatures d’API. Considérez chaque citation comme non vérifiée tant que vous ne l’avez pas ouverte.

Chaque modèle que nous publions est accompagné d’un rapport d’évaluation qui indique où le modèle échoue, pas seulement où il réussit. Ces rapports sont publiés même lorsqu’ils sont peu flatteurs, et ils sont publiés avant les poids. Lisez-les avant de choisir un modèle.

Ce qui réduit le risque : donner au modèle le document source plutôt que lui demander de s’en souvenir ; lui demander de citer ; lui demander son incertitude ; et faire vérifier par une personne tout ce qui donnera lieu à une action. Ce qui ne réduit pas le risque : un ton assuré. La fluidité n’est pas une preuve.

6 Usages à haut risque interdits

Au titre de l’article 5 du règlement européen sur l’IA, et de nos propres conditions, les usages suivants sont purement et simplement interdits et ne sont pas rendus licites par notre licence :

  • les techniques subliminales, délibérément manipulatrices ou trompeuses qui altèrent substantiellement le comportement et causent un préjudice important ;
  • l’exploitation d’une vulnérabilité d’une personne ou d’un groupe liée à l’âge, au handicap ou à une situation sociale ou économique particulière, pour altérer son comportement d’une manière qui cause un préjudice important ;
  • la notation sociale par un acteur public ou privé, produisant un traitement préjudiciable ou défavorable sans rapport avec le contexte dans lequel les données ont été générées ;
  • la prédiction du risque qu’une personne physique commette une infraction pénale, sur la seule base d’un profilage ;
  • la constitution d’une base de données de reconnaissance faciale par moissonnage non ciblé d’images ;
  • l’inférence des émotions sur le lieu de travail ou dans un cadre éducatif ;
  • la catégorisation biométrique visant à déduire la race, les opinions politiques, l’affiliation syndicale, les convictions religieuses ou philosophiques, la vie sexuelle ou l’orientation sexuelle.

Au-delà de ces interdictions, nous refusons — et les conditions d’utilisation interdisent — les usages listés en 2.2.4, et en particulier les décisions sur l’accès des personnes à l’emploi, au crédit, au logement, aux soins, à l’éducation ou aux services publics essentiels sans revue humaine qualifiée.

7 Contrôle humain

Un système d’IA déployé sur lequel une personne s’appuie doit laisser cette personne capable de le comprendre, de le contredire et de l’arrêter.

Dans nos propres produits, cela signifie : le modèle énonce son incertitude au lieu de la lisser ; chaque affirmation de Deep Research porte une citation que vous pouvez ouvrir ; une action qui modifie vos fichiers est présentée pour confirmation avant de s’exécuter ; et il y a toujours un moyen d’accomplir la tâche sans le modèle.

Dans vos propres déploiements, placez un humain nommé dans la boucle partout où une sortie affecte les droits d’une personne ou son accès à un service, et consignez qui a relu quoi. La personne qui signe reste responsable ; le modèle n’est pas un bouclier.

8 Signaler un problème

Signalez une sortie préjudiciable, un problème de sécurité dans un service Cortex, ou un modèle qui se comporte d’une manière que sa fiche ne décrit pas, à [À REMPLIR PAR MATHIS : adresse e-mail de signalement]. Pour les signalements de sécurité, n’ouvrez pas d’abord un ticket public : utilisez [À REMPLIR PAR MATHIS : canal de divulgation, ou l’adresse dédiée].

Nous accusons réception d’un signalement, nous vous disons ce que nous avons trouvé, et nous publions le correctif dans le journal des versions. Lorsqu’un signalement révèle une défaillance systématique — une classe de prompts qui contourne une protection, une lacune dans une évaluation — nous le disons dans la fiche modèle de la version concernée. Un modèle qui échoue n’est pas retiré du registre ; il est annoté.

9 Conformité au règlement européen sur l’IA

Cortex Foundation agit en tant que fournisseur de modèles d’IA à usage général au sens du règlement (UE) 2024/1689, et en tant que fournisseur d’un système d’IA pour ses propres produits.

  • Obligation
    Documentation technique du modèle, y compris le processus d’entraînement et d’évaluation
    Où elle est remplie
    fiches modèles et rapports d’évaluation, sur les pages Modèles et Recherche
  • Obligation
    Informations pour les fournisseurs en aval
    Où elle est remplie
    la fiche modèle et sa licence, publiées avec les poids
  • Obligation
    Politique de droit d’auteur, y compris un modèle de réserve de droits
    Où elle est remplie
    section 2.4.3 de ce document, et [À REMPLIR PAR MATHIS : emplacement de la politique droits d’auteur]
  • Obligation
    Résumé public du contenu d’entraînement
    Où elle est remplie
    [À REMPLIR PAR MATHIS : emplacement de ce résumé]
  • Obligation
    Signalement des incidents graves au Bureau de l’IA
    Où elle est remplie
    procédure tenue par [À REMPLIR PAR MATHIS : fonction responsable], signalement via 2.4.8
  • Obligation
    Transparence envers les utilisateurs d’un système d’IA
    Où elle est remplie
    sections 2.4.1, 2.4.2 et 2.4.5 de ce document
  • Obligation
    Pratiques interdites
    Où elle est remplie
    section 2.4.6

Lorsqu’un modèle Cortex est intégré dans un produit mis sur le marché par quelqu’un d’autre, ce fournisseur porte les obligations du système d’IA et Cortex Foundation celles du modèle. Nous fournissons la documentation nécessaire à cet effet, et nous demandons aux intégrations de laisser intacts les marqueurs de provenance.

Cette section décrit notre lecture du règlement en vigueur à la date figurant en tête de cette page. Elle ne constitue pas un conseil juridique et ne remplace pas le règlement.

Non, pas par défaut. L’entraînement sur les conversations des utilisateurs est désactivé, et il le reste tant que vous ne l’activez pas pour une conversation ou pour votre compte. L’activer est un consentement que vous pouvez retirer ; le retirer arrête l’entraînement futur sans effet sur ce qui a déjà été appris.

Les autres documents

Chacun porte sa date en tête ; la version en vigueur est celle que vous lisez.

  • Mentions légales

    Qui publie ce site, qui est responsable de ce qu’il dit et sous quelles licences les modèles sont publiés.

  • Conditions d’utilisation

    Ces conditions régissent votre usage de cortex.foundation et des services Cortex accessibles depuis ce site.

  • Politique de confidentialité

    Cette politique explique quelles données personnelles Cortex Foundation collecte, pourquoi, sur quelle base légale, pendant combien de temps elles sont conservées et comment vous exercez vos droits.