
Dans cet article (4)
Analyse du financement de la vérification de l’IA par le SB 813 de Californie
Points clés
- Traitez les affirmations de sécurité comme des artefacts d’ingénierie testables, et non comme du discours marketing.
- Suivez qui finance et définit le périmètre des audits d’IA, car l’indépendance dépend des incitations.
- Préparez les processus de publication à un examen externe avec de la documentation, des journaux et des registres clairs des modifications de modèle.
Le projet de loi transfère les contrôles indépendants des modèles vers les institutions, où la gouvernance, l’accès et le financement des auditeurs deviennent un ensemble complexe.
Le projet de loi transfère les vérifications indépendantes des modèles vers les institutions, où la gouvernance, l’accès et le financement des auditeurs forment un ensemble complexe.
Le travail le plus étrange dans l’IA pourrait bientôt consister à lire les devoirs de quelqu’un d’autre sur la sécurité des modèles et à dire, poliment : prouvez-le. Le SB 813 de Californie ne concerne pas un énième classement où le modèle A bat le modèle B d’un point décimal suspect. Il s’agit de savoir qui peut vérifier les affirmations de sécurité sur l’IA de pointe, avec quelle autorité et avec quelles incitations. Ce dernier point compte, car un audit financé comme un petit cadeau de fête n’est pas tout à fait la même chose qu’un audit financé comme une infrastructure publique. Fathom, l’organisation à but non lucratif qui a parrainé le SB 813, affirme que la législature californienne a adopté à une très large majorité le projet de loi présenté par le sénateur Jerry McNerney. Fathom décrit la mesure comme une étape vers le premier cadre étatique du pays pour des organisations de vérification indépendantes, ou IVO, chargées de tester les affirmations de sécurité de l’IA, de mesurer les risques et de renforcer la confiance du public. Traduction depuis le dialecte des politiques publiques : l’État essaie de rendre l’évaluation des modèles moins semblable à un devoir maison auto-noté, et davantage à un régime d’inspection avec supervision adulte. Les laboratoires d’IA détesteront peut-être la paperasse, mais la paperasse est la manière dont les sociétés disent aux très grosses machines d’arrêter les déploiements fondés sur de simples impressions.
Le SB 813 fait passer l’audit de l’IA des impressions aux institutions
Selon Fathom, le mécanisme central du SB 813 est le modèle des IVO : des experts externes capables d’évaluer les affirmations de sécurité de l’IA et les risques. ICT Solutions and Education rapporte que les législateurs californiens ont adopté le SB 813 afin de créer un cadre pour que des organisations indépendantes évaluent la sécurité, les risques et les garde-fous de l’IA. Cette formulation est importante, car elle va au-delà du théâtre des benchmarks. Un vérificateur crédible ne se contente pas de demander si un modèle peut réussir un ensemble de tests ; il demande si le récit de sécurité du développeur résiste à l’examen indépendant. CalMatters Digital Democracy note que la loi existante, le Transparency in Frontier Artificial Intelligence Act, oblige déjà un grand développeur d’IA de pointe à rédiger, mettre en œuvre et publier clairement un cadre d’IA de pointe pour ses modèles de pointe. Le SB 813 s’inscrit naturellement après cela : si les développeurs doivent publier des cadres, quelqu’un d’extérieur au développeur doit avoir un moyen d’examiner si ces cadres signifient vraiment quelque chose. Sinon, un cadre de sécurité peut devenir l’équivalent, dans l’IA, d’un abonnement à la salle de sport acheté en janvier et ignoré dès février.
GovBuddy montre que la tuyauterie des politiques publiques est désormais en
mouvement GovBuddy répertorie le SB 813 dans la session ordinaire 2025-2026 de Californie et l’identifie comme un projet de loi du Sénat avec le statut Adopté par les deux chambres. Cela ne fait pas disparaître les questions techniques. Cela les rend opérationnelles. Une fois que la vérification devient une fonction reconnue par l’État, les laboratoires, les évaluateurs et les agences publiques ont besoin de réponses ennuyeuses mais essentielles sur le périmètre, l’accès, la documentation et la gestion des conflits. C’est là que le caoutchouc de l’ingénierie rencontre la route réglementaire, puis se plaint que la route ne figurait pas dans le document des exigences. Un évaluateur de modèles peut avoir besoin d’un accès API, de fiches système, de documentation de politiques, de modèles de menace, de bancs d’évaluation et d’un budget de calcul suffisant pour mener des tests significatifs. Si l’évaluateur ne peut pas se permettre les tests, l’indépendance devient décorative. Si le développeur contrôle l’accès de façon trop stricte, l’indépendance devient du théâtre de dîner avec des sorties JSON.
Le problème de l’argent n’est pas une note
de bas de page ICT Solutions and Education présente les IVO comme des évaluations par des tiers qualifiés des modèles et systèmes d’IA, y compris de leur sécurité, de leurs risques et de leurs garde-fous. Cela semble net, mais toute personne ayant mené de sérieuses évaluations de modèles sait que le compteur tourne vite. Les sondes de contexte long, les suites de tâches agentiques, les tests adversariaux, l’échantillonnage répété, l’évaluation de l’utilisation d’outils et les vérifications de régression ne sont pas gratuits. La facture n’est pas toute l’histoire, mais faire semblant qu’elle est sans importance est ainsi que l’on obtient des audits qui sont essentiellement des PDF portant des blouses de laboratoire. La leçon politique est simple : l’indépendance des vérificateurs a besoin d’un modèle de financement, pas seulement d’un énoncé de mission. Si les laboratoires paient directement, les lecteurs devraient demander comment les conflits sont gérés. Si l’État paie ou certifie un marché d’évaluateurs, les lecteurs devraient demander comment la qualité et l’accès sont maintenus. Si personne ne paie suffisamment, l’écosystème obtient des tests symboliques, ce qui revient à vérifier un parachute en complimentant les coutures.
Ce que les bâtisseurs devraient préparer ensuite
Pour les bâtisseurs d’IA, la conclusion pratique n’est pas de paniquer, mais d’adopter une bonne hygiène. Fathom indique que le SB 813 est conçu autour du test des affirmations de sécurité et de la mesure des risques ; les équipes devraient donc rendre ces affirmations testables avant que quelqu’un d’autre ne demande des preuves. Cela signifie une documentation de modèles versionnée, des journaux d’évaluation, des procédures de réponse aux incidents, des critères de publication clairs et un historique de ce qui a changé entre les versions du modèle. Oui, c’est moins glamour qu’un tour d’honneur après une victoire sur un benchmark, mais le fil dentaire aussi, et les dentistes restent invaincus. Pour les équipes produit et sécurité, le marché émergent de la vérification indépendante signifie que l’aptitude à la publication pourrait commencer à ressembler davantage à de la conformité plus une revue d’ingénierie. Les meilleures équipes traiteront cela comme une infrastructure de retour d’information, et non comme un simple laissez-passer. Surveillez la manière dont la Californie définit les évaluateurs qualifiés, la façon dont les conditions d’accès sont structurées et si les modèles de financement soutiennent une véritable indépendance. L’économie de l’audit arrive, et elle apporte les reçus.