Une nouvelle série d'alertes ne porte pas sur un chatbot qui répond à vos horaires. Reuters a rapporté que des chercheurs actuels et anciens d'OpenAI et de Google DeepMind demandent un contrôle plus fort de systèmes qui pourraient s'améliorer plus vite que des personnes ne peuvent les examiner, en s'appuyant sur des témoignages vidéo recueillis par l'organisation à but non lucratif Palisade Research. Un article voisin, signé par des responsables de recherche d'OpenAI, Anthropic, Microsoft et Meta et rapporté par le Wall Street Journal, demande aux gouvernements de regarder jusqu'où la recherche en IA elle-même a déjà été automatisée. Le langage vise les laboratoires de frontière. L'habitude qu'il décrit peut quand même apparaître, en miniature, dans une entreprise britannique qui laisse un assistant agir sans contrôle.
Ce que « s'améliorer soi-même » veut dire simplement
L'auto-amélioration récursive est l'idée qu'un système aide à concevoir le système suivant, de sorte que la capacité peut monter sans une revue humaine qui monte autant. Des chercheurs parlant à Reuters ont soutenu que les laboratoires avancent vers ce point avec trop peu de protection, et que l'inquiétude sur le rythme n'est pas seulement une ligne commerciale. L'article rapporté par le Journal demande aux décideurs de la visibilité : à quel point la recherche est-elle automatisée, et les garde-fous suivent-ils ?
Personne en dehors de ces laboratoires ne voit le tableau complet, et ce texte ne prétendra pas le contraire. Il n'y a pas de loi britannique publiée, née de ces récits, qui dirait à une petite entreprise d'éteindre un produit nommé. Ce que l'on peut voir, c'est le motif que les chercheurs désignent. Quand un système fait le travail et aide aussi à décider la version suivante du travail, une personne qui ne regarde qu'en fin de semaine arrive trop tard.
Pourquoi une entreprise qui achète du logiciel devrait s'en soucier
La plupart des entreprises britanniques n'entraîneront jamais un modèle de frontière. Elles en loueront un. La version louée qui touche un client est en général un assistant sur un site, un outil dans un CRM, ou une automatisation qui classe, répond ou relance. Ces produits sont vendus comme un gain de temps. Le temps gagné est celui qu'une personne passait à remarquer une erreur.
Cet échange est acceptable quand l'erreur est peu coûteuse à défaire : un brouillon dans un dossier, une catégorie suggérée sur un ticket. C'est un mauvais échange quand l'action quitte le bâtiment. Un e-mail à un client, un paiement, un changement sur une page publique, une réservation qu'une personne devra ensuite honorer. Le développement IA que nous menons part d'un de ces travaux, nommé dans une phrase qu'un collègue reconnaîtrait, avec une personne encore capable de l'arrêter.
Les usages pratiques de l'IA dans les logiciels d'entreprise sont surtout de cette sorte plus étroite : trier des documents, répondre à des questions déjà publiées, qualifier une demande. Aucun n'exige un système qui réécrit ses propres instructions pendant la nuit.
Un contrôle que vous pouvez vraiment tenir
On demande aux gouvernements des audits, des rapports d'incidents et une vue plus claire de la recherche automatisée. Une petite entreprise ne peut pas copier un régulateur national. Elle peut copier le principe : quelqu'un de nommé, un relevé, et une limite.
- Une tâche, écrite, y compris ce que l'assistant ne doit pas faire.
- Un journal qu'un collègue non technique peut ouvrir.
- Une approbation avant que l'entreprise soit engagée.
- Un interrupteur qui coupe la fonction sans emporter le site ou la base de données.
- Une date pour lire le journal, pas seulement une date de lancement.
Si un fournisseur ne peut pas soutenir cette liste, l'alerte des laboratoires concerne déjà votre contrat. On vous offre de la vitesse sans moyen de voir le travail. Le UK GDPR s'applique encore aux données personnelles dans ce travail, qu'une audience américaine définisse ou non un nouveau devoir de sécurité.
Ne pas importer le calendrier du laboratoire dans votre projet
La recherche de frontière avance sur un calendrier fixé par des entreprises qui se font la course. Votre formulaire de demande, non. Une alerte sur des systèmes qui pourraient se redessiner n'est pas un brief pour suspendre un site simple, et ce n'est pas un brief pour ajouter un agent autonome afin de ne pas « rester en arrière ». Les entreprises qui émettent l'alerte livrent aussi des produits. Lire les deux sans filtre produit soit la panique, soit une liste d'achats.
Le filtre, c'est la tâche. Si une personne peut encore décrire le résultat, le vérifier et le défaire, l'alerte a été prise au sérieux à la seule échelle que vous contrôlez. Si le discours est que l'outil décidera l'étape suivante en plus de l'exécuter, on vous vend le motif que les chercheurs veulent voir surveillé par les gouvernements. Vous pouvez refuser ce motif sans refuser le logiciel.
Garder l'alerte à sa mesure
Ces récits ne sont pas une raison d'éviter tout usage de l'IA, et ils ne prouvent pas qu'un produit précis a déjà échappé à son propriétaire. Ils sont une raison de refuser la version du discours qui dit que le contrôle peut attendre que l'outil soit impressionnant. Le comportement impressionnant est exactement le moment où une revue est la moins chère à ajouter et la plus chère à sauter.
Après la mise en ligne, la règle a besoin d'un responsable. Un flux étroit dans un pilote gagne des permissions supplémentaires parce que quelqu'un est absent. La maintenance et le support sont la façon peu spectaculaire de garder ces permissions là où vous les avez posées.
Web Works Rise est une équipe dirigée depuis le Royaume-Uni, avec le bureau à Birmingham et un hub de développement en Tunisie pour la capacité de livraison. Si vous voulez un premier assistant qui reste dans un travail que vous pouvez décrire, contactez l'équipe. Apportez la tâche et le point où une personne doit encore dire oui.
