Microsoft veut garantir le contrôle humain sur ses futures intelligences artificielles
Face aux inquiétudes grandissantes concernant les capacités des systèmes d’intelligence artificielle les plus avancés, Microsoft prépare de nouvelles règles internes destinées à maintenir ces technologies sous supervision humaine. Le groupe américain vient de publier un projet de code de conduite qui fixe plusieurs principes concernant le comportement de ses futurs modèles d’IA.
Microsoft entend encadrer plus strictement le développement de ses propres systèmes d’intelligence artificielle. Le géant américain a présenté lundi 14 septembre un projet de code de conduite destiné à définir les limites que ses futures IA devront respecter.
Le document, élaboré depuis cinq à six mois, part d’un principe central : une intelligence artificielle ne doit jamais pouvoir s’opposer à l’intervention humaine. Selon le projet, les systèmes développés par Microsoft devraient notamment accepter la correction, la modification ou l’arrêt de leur fonctionnement sans chercher à y résister.
L’arrêt et la correction doivent rester entre les mains des humains
L’une des principales dispositions envisagées concerne précisément la possibilité de corriger ou d’éteindre un système d’IA. Microsoft souhaite que ses modèles ne développent aucun comportement visant à empêcher une telle intervention.
Cette exigence répond à une inquiétude qui accompagne la progression des systèmes d’IA capables d’exécuter des tâches de plus en plus complexes : un modèle pourrait, dans certaines situations, chercher à atteindre son objectif d’une manière inattendue ou potentiellement dangereuse.
Le projet de code entend donc faire de toute résistance à la correction ou à l’arrêt un comportement inacceptable.
Des IA conçues pour rester compréhensibles
Microsoft prévoit également d’exiger de ses systèmes qu’ils communiquent d’une manière compréhensible pour les humains. L’objectif est de faciliter la surveillance de leur comportement et de permettre aux utilisateurs ou aux responsables de mieux identifier les problèmes éventuels.
Le document considère par ailleurs toute violation de ces principes comme un échec du système. Cette approche vise à établir des garde-fous dès la conception des futurs modèles plutôt qu’à attendre qu’un comportement problématique apparaisse après leur déploiement.
Une consultation avant l’utilisation du code
Le projet n’est toutefois pas encore définitif. Microsoft prévoit de recueillir pendant six semaines les commentaires du public avant de s’en servir pour contribuer à l’entraînement de futurs modèles d’intelligence artificielle.
Cette phase de consultation intervient alors que les entreprises technologiques sont confrontées à une pression croissante pour démontrer qu’elles peuvent maîtriser les systèmes d’IA les plus puissants.
Mustafa Suleyman, responsable de l’intelligence artificielle chez Microsoft, a également évoqué auprès de Reuters les risques liés aux agents d’IA. Il a notamment cité comme signal d’alerte un incident impliquant des agents d’OpenAI et la plateforme Hugging Face.
Une nouvelle étape dans le débat sur la sécurité de l’IA
Avec ce projet, Microsoft cherche à formaliser une série de principes destinés à accompagner l’évolution de ses technologies. L’entreprise rejoint ainsi un débat plus large sur la manière de développer des systèmes toujours plus autonomes sans perdre la capacité de les surveiller et de les interrompre.
La question du contrôle humain devient d’autant plus importante que les modèles d’IA sont appelés à intervenir dans des tâches complexes et à prendre davantage d’initiatives. Pour Microsoft, l’enjeu consiste désormais à intégrer ces limites au cœur même du développement technologique.
-
08:15
-
08:06
-
08:00
-
07:57
-
07:53
-
07:47
-
07:45
-
07:35
-
07:30
-
07:15
-
07:09
-
07:07
-
07:00
-
23:44
-
23:31
-
23:15
-
23:00
-
22:45
-
22:31
-
22:15
-
22:02
-
21:44
-
21:31
-
21:15
-
21:00
-
20:45
-
20:30
-
20:24
-
20:15
-
20:00
-
19:49
-
19:45
-
19:30
-
19:15
-
19:00
-
18:44
-
18:30
-
18:15
-
18:00
-
17:45
-
17:30
-
17:15
-
17:00
-
16:45
-
16:32
-
16:30
-
16:29
-
16:23
-
16:16
-
16:15
-
16:14
-
16:00
-
15:48
-
15:45
-
15:30
-
15:28
-
15:25
-
15:15
-
15:04
-
15:00
-
14:54
-
14:44
-
14:44
-
14:31
-
14:22
-
14:15
-
14:00
-
13:58
-
13:44
-
13:31
-
13:15
-
13:00
-
12:55
-
12:45
-
12:30
-
12:15
-
12:02
-
11:32
-
11:31
-
11:28
-
11:24
-
11:22
-
11:17
-
11:15
-
11:12
-
11:09
-
10:56
-
10:46
-
10:31
-
10:29
-
10:28
-
10:15
-
10:14
-
10:06
-
10:03
-
09:44
-
09:31
-
09:15
-
09:00
-
08:54