More

    Nouvelle méthode d’Oxford pour détecter les « hallucinations » AI

    Nouvelle méthode d’Oxford pour détecter les « hallucinations » de l’IA

    Les systèmes actuels de deep learning, tels que « Chatbot GB », souffrent souvent de la propagation d’informations erronées, ce que les chercheurs et experts qualifient d' »hallucinations », constituant un obstacle majeur à leur efficacité.

    Des chercheurs de plusieurs universités et instituts de recherche tentent de trouver des solutions à ce problème. Dans un nouvel article publié dans la revue scientifique « Nature », des chercheurs du département d’informatique de l’Université d’Oxford décrivent une nouvelle méthode pour détecter les moments où les systèmes d’IA pourraient halluciner.

    La méthode décrite dans l’article est capable de distinguer entre les réponses correctes et incorrectes générées par le modèle d’IA avec une précision d’environ 79% du temps, soit environ 10 points de pourcentage de plus que les méthodes leader actuellement disponibles.

    Bien que cette méthode ne traite qu’une seule des nombreuses causes d’hallucinations dans les modèles d’IA, et nécessite environ dix fois plus de puissance de calcul qu’une conversation normale avec le robot, ces résultats pourraient ouvrir la voie à des systèmes d’IA plus fiables à l’avenir, selon un rapport publié dans le magazine Time.

    Hallucinations de l’IA

    Le terme « hallucination » est devenu courant dans le domaine de l’IA, mais il est également controversé. D’une part, il souligne que les modèles ont une sorte d’expérience autonome du monde, ce qui, selon la plupart des informaticiens, n’est pas vrai.

    D’un autre côté, le terme indique que ces hallucinations sont un problème résoluble, et non un problème fondamental potentiellement insoluble dans les grands modèles linguistiques. Cela soulève des divergences entre les chercheurs en IA sur la réponse à cette question, mais surtout, le terme est imprécis car il décrit divers types d’erreurs commises par les modèles d’IA, comme le rapporte l’article.

    C’est pourquoi l’équipe d’Oxford a décidé de se concentrer sur une catégorie spécifique d’hallucinations, appelée « confabulations », où le modèle d’IA fournit des réponses incorrectes non conformes à une question factuelle, contrairement aux réponses incorrectes conformes qui sont généralement attribuées à d’autres raisons telles que des problèmes dans les données d’entraînement du modèle, ou lorsque le modèle ment pour obtenir un avantage, ou en cas de défaillance structurelle dans sa logique ou sa méthode d’inférence.

    Chatbot utilisant l'intelligence artificielle pour discuter

    « Entropie sémantique » mesure le degré de similitude ou de différence de sens de chaque réponse (Shutterstock).

    Méthode simple

    La méthodologie employée par l’équipe de recherche pour détecter la propension du modèle à confabuler est relativement simple. Dans un premier temps, les chercheurs demandent à un robot de conversation de fournir un ensemble de réponses, généralement entre 5 et 10 réponses, à la même question. Ensuite, ils utilisent un modèle linguistique différent pour classer ces réponses en fonction de leur signification.

    Par exemple, des réponses telles que « Paris est la capitale de la France » et « La capitale de la France est Paris » seraient classées dans le même groupe par le modèle car elles ont la même signification, malgré des formulations différentes. En revanche, une réponse comme « La capitale de la France est Rome » serait classée dans un groupe différent.

    Les chercheurs calculent ensuite ce qu’ils ont appelé « l’entropie sémantique », qui mesure le degré de similitude ou de différence de sens de chaque réponse. Si toutes les réponses du modèle ont des significations différentes, l’entropie sémantique sera élevée, indiquant que le modèle est confus et sujet à la confabulation.

    Si toutes les réponses du modèle ont des significations similaires ou identiques, l’entropie sémantique sera faible, indiquant que le modèle fournit une réponse cohérente. Cela signifie que le modèle n’est probablement pas enclin à la confabulation, bien que la réponse puisse être fausse, cela relève d’une forme différente d’hallucination, peut-être due à des problèmes dans les données d’entraînement du modèle lui-même.

    Les chercheurs ont souligné que la méthode de surveillance de l’entropie sémantique surpasse de nombreuses autres méthodes de détection d’hallucinations dans les modèles d’IA, y compris l’entropie primitive, qui ne détecte que les différences de formulation de phrase et non de signification, ainsi qu’une méthode demandant au modèle lui-même d’évaluer la véracité de ses réponses, en plus d’une autre méthode où le modèle d’IA est ajusté aux bonnes réponses à des questions spécifiques.

    Applicabilité Pratique

    L’équipe de recherche propose quelques idées sur la manière dont la méthode de détection de « l’entropie sémantique » pourrait commencer à réduire les hallucinations des robots de conversation de pointe actuellement sur le marché. Un des auteurs de l’article de recherche mentionne qu’il serait théoriquement possible pour une entreprise comme OpenAI d’ajouter une option au robot « Chatbot GB », où lorsqu’un utilisateur clique sur une réponse, il recevrait un certain degré de confirmation qui lui donnerait plus de confiance quant à l’exactitude de cette réponse.

    Il est également expliqué que cette méthode pourrait également être intégrée à d’autres outils qui reposent sur des modèles d’IA dans des environnements professionnels à haut risque, où l’entreprise ou l’organisation souhaite échanger la vitesse et le coût contre la précision de la réponse.

    Alors que l’équipe de recherche est optimiste quant à la capacité de leur méthode à améliorer la fiabilité des systèmes d’IA, certains experts mettent en garde contre une surestimation de son impact immédiat, selon un rapport de Time.

    Certains experts soulignent le manque de clarté quant à l’intégration potentielle de cette méthode dans des applications réelles comme les robots de conversation déjà répandus, soulignant que plus les modèles d’IA deviennent performants, plus les gens chercheront à les utiliser dans des tâches plus difficiles où le risque d’échec pourrait augmenter.

    LAISSER UN COMMENTAIRE

    S'il vous plaît entrez votre commentaire!
    S'il vous plaît entrez votre nom ici

    Actualités

    L’acteur de Friends, Matthew Perry, décède à 54 ans

    "Matthew Perry, célèbre pour son rôle de Chandler Bing dans Friends, décède à 54 ans. Acteur très apprécié, sa mort suscite l'émotion mondiale."

    Entité sioniste déploie des navires de guerre en Mer Rouge selon un expert militaire

    Entité sioniste déploie des navires de guerre en Mer Rouge pour contrer les Houthis au Yémen, une manœuvre vue comme une démonstration de force envers l'Iran.

    Le Retour de Microsoft avec Bing et Edge : Une Menace pour Google ?

    Depuis moins de trois mois, ChatGPT a déjà créé...

    L’affaire des SMS entre Pfizer et la Commission européenne : ce qu’il faut savoir

    En avril 2021, le New York Times a révélé...

    Banque suisse : Credit Suisse en chute libre après la faillite de la SVB

    L'action de Credit Suisse a dévissé de plus de...

    Hébron : des blessés palestiniens lors d’attaques de l’armée et de colons sionistes

    Dix Palestiniens ont été pris en charge à Hébron. D’autres incidents, arrestations et sièges de maisons ont été signalés en Cisjordanie.

    Syrie : une enquête annoncée après l’hospitalisation de Mohamed Ghmira

    Les autorités de Lattaquié annoncent une enquête après l’hospitalisation de Mohamed Ghmira. Le cas d’Abd al-Salam Akko ravive aussi le débat sur les détenus en Syrie.

    Liban : 11 morts après des frappes de l’État sioniste dans le Sud

    L’armée de l’État sioniste affirme avoir tué un commandant du Hezbollah. Les frappes de samedi ont fait 11 morts et 19 blessés, d’après le bilan rapporté.

    Iran : deux médiations en attente autour du détroit d’Ormuz

    Mascate travaille avec Téhéran sur l’organisation du trafic maritime, tandis qu’une initiative pakistanaise vise à rétablir un canal politique avec Washington.

    Syrie : des milliers de dounams agricoles endommagés à Quneitra

    La direction de l’agriculture de Quneitra évalue à plus de 4 800 dounams les pâturages, cultures d’hiver et vergers endommagés après des épandages signalés en janvier.

    Détroit d’Ormuz : condamnations du Golfe après trois attaques contre des navires d’ADNOC

    Trois navires d’ADNOC ont été visés dans le détroit d’Ormuz en deux soirs. Les pays du Golfe ont condamné les attaques.

    Gaza : une délégation du Hamas attendue au Caire pour discuter de l’accord

    Conduite par Khalil al-Hayya, une délégation du Hamas est attendue au Caire pour discuter de l’accord de cessez-le-feu à Gaza.

    Coupe du Roi d’Arabie saoudite : les 32es de finale lancent la 40e édition

    La Coupe du Roi d’Arabie saoudite lance ses 32es de finale sur quatre jours, avec 32 clubs engagés dans cette 40e édition.

    à Lire

    Categories