Quration Play

tech

Comme les laboratoires d'IA manquent de nouveaux textes écrits par des humains pour apprendre, beaucoup entraînent désormais leurs modèles en partie sur des données créées par d'autres systèmes d'IA.

Comment appelle-t-on ce matériel d'entraînement généré par l'IA ?

Données synthétiques
Les données synthétiques sont des informations produites par des modèles ou des simulations plutôt que recueillies dans le monde réel, et elles comblent les lacunes là où les exemples réels sont rares ou privés. Les chercheurs avertissent qu'un entraînement trop intensif sur des sorties d'IA peut dégrader la qualité, un risque surnommé « effondrement du modèle ».

Les données synthétiques sont des données d'entraînement générées par des modèles d'IA ou des simulations informatiques, plutôt que collectées directement à partir d'écrits, d'images ou d'événements humains réels. À mesure que les laboratoires d'IA se heurtent de plus en plus aux limites de la quantité de texte humain récent et de qualité disponible pour l'entraînement, les données synthétiques offrent un moyen de combler ces lacunes, en particulier dans les domaines où les exemples réels sont rares, coûteux à réunir ou privés, permettant aux chercheurs de générer de grands volumes d'exemples d'entraînement supplémentaires et adaptés.

Les données ouvertes (« open-source ») désignent des informations ou du code librement accessibles à quiconque veut les utiliser ou les modifier, un concept de licence sans rapport avec le fait que le contenu ait été généré par une IA. Les métadonnées ne sont que des informations descriptives sur d'autres données, comme la date de création ou l'auteur d'un fichier, et non un contenu d'entraînement généré par un système d'IA lui-même.

Des chercheurs ont exprimé des inquiétudes quant au fait qu'entraîner de nouveaux modèles d'IA de façon trop intensive sur des données générées par d'anciens modèles d'IA, plutôt que sur du contenu réellement créé par des humains, peut progressivement dégrader la qualité et la diversité au fil des générations successives, un problème de boucle de rétroaction que les chercheurs ont surnommé « effondrement du modèle ».

▶ Quration Play

tech

Comment appelle-t-on la seconde approche, l'entraînement sur des exemples ?Comment fonctionne en général ce 'filigrane' du texte ?Comment s'appelle cette technique d'entraînement ?Comment s'appelle cette technique de compression ?Comment appelle-t-on les modèles d'IA qui gèrent plusieurs types d'entrée à la fois ?Quelle entreprise exploite ce service commercial de robotaxi entièrement sans conducteur ?Sur la célèbre échelle SAE, quel est le numéro de niveau le plus élevé, représentant l'automatisation totale ?Quel est le nom du robot humanoïde dévoilé par le constructeur automobile Tesla ?Quelle entreprise a été pionnière de ce service de livraison médicale par drone en Afrique ?Les robots d'entrepôt d'Amazon sont nés de son rachat en 2012 de quel fabricant de robots ?Quel est le nom du robot chirurgical très répandu fabriqué par Intuitive Surgical ?Quel est le principal avantage que ces robots de désherbage laser apportent aux agriculteurs ?

Quration — Quration Play