tech
Une nouvelle vague de modèles d'IA prend le temps de « réfléchir » étape par étape avant de répondre, dépensant plus de calcul au moment de la question, pas seulement à l'entraînement.
Les modèles de raisonnement s'arrêtent pour décomposer un problème en étapes intermédiaires avant de produire une réponse finale, plutôt que de générer une réponse en un seul passage immédiat comme le faisaient généralement les agents conversationnels précédents. En consacrant un effort de calcul supplémentaire au moment même où la question est posée, en générant une sorte de brouillon de raisonnement interne, ces modèles peuvent repérer leurs erreurs, explorer plusieurs approches et traiter des problèmes à plusieurs étapes, ce qui améliore sensiblement leurs performances sur des mathématiques difficiles, des énigmes logiques et des tâches de programmation complexes.
Ces modèles nécessitent toujours une connexion internet lorsqu'ils sont exécutés via un service cloud, cette option méconnaît donc leur mode de déploiement réel. Ils n'utilisent pas non plus moins de mémoire que les modèles plus anciens ; ce raisonnement supplémentaire, étape par étape, a tendance à consommer davantage de ressources de calcul par réponse, car générer ce raisonnement caché demande un temps de traitement et une puissance supplémentaires.
Cela montre qu'il n'existe pas qu'une seule voie vers de meilleures performances en agrandissant simplement un modèle ; laisser un modèle « réfléchir plus longtemps » au moment de la question peut parfois égaler, voire dépasser, les gains obtenus en entraînant un modèle encore plus grand depuis le début.
tech
Que fait la Génération Augmentée par Récupération (RAG) ?Quel est un avantage clé de cette IA 'embarquée' ?Comment un modèle à 'mélange d'experts' y parvient-il ?Comment appelle-t-on ce matériel d'entraînement généré par l'IA ?Comment appelle-t-on la seconde approche, l'entraînement sur des exemples ?Comment fonctionne en général ce 'filigrane' du texte ?Comment s'appelle cette technique d'entraînement ?Comment s'appelle cette technique de compression ?Comment appelle-t-on les modèles d'IA qui gèrent plusieurs types d'entrée à la fois ?Quelle entreprise exploite ce service commercial de robotaxi entièrement sans conducteur ?Sur la célèbre échelle SAE, quel est le numéro de niveau le plus élevé, représentant l'automatisation totale ?Quel est le nom du robot humanoïde dévoilé par le constructeur automobile Tesla ?Quration — Quration Play