C’est la traduction française de « What Is ChatGPT Doing… and Why Does It Work? » de Stephen Wolfram, composé de deux essais écrits peu après le lancement de ChatGPT (début 2023).
Premier essai – Comment fonctionne ChatGPT :
- ChatGPT génère du texte en prédisant, mot par mot (ou plutôt « jeton » par jeton), la suite la plus « acceptable » d’un texte donné, en se basant sur des probabilités statistiques apprises sur des milliards de pages de texte.
- Wolfram explique le rôle de la « température » (un paramètre qui introduit du hasard dans le choix des mots, évitant un texte trop répétitif).
- Le livre explore ensuite l’origine de ces probabilités, le concept de modèle (et pourquoi des modèles simplifiés fonctionnent pour des tâches humaines), les réseaux neuronaux et leur entraînement, ainsi que les limites de cette approche.
- Il aborde l' »enchâssement de mots » (word embedding), qui permet de représenter le sens des mots numériquement, puis détaille l’architecture interne de ChatGPT (transformeurs) et son processus d’entraînement.
- La fin de cette partie traite de « l’espace sémantique » et des « lois sémantiques du mouvement », une réflexion sur la structure du langage qui permettrait à un modèle statistique de produire un texte cohérent, et conclut sur ce que fait réellement ChatGPT et pourquoi cela fonctionne.
Second essai – Wolfram|Alpha et ChatGPT :
- Cette partie explore comment combiner ChatGPT avec Wolfram|Alpha (système de calcul de connaissances de Wolfram) pour pallier les limites de ChatGPT en matière de calculs précis et de connaissances factuelles fiables.
- Des exemples concrets illustrent cette synergie, et le livre se termine par une réflexion sur les perspectives futures de l’IA.







Avis
Il n’y a pas encore d’avis.