Aujourd'hui, je veux partager un nouvel épisode avec Hamel Husain.
Hamel a formé plus de 2 000 chefs de produit et ingénieurs d'entreprises comme OpenAI, Anthropic et Google sur la manière de réaliser des évaluations IA. Dans mon nouvel épisode, il partage une masterclass gratuite sur la façon de construire des évaluations pour un véritable agent IA en seulement 50 minutes en utilisant une simple feuille de calcul. J'ai beaucoup appris de Hamel et je pense que vous le ferez aussi.
Hamel et moi avons parlé de :
(00:00) Quelle est la partie la plus précieuse des évaluations
(01:25) Démonstration en direct : Analyse de 100 traces de production réelles
(09:50) Création des critères d'évaluation à l'aide d'une simple feuille de calcul
(24:44) Pourquoi les notations binaires pass/fail surpassent toujours les scores de 1 à 5
(28:52) Le piège de la métrique d'accord qui trompe la plupart des chefs de produit
(30:08) Taux de vrais positifs et négatifs expliqués
(36:00) Comment mettre en place des évaluations continues en production
Où trouver Hamel :
📌 Abonnez-vous à cette chaîne – d'autres interviews arrivent bientôt !