Plusieurs spécialistes, vision, navigateur
Dernier épisode de la série.
Le cours Agents HF ouvre aussi multi-agents, vision et navigateur.
On reste prudents : c'est là que beaucoup de démos deviennent du chaos.
Multi-agents : l'idée
Au lieu d'un seul agent qui fait tout :
- un chercheur (FAQ / web limité) ;
- un vision (lit une image) ;
- un rédacteur ;
- un chef qui répartit et fusionne.
Quand rester simple (cas le plus fréquent)
Horaires + délai devis + FAQ : un agent, 3 outils, ça suffit.
Plusieurs agents = overhead. Ne le fais que si tu as une vraie douleur.
Vision
Utile pour : capture d'erreur, étiquette, maquette.
Pas magique : l'OCR se trompe. Valide les champs critiques.
Navigateur (browser)
Utile pour : lire une page publique autorisée.
Dangereux pour : comptes connectés, paiements, tout le web ouvert.
Règles mini :
- domaines autorisés ;
- pas de secrets dans le prompt ;
- humain avant action irréversible ;
- log de chaque URL.
Clôture de la série
Tu as maintenant la carte :
- c'est quoi un agent ;
- outils ;
- boucle ;
- premier agent ;
- code vs outil contrôlé ;
- choix de framework ;
- chercher dans ta doc ;
- voir / mesurer ;
- fine-tune outils ;
- parcours LangGraph ;
- docs LlamaIndex ;
- multi / vision / navigateur.
Le cours officiel reste top pour les labs.
Ici, tu as la version lisible, en français, avec les garde-fous.
Pour le socle modèles : série LLM.
Phrase à garder : un agent sans limite, c'est un stagiaire avec les clés du camion.
Questions fréquentes (FAQ)
Toujours multi-agent ?
Non. Un agent bien outillé bat cinq agents mal briefés.
Browser = danger ?
Oui s'il est ouvert sans règles.
Par quoi commencer demain ?
Un agent, 2 outils, traces allumées, 20 vraies questions clients.
Navigation dans la série
- Précédent : Agent + tes documents (LlamaIndex)
- Fin de la série - Agents Course Hugging Face · série LLM