Modèles Llama entièrement gérés
Restez organisé à l'aide des collections
Enregistrez et classez les contenus selon vos préférences.
Les modèles Llama sont disponibles en tant qu'API gérées et modèles auto-déployés sur Gemini Enterprise Agent Platform. Vous pouvez diffuser vos réponses en flux continu pour réduire la perception de la latence côté utilisateur. Une réponse en flux continu utilise des événements envoyés par le serveur (SSE) pour diffuser la réponse de manière incrémentielle.
Modèles Llama gérés
Les modèles Llama offrent des modèles entièrement gérés et sans serveur en tant qu'API. Pour utiliser un modèle Llama sur Agent Platform, envoyez une requête directement au point de terminaison de l'API Agent Platform. Lorsque vous utilisez des modèles Llama en tant qu'API gérée, il n'est pas nécessaire de provisionner ni de gérer l'infrastructure.
Les modèles Llama suivants sont disponibles pour une utilisation dans Gemini Enterprise Agent Platform. Pour accéder à un modèle Llama, accédez à la fiche de modèle Model Garden.
Llama 4 Maverick 17B-128ELe modèle Llama 4 multimodal le plus grand et le plus performant (MoE 17B actif / 400B total), optimisé pour le codage, le raisonnement approfondi, le chat sophistiqué et la compréhension d'images de haute précision.Llama 4 Scout 17B-16EModèle MoE à haute efficacité (17 milliards d'actifs / 109 milliards au total) offrant des résultats de pointe pour la récupération de contexte long, la synthèse de documents et le raisonnement dans de grandes bases de code.blockLlama 3.3 70BModèle textuel de 70 milliards de paramètres adapté aux instructions, qui offre des performances améliorées par rapport à Llama 3.1 70B et Llama 3.2 90B pour les applications textuelles.
Utiliser des modèles Llama
Pour les modèles gérés, vous pouvez utiliser des commandes curl pour envoyer des requêtes au point de terminaison Gemini Enterprise Agent Platform à l'aide des noms de modèles suivants. Pour savoir comment effectuer des appels en flux continu et non en flux continu aux modèles Llama, consultez Appeler des API de modèles ouverts.
Pour utiliser un modèle Gemini Enterprise Agent Platform auto-déployé :
Sauf indication contraire, le contenu de cette page est régi par une licence Creative Commons Attribution 4.0, et les échantillons de code sont régis par une licence Apache 2.0. Pour en savoir plus, consultez les Règles du site Google Developers. Java est une marque déposée d'Oracle et/ou de ses sociétés affiliées.
Dernière mise à jour le 2026/10/07 (UTC).
[[["Facile à comprendre","easyToUnderstand","thumb-up"],["J'ai pu résoudre mon problème","solvedMyProblem","thumb-up"],["Autre","otherUp","thumb-up"]],[["Difficile à comprendre","hardToUnderstand","thumb-down"],["Informations ou exemple de code incorrects","incorrectInformationOrSampleCode","thumb-down"],["Il n'y a pas l'information/les exemples dont j'ai besoin","missingTheInformationSamplesINeed","thumb-down"],["Problème de traduction","translationIssue","thumb-down"],["Autre","otherDown","thumb-down"]],["Dernière mise à jour le 2026/10/07 (UTC)."],[],[]]