Accéder au contenu principal

Interrogez les points de terminaison de modèles de fondation

Interrogez les points de terminaison de modèles de fondation Databricks pour accéder en production à des modèles hébergés avec la gouvernance intégrée d’AI Gateway.

Aperçu de Interrogez les points de terminaison de modèles de fondation

Créer avec l’IA

  1. Copiez le prompt ci-dessous
  2. Collez-le dans Cursor, Claude Code, Codex ou tout autre agent de codage
  3. Votre agent la crée en posant des questions au fil du processus afin que le résultat corresponde exactement à vos attentes

Vous découvrez les modèles ? En savoir plus ici

Une fois l'opération terminée, vous disposerez de :

  • Un serving endpoint de foundation-model configuré pour l'inférence de chat dans votre application
  • Un utilitaire de requête s'appuyant sur le SDK Databricks pour les interactions requête/réponse standard
  • Une configuration de streaming optionnelle s'appuyant sur le SDK Vercel AI pour des réponses de chat en temps réel

Prerequisites

Vérifiez que ces fonctionnalités du workspace Databricks sont activées avant de commencer. Si l'une des vérifications échoue, demandez à l'administrateur de votre workspace d'activer la fonctionnalité concernée.

  • Endpoints Foundation Model API avec gouvernance AI Gateway. Les endpoints de foundation models hébergés par Databricks sont préconfigurés avec les fonctionnalités d'AI Gateway (suivi d'utilisation, limites de débit, garde-fous). Vérifiez leur disponibilité en listant les endpoints et en contrôlant la configuration : databricks serving-endpoints list --profile <PROFILE> doit renvoyer au moins un endpoint de foundation model databricks-*, et databricks serving-endpoints get <endpoint-name> --profile <PROFILE> -o json | grep -q '"ai_gateway"' && echo ok doit afficher ok. La disponibilité des endpoints varie selon le workspace et la région.