Preuve autonome
Utilisez le moteur intégré de l'application et le modèle par défaut pour valider une charge de travail limitée sur un matériel d'extrémité réel.
Chaque application IA peut démarrer de manière autonome avec son moteur IA intégré. Ajoutez AI Server lorsque les modèles, la puissance de calcul ou les API doivent être partagés ; ajoutez AI Gateway uniquement lorsque plusieurs serveurs nécessitent une porte d'entrée résiliente.
Les applications IA conservent leur moteur intégré et leur routage local même lorsqu'elles se connectent à la plateforme organisationnelle présentée ci-dessous.
Utilisez le moteur intégré de l'application et le modèle par défaut pour valider une charge de travail limitée sur un matériel d'extrémité réel.
Ajoutez un modèle central, un calcul ou un service API uniquement lorsque le cas d'utilisation l'exige.
Ajoutez des membres, des droits, l'enregistrement des serveurs, la politique et les preuves d'audit lorsque la gouvernance centrale est importante.
Placez AI Gateway devant plusieurs serveurs travailleurs lorsque la résilience, la spécialisation ou la capacité mesurée l'exigent.
Les options de déploiement incluent Windows, macOS, Linux, Docker et Kubernetes. La topologie appropriée dépend de la charge de travail, du matériel, de l'identité, de la disponibilité et des exigences de conformité.
Connectez des clients compatibles aux services de chat, d'intégration, d'image, de voix et de vision.
Placez les modèles et l'inférence sur une infrastructure contrôlée par votre organisation.
Gérez les membres, licences, inscriptions, politiques, audits et preuves d'utilisation.
Passez d'un nœud à une ferme gérée par Gateway à mesure que la demande et les preuves augmentent.
Le planificateur de déploiement évalue les applications intégrées, les serveurs optionnels, Gateway, l'administration, le matériel et les quantités de licences payantes — puis envoie uniquement les lignes commandables vers la Boutique.