OnDemand
OnDemand, outil intelligent axé sur l’amélioration de l’efficacité grâce à l’IA
Étiquettes :Amélioration de l’efficacité de l’IAPrésentation des outils
OnDemand est une plateforme de création, d’orchestration et de déploiement d’agents intelligents basés sur l’IA, gérée par School Hack FZ-LLC. Elle est présentée officiellement comme un système d’exploitation décentralisé pour les agents. Elle s’adresse à la fois aux expériences sans code, à l’automatisation d’entreprise et à l’intégration des développeurs, couvrant les agents, le savoir, les workflows, l’inférence de modèles et divers types d’API.
Fonction principale
Agents et Playground en temps réel
Les utilisateurs peuvent tester des modèles, des fichiers et des agents personnalisés dans le Playground, ajuster des paramètres tels que la température et consulter les journaux d’exécution. La plateforme permet de créer des outils, des agents et des processus multi-agents, et offre également des composants réutilisables, des modèles de planification, une mémoire persistante et des nœuds d’approbation manuelle.
- Vous pouvez commencer avec des agents ou des outils prédéfinis, ou bien configurer vous-même les prompts, les modèles et le comportement.
- Utilisez le débogage en temps réel pour visualiser les requêtes, les exemples de code, les étapes et les appels d’outils.
- Conserver le contexte entre sessions grâce à la mémoire, et contrôler l’accès des équipes avec les permissions des rôles.
- Ajouter une confirmation manuelle pour les actions telles que l’envoi d’e-mails et la modification de données, afin de réduire les risques liés à l’exécution autonome.
Connexions de connaissances, plugins et MCP
La plateforme permet de télécharger des fichiers et des dossiers, ainsi que de se connecter à des services de stockage cloud tels que SharePoint, OneDrive et Amazon S3. Les agents peuvent également accéder à des capacités externes en utilisant des plugins par défaut, des endpoints personnalisés, des connecteurs OAuth et des outils MCP.
- Permettre à l’agent d’effectuer des recherches sur les données de l’entreprise et de générer des réponses contextualisées.
- Lire des données, déclencher des opérations ou combiner des processus après la connexion à des systèmes tiers.
- Prend en charge le PDF et la mise en correspondance des images à l’intérieur des fichiers, ce qui facilite le traitement de documents complexes.
- L’accessibilité des connecteurs et la portée des permissions dépendent du compte, du mode de déploiement et des paramètres de l’administrateur.
Modèles, raisonnement et déploiement d’applications
OnDemand permet de choisir entre un modèle de plateforme, un modèle intégré ou une connexion à un endpoint d’inférence privé ; il est également possible de déployer des modèles Hugging Face sur des GPU dédiés et de les exécuter via vLLM. Les développeurs peuvent aussi déployer des applications sans serveur et créer des produits interactifs grâce à des réponses en flux.
- Choisir de manière unifiée plusieurs grands modèles de langage, et mettre en place un contrôle d’accès Pro pour les modèles avancés.
- Conserver le choix de l’infrastructure de modèles et d’inference grâce à BYOM et BYOI.
- Encapsuler les processus d’agents intelligents dans des sites web, des systèmes internes ou des applications clients.
- La portée de prise en charge du modèle, la disponibilité des GPU et les performances varient en fonction de la région et du plan.
Développer une interface
| Interface ou capacité | Utilisation principale | Scénarios adaptés | Précautions à prendre |
|---|---|---|---|
| Chat API | Créer des sessions étatiques, se connecter à des agents et retourner les résultats en flux. | Service client, FAQ et assistant intégré | Gestion des sessions, des clés, du throttling et des tentatives de réessai en cas d’échec |
| Media API | Télécharger ou citer des médias, extraire des informations audio, vidéo et documentaires | Analyse de documents, transcription et recherche de contenu | Il est nécessaire de vérifier le format du fichier, sa taille et la portée des données sensibles. |
| Cloud Services API | Transcription vocale en texte et texte en voix | Assistants vocaux, réunions et fonctionnalités d’accessibilité | Langue, timbre de voix et facturation selon le compte |
| Agent Tools API | Créer une session, interroger l’agent et appeler des outils | Tâches automatisées et processus à plusieurs étapes | Les outils d’écriture doivent intégrer des droits minimaux et une approbation. |
| BYOM et BYOI | Déployer des modèles propriétaires ou se connecter à des endpoints d’inférence propres | Modèles privés, puissance de calcul dédiée et environnement contrôlé | L’exploitation, la sécurité et les licences des modèles sont à la charge conjointe de l’utilisateur. |
Tutoriel d'utilisation
- Inscrivez-vous, choisissez un modèle dans Playground, et testez la sortie avec des tâches ne contenant pas d’informations sensibles.
- Créer un espace de connaissances, télécharger un petit nombre de documents représentatifs et vérifier les résultats d’analyse, de segmentation et de recherche.
- Créer un nouvel agent, en définissant les instructions du système, le modèle, les connaissances, la mémoire ainsi que les outils autorisés.
- Lorsqu’une automatisation à plusieurs étapes est nécessaire, connectez des déclencheurs, des modèles, des outils, des nœuds d’approbation et des nœuds de sortie dans le constructeur de flux.
- Générez une clé API et copiez les exemples en Python, JavaScript ou en ligne de commande fournis par la plateforme dans l’environnement de test.
- Configurer avant le lancement l’isolation des clés, le budget, la limitation du débit, les journaux, les droits des rôles, la révision manuelle et le rollback en cas d’anomalie.
À qui s’adresse-t-il
- Équipes de produits et d’innovation nécessitant une validation rapide des systèmes de Q&A RAG et des agents intelligents instrumentaux.
- Développeurs qui souhaitent intégrer des conversations, du média ou de l’IA vocale dans leurs applications via une API.
- Équipes opérationnelles qui doivent relier plusieurs modèles, outils et étapes d’approbation dans un processus visuel.
- Les entreprises souhaitant utiliser leurs propres modèles, l’inférence privée ou des options de déploiement local.
- Les utilisateurs qui ont simplement besoin de conversations personnelles simples n’ont peut-être pas besoin d’une capacité de déploiement et de gouvernance complètes.
Prix et forfaits
| niveau | Montant actuellement divulgué | Champ confirmé | Adéquat pour les utilisateurs |
|---|---|---|---|
| Commencer gratuitement | À partir de 0 dollar | Les informations structurées sur les produits sur le site officiel offrent un accès gratuit ; il est possible de s’inscrire et d’accéder à la plateforme. | Essai et validation du prototype |
| Pro | Les autorités ne l’ont pas encore rendu public. | Une partie des modèles avancés et des compétences professionnelles sont contrôlées par les droits Pro. | Nécessite des modèles avancés et des personnes ou équipes utilisant en continu |
| Déploiement en entreprise ou local | Contacter l’équipe | Les droits des rôles, le branding personnalisé, les modèles propriétaires, l’inférence privée, le mode local et le support sur mesure sont à confirmer selon le plan. | Les organisations ayant des exigences en matière de sécurité, de conformité et de déploiement |
| API et consommation de puissance de calcul | Affichage des éléments réels dans le compte | Les modèles, les agents, les médias, la voix, le stockage, les GPU et l’exécution sans serveur peuvent être facturés séparément. | Applications de production et projets à forte consommation |
Selon les mises à jour officielles de mai 2026, le système de prix a été ajusté, et en juillet des contrôles Pro ont été ajoutés pour les modèles avancés ; le site web officiel ne affiche pas de manière stable le montant actuel des forfaits ni les limites totales. Après inscription, il convient de se référer à la page d’utilisation et de facturation, et non aux anciens prix fournis par des tiers.
Les conditions de la plateforme exigent que l’utilisateur prenne en charge les frais liés au compte, et précisent que le montant de la facture est hors taxe et doit généralement être payé dans un délai de cinq jours suivant l’émission de la facture. Les modalités de résiliation, de remboursement, de durée de validité du crédit gratuit ainsi que le prix par excédent ne sont pas entièrement indiquées sur la page publique ; une confirmation écrite doit être obtenue avant l’achat.
Avantages du produit
- Il offre en même temps des expériences sans code, une orchestration visuelle et des API de développement, facilitant le passage du prototype à l’intégration.
- Les connaissances, les plugins, MCP, les modèles et les capacités de déploiement sont regroupés sur une même plateforme.
- Il est possible d’utiliser ses propres modèles ou des endpoints de raisonnement, afin de réduire la dépendance vis-à-vis d’un seul fournisseur de modèles.
- Prend en charge les fonctionnalités de gouvernance opérationnelle telles que l’approbation manuelle, les rôles des utilisateurs, l’historique d’exécution et les journaux.
- Les officiels publient continuellement des mises à jour de fonctionnalités et fournissent des documents API ainsi que l’exportation de code.
Restrictions d'utilisation et précautions
- Il existe de nombreux niveaux de plateforme, et la combinaison de modèles, d’outils, de plugins, de connaissances et de déploiement augmente la complexité du débogage.
- L’appel de systèmes externes par un agent intelligent peut entraîner des effets secondaires réels ; il convient donc de limiter les permissions et de prévoir des mécanismes de rollback.
- Les coûts peuvent provenir de plusieurs facteurs tels que les modèles, les médias, la voix, les GPU, le stockage et l’exécution.
- Les modèles embarqués ne résolvent pas automatiquement les problèmes de licences, de fuites de données, d’injection d’instructions et de sécurité des sorties.
- Les performances officielles, la sécurité et le nombre de modèles font partie des spécifications de la plateforme ; les entreprises doivent néanmoins effectuer elles-mêmes des tests de charge et de risque.
Sécurité, confidentialité et déploiement
La page d’accueil officielle indique l’audit SOC 2 Type 1 et précise que des rôles d’entreprise, des connexions Azure, du raisonnement privé et des modèles de connaissances locaux peuvent être utilisés. La portée de la certification, les rapports les plus récents, ainsi que le stockage des données et les sous-traitants doivent être confirmés à travers les documents de vente ou d’évaluation de la sécurité.
Les conditions de la plateforme stipulent que les données des clients ne seront consultées que pour fournir des services, calculer des frais ou en cas d’exigence légale, et que des mesures techniques et organisationnelles raisonnables seront mises en œuvre. Avant de traiter des données sensibles, un accord de données applicable doit être signé, définissant les règles de stockage, de suppression, de sauvegarde, d’entraînement des modèles et de notification en cas d’événement.
API, SDK et situation du logiciel open source
OnDemand propose effectivement une page de référence API couvrant les interfaces pour les outils de chat et d’agents intelligents, les médias et la voix, et permet également d’exporter du code pour Python, JavaScript et la ligne de commande. Il s’agit d’une interface de développement officielle ; les clés doivent être stockées uniquement du côté serveur et séparées selon l’environnement.
Les documents officiels ne confirment pas l’existence d’un SDK officiel publié de manière indépendante et maintenu en open source, ni ne fournissent de licence open source pour le produit lui-même. Il est possible de consulter le code des agents, de déployer des modèles open source ou d’utiliser vLLM en open source, mais cela n’équivaut pas à l’open source de la plateforme OnDemand elle-même.
Questions fréquentes
OnDemand peut-il être utilisé gratuitement ?
Le site officiel propose un accès à partir de zéro coût, mais les quotas gratuits actuels, la gamme de modèles et la durée de validité ne sont pas entièrement listés sur la page publique. Une fois connecté au compte, il convient d’abord de consulter les règles d’utilisation et de facturation.
Faut-il absolument utiliser les modèles fournis par la plateforme ?
Ce n’est pas obligatoire. La plateforme prend en charge BYOM et BYOI, il est possible de déployer ses propres modèles ou de se connecter à ses propres points d’inférence, mais les fonctionnalités spécifiques et les coûts dépendent du forfait choisi.
A-t-il une API publique ?
Oui. Des références API et une exportation de code sont fournies officiellement, couvrant des fonctionnalités telles que la messagerie, les agents intelligents, les médias et la voix, mais les quotas d’appel et les prix doivent être confirmés dans le compte.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164