Aliyun Bailian
Valeur ajoutée gratuite
Agent intelligent IA AI Agent

Aliyun Bailian

Appels de modèles orientés entreprises, développement d’applications et plateforme d’agents intelligents

Étiquettes :

Qu’est-ce qu’Aliyun Bailian ?

Alibaba Cloud Model Studio, dont le nom en anglais est Alibaba Cloud Model Studio, est une plateforme intégrée fournie par Alibaba Cloud pour le développement de grands modèles et la création d’applications IA. Les développeurs peuvent choisir des modèles Tongyi Qianwen ou de tiers dans une seule console, obtenir des clés API, tester des prompts, construire des bases de connaissances, créer des agents et des workflows, puis publier leurs applications sur leur propre site web, leurs applications mobiles et leurs systèmes d’entreprise.

Bailian n’est pas l’application Qianwen conçue pour les conversations avec des utilisateurs ordinaires, ni un modèle unique. Tongyi Qianwen fait partie de la famille de modèles développés par Alibaba Cloud, tandis que Bailian est une plateforme cloud qui offre des services de mise à disposition de modèles, RAG, Agents, outils, optimisation, évaluation, surveillance et gouvernance d’entreprise.

Services de modèles

1. Modèle de texte et de raisonnement Tongyi Qianwen

La plateforme propose différentes versions de Qianwen Max, Plus, Flash, ainsi que des modèles destinés au code, aux mathématiques, à la traduction, aux textes longs et au raisonnement avancé. Les utilisateurs peuvent choisir entre une version fixe ou l’alias Latest en fonction de la qualité, du contexte, du délai et du prix.

Latest s’adapte aux mises à niveau des capacités du modèle selon la plateforme, ce qui permet d’obtenir rapidement de nouveaux effets, mais les résultats peuvent varier ; les systèmes en production doivent privilégier une version fixe et effectuer des tests de régression, en veillant aux annonces concernant la désactivation et le transfert du modèle.

2. Modèles multimodaux et génératifs

Bailian couvre des modèles tels que la compréhension visuelle, la génération et l’édition d’images, la génération de vidéos, la reconnaissance vocale, la synthèse vocale, l’audiovisuel en temps réel, les Embedding et le Rerank. L’application peut traiter du texte, des images, de l’audio, des vidéos et des documents, et peut également combiner différents modèles pour réaliser des scénarios tels que des podcasts, des Q&A visuels et des avatars numériques.

L’unité de facturation des modèles multimodaux peut être un token, une seconde, un caractère, ou des spécifications d’image ou de vidéo. La résolution, la durée, le nombre de connexions simultanées et le fait d’activer la réflexion influencent tous le coût ; il n’est pas possible d’estimer tous les travaux en se basant uniquement sur le prix des modèles textuels.

3. Modèles tiers

En plus de Qianwen, le modèle Plaza propose également DeepSeek, GLM, Kimi, MiniMax ainsi que certains services de modèles open source. La plateforme offre un compte et une surveillance unifiés, mais chaque modèle présente des différences en termes de région, de quota gratuit, de contexte, de politique de contenu et de prix.

4. Interface compatible OpenAI

Bailian propose une interface compatible avec OpenAI, permettant d’utiliser les SDK officiels d’OpenAI pour Python, Node.js, Java, Go, etc., ainsi que les SDK officiels DashScope pour Python et Java. Lors du transfert d’applications existantes, il est généralement nécessaire de remplacer les adresses API, les clés et les IDs de modèles, et de vérifier les paramètres de appel des outils, les images, ainsi que les sorties en flux et structurées.

Trois modes de construction d’applications

1. Agent intelligent 2.0

La nouvelle version de l’agent est pilotée par des instructions en langage naturel, capable de comprendre les intentions de l’utilisateur, de planifier de manière autonome, et d’accéder à une base de connaissances, à la mémoire, aux compétences, au MCP et aux extensions. Elle convient au service client ouvert, aux questions-réponses, aux assistants de tâches, à la planification de voyages et aux interactions multi-échanges.

Plus l’autonomie de l’agent est élevée, plus il est difficile de prédire le parcours d’exécution. Lorsqu’il s’agit de commandes, de paiements, d’envois, de suppressions et de données internes, il convient de mettre en place une liste blanche d’outils, une validation des paramètres, des droits d’accès et une confirmation manuelle ; on ne peut pas se fier uniquement à des instructions pour empêcher les abus de pouvoir.

2. Visualisation des workflows

Le flux de travail définit une séquence d’exécution fixe à travers des nœuds, et peut combiner de grands modèles, la classification des intentions, une base de connaissances, l’analyse de documents, du code, des API, le calcul fonctionnel, des jugements, le parallélisme, des boucles, des variables, des agents et des sous-processus. Il convient aux tâches nécessitant une exécution stable et reproductible, telles que la génération de rapports, le traitement des commandes, l’approbation, l’étiquetage des données et la modération du contenu.

Le flux de travail prend en charge le débogage et les variables de session, et peut également être publié comme une application de dialogue en temps réel audiovisuel, intégrée au Web, à iOS et à Android via H5 ou des SDK audiovisuels. Les modèles, bases de connaissances et services cloud appelés par les nœuds entraînent des frais respectifs.

3. Applications à fort taux de code

Les applications à fort niveau de codage s’adressent aux développeurs professionnels et permettent d’utiliser Python pour construire un backend d’IA, d’intégrer MCP, des connecteurs de données ainsi que des agents/workflows existants, et de les déployer en un clic dans un environnement cloud. Elles conviennent aux algorithmes privés, aux dépendances complexes et à l’intégration système approfondie.

Le code s’exécute avec des droits plus élevés ; il convient de fixer les dépendances, de scanner les vulnérabilités, de restreindre le réseau et les identifiants, et d’établir des règles de gestion opérationnelle pour les temps d’attente, l’ajustement de la capacité, les journaux et les exceptions.

Base de connaissances RAG

Documents, tableaux, images et connaissances audiovisuelles

La base de connaissances Bai Lian prend en charge la recherche de documents, les requêtes de données, les questions-réponses avec des images, ainsi que la recherche audio et vidéo. Elle peut être importée à partir de fichiers locaux, d’OSS, de pages web et d’autres sources de données. La reconnaissance de documents couvre PDF, DOC, DOCX, WPS, PPT, PPTX, Markdown, TXT et Excel ; les documents richement texturés permettent d’analyser les illustrations et les graphiques grâce à de grands modèles.

Les différents types de bases de connaissances ne peuvent pas être sélectionnés en combinaison dans la même base, mais la nouvelle version d’Agent 2.0 peut associer plusieurs bases de connaissances et les appeler de manière autonome en tant qu’outil standard. Les workflows peuvent spécifier des bases de connaissances de manière fixe ou dynamique, avec des paramètres TopK et de recherche définis séparément.

Recherche et réorganisation

La base de connaissances découpe les documents en blocs, les vectorise et crée des index ; lors de la recherche, on peut utiliser une correspondance sémantique, des mots-clés, un réarrangement et un filtrage par métadonnées. Les tests de correspondance servent à visualiser les fragments récupérés, et les paramètres API ont la priorité sur les configurations de la console.

Augmenter TopK peut améliorer la couverture, mais il augmente également le nombre de tokens d’entrée du modèle ainsi que le bruit. L’équipe doit évaluer les troncations, les modèles vectoriels, les seuils et le réarrangement à l’aide de problèmes réels, et les réponses clés doivent toujours être vérifiées dans le texte original.

SDK de base de connaissances

En plus de son utilisation dans les applications Bai Lian, les applications externes peuvent également appeler directement les capacités de recherche de la base de connaissances via l’SDK Bai Lian. Cela permet de transmettre les résultats RAG à des orchestrateurs de modèles personnalisés ou à d’autres agents, mais il reste nécessaire de gérer l’espace métier, l’ID de la base de connaissances, ainsi que l’authentification et le throttling.

Mémoire, Compétences, Extensions et MCP

La base de mémoire sert à stocker les préférences de l’utilisateur et les informations à long terme, permettant à l’agent de rester personnalisé entre les sessions. Un Skill est un ensemble de capacités pouvant être ajoutées à un agent ; les Skills officiels couvrent des tâches courantes telles que le traitement de fichiers.

Les extensions comprennent un interpréteur de code, une calculatrice, une génération d’images, une fonction de recherche, des codes QR et une recherche sur GitHub, et prennent également en charge des API personnalisées.

MCP permet aux agents d’appeler Amap, des bases de données, des services internes et des outils tiers ; les applications à fort niveau de codage peuvent également étendre l’accès aux données via MCP.

La description des outils et leurs paramètres sont laissés à la décision du modèle ; le serveur doit valider l’identité, la portée et les conditions métier afin de prévenir les injections de prompts.

Optimisation et évaluation des modèles

Bailian prend en charge la gestion des prompts, l’évaluation des modèles, le fine-tuning supervisé, etc., et permet de comparer les modèles de base avec leurs versions optimisées à l’aide de données propres. L’évaluation des applications vérifie l’efficacité de l’agent et du flux de travail du point de vue des réponses finales, du rappel des connaissances et de l’exécution des outils.

Le ajustement fin permet d’apprendre les formats, les styles et les modèles de tâches, mais il n’est pas adapté à une mise à jour fréquente des faits ; le RAG doit être utilisé pour les connaissances privées en temps réel.

Les données d’entraînement doivent être autorisées et démasquées, puis divisées en ensembles d’entraînement et de validation, afin d’éviter la mémorisation des informations privées et le surapprentissage.

Publication, API et observation

Les agents et les flux de travail peuvent être intégrés par des appels API ou des pages de partage, et les services de modèles peuvent également être accédés directement via des interfaces compatibles avec DashScope et OpenAI. La plateforme offre des statistiques d’appel, des tokens, un taux de réussite, des délais, des journaux d’application, une observation du parcours et une gestion des permissions.

La clé API doit être stockée du côté serveur et isolée en fonction de l’espace métier et des permissions RAM. Il convient de configurer une limitation du débit, des alertes de budget, le masquage des journaux, des tentatives de réessai en cas d’échec et un renouvellement des clés ; il est interdit de placer la clé du compte principal dans un navigateur ou dans un dépôt public.

Comparaison des prix et des versions

Forfait ou versionPrix, plafonds et avantages clés
Prix du modèlePar défaut, le modèle BaiLian est facturé à l’usage ; les modèles de texte calculent généralement séparément les tokens d’entrée et de sortie ; les images, vidéos, sons, vecteurs et retraitements utilisent leurs propres unités. Certains modèles appliquent des tarifs progressifs en fonction de la longueur des tokens d’entrée, et toute demande utilise le tarif correspondant à la tranche concernée. À la date de cette vérification, le prix de référence pour la version fixe QianWen 3.7 Max dans la région de Pékin, dans le nord de la Chine, est de 12 yuans par million de tokens d’entrée et de 36 yuans par million de tokens de sortie, avec un quota gratuit de 1 million de tokens. Ce quota gratuit est généralement valable pendant 90 jours à partir de la date la plus tardive parmi l’activation de BaiLian, la publication du modèle ou l’approbation de la demande ; d’autres régions peuvent ne pas disposer de ce quota. Pour les modèles prenant en charge le traitement par lots, l’entrée et la sortie sont généralement facturées à 50 % du prix du raisonnement en temps réel. Le cache de contexte a un tarif distinct : la création d’un cache explicite coûte 125 % du prix d’entrée standard, tandis qu’une récupération réussie coûte 10 % ; les remises pour le traitement par lots et le cache ne s’appliquent pas simultanément. Les prix varient considérablement selon les différentes tranches de QianWen et les modèles tiers, et des offres promotionnelles peuvent également être disponibles dans la console. Il n’est pas possible d’indiquer simplement un seul « prix de BaiLian par million de tokens ».
Prix de la base de connaissancesLa base de connaissances est facturée à l’usage, avec un calcul par heure. La page de création actuelle indique 0,03 yuan/heure pour l’édition standard et 0,2 yuan/heure pour l’édition phare ; en outre, des frais peuvent être générés pour le stockage, l’analyse, les embeddings, la recherche, le reranking et les tokens des grands modèles ultérieurs. Même lorsque la base de connaissances est inutilisée, le temps d’exécution selon les spécifications peut tout de même être facturé. Les ressources qui ne sont plus utilisées après test doivent être supprimées ou désactivées en temps opportun, et des budgets ainsi que des alertes doivent être configurés dans le centre de facturation.
Essai gratuit et abonnementsL’offre d’essai d’AI d’Aliyun promeut actuellement le service Bai Lian, qui permet d’accéder à plus de 100 millions de tokens de grands modèles, mais nécessite une authentification par identité réelle, doit être activé via un centre d’essai désigné, et est soumis à des restrictions liées au premier essai, aux comptes partagés ainsi qu’à la durée de validité des modèles spécifiques. Les quotas offerts dans le cadre de cette offre ne constituent pas des droits permanents pour tous les comptes. Bai Lian propose également des produits abonnés tels que CodingPlan et TokenPlan, dont la gamme de modèles, la renouvellement automatique et la politique d’utilisation équitable sont indépendants des API payantes au forfait. Il convient de consulter le forfait en vigueur avant achat, et de ne pas utiliser les quotas d’abonnement pour des API standard non prises en charge ou pour une revente à des fins commerciales.

Prix du modèle

Par défaut, le modèle BaiLian est facturé au forfait, tandis que les modèles de texte calculent généralement séparément les tokens d’entrée et de sortie ; les images, vidéos, sons, vecteurs et retraits utilisent chacun leurs propres unités.

Certains modèles appliquent des tarifs en gradins en fonction de la longueur du token d’entrée unique, et toute requête utilise le prix unitaire correspondant à cette catégorie.

À la date de cette vérification, pour la région de Pékin dans le nord de la Chine, le prix de référence pour la version fixe Qianwen 3.7 Max est de 12 yuans par million de tokens pour l’entrée et de 36 yuans par million de tokens pour la sortie, avec un crédit gratuit de 1 million de tokens. Ce crédit gratuit est généralement valable pendant 90 jours à partir de la date la plus tardive parmi l’activation de Bai Lian, la publication du modèle ou l’approbation de la demande ; d’autres régions peuvent ne pas disposer de ce crédit.

Les entrées et sorties de modèles prenant en charge le traitement par lots sont généralement facturées à 50 % du prix du raisonnement en temps réel. Le cache contextuel a un tarif distinct : la création d’un cache explicite coûte 125 % du prix d’entrée standard, tandis qu’un accès réussi coûte 10 % ;

Les remises par lot et les remises de cache ne peuvent pas être appliquées en même temps.

Les prix varient considérablement selon les différents niveaux de Qianwen et les modèles tiers, et la console peut également proposer des offres promotionnelles. Le catalogue ne doit pas se limiter à indiquer un seul « prix par million de tokens pour Bai Lian » ; le budget officiel doit être calculé séparément en fonction de l’ID du modèle, de la région, de la longueur de l’entrée, de la sortie de réflexion, du cache et du traitement en lot.

Prix de la base de connaissances

La base de connaissances est facturée à l’usage, avec un calcul par heure. La page de création actuelle indique 0,03 yuan/hour pour l’édition standard et 0,2 yuan/hour pour l’édition phare ; en outre, des frais peuvent être générés pour le stockage, l’analyse, les Embedding, la recherche, le Rerank ainsi que pour les tokens des grands modèles ultérieurs.

Même si la base de connaissances est inutilisée, le temps d’exécution selon les spécifications peut tout de même faire l’objet d’une facturation. Les ressources qui ne sont plus utilisées après les tests doivent être supprimées ou désactivées en temps opportun, et des budgets ainsi que des alertes doivent être configurés dans le centre de gestion des coûts.

Essai gratuit et abonnements

L’offre d’essai d’AI d’AliCloud promet actuellement l’accès à plus de 100 millions de tokens de grands modèles via Bai Lian, mais elle nécessite une vérification d’identité, doit être activée depuis un centre d’essai désigné, et est soumise à des restrictions liées au premier essai, aux comptes partagés ainsi qu’à la durée de validité des modèles spécifiques. Les crédits offerts ne constituent pas un droit permanent pour tous les comptes.

Bailian propose également des produits abonnés tels que CodingPlan et TokenPlan, dont la gamme de modèles, la renouvellement automatique et les politiques d’utilisation équitable sont indépendants des API payantes à l’usage. Il convient de consulter le forfait en vigueur avant achat, et de ne pas utiliser les crédits d’abonnement pour des API standards non prises en charge ou pour une revente en production.

GitHub et l’état open source

AliCloud maintient en open source sur GitHub le SDK DashScope, des exemples d’API ainsi que des projets liés au modèle Tongyi Qianwen. Certains poids de modèles et outils sont soumis à la licence Apache 2.0 ou à leurs licences respectives. Les développeurs peuvent également utiliser directement le SDK open source officiel d’OpenAI pour appeler des interfaces compatibles.

La plateforme BaiLianYun, la base de connaissances hébergée, la console d’application et les services de modèle commercial ne sont pas des logiciels open source pouvant être déployés en mode privé. Le fait qu’un modèle Qwen ou un SDK soit open source ne signifie pas que tous les modèles, données et services disponibles sur BaiLian utilisent la même licence ; il convient de vérifier chaque élément avant une utilisation commerciale.

Sécurité des données et géographie

Selon les informations officielles, les données transmises lors de la création d’une application ou de l’entraînement d’un modèle sont chiffrées. La plateforme propose également de la RAM, un espace de travail, des journaux d’activité ainsi que des fonctionnalités de sécurité cloud de niveau entreprise.

Les modèles, les quotas gratuits et les capacités d’application peuvent varier selon la région, et il existe également des différences dans les fonctionnalités disponibles entre la plateforme internationale et la plateforme chinoise.

La transmission chiffrée ne signifie pas que les données peuvent être téléchargées sans condition. Les entreprises doivent examiner les accords de service, la conservation des données, leur utilisation pour l’entraînement, les transferts transfrontaliers, les exigences relatives aux informations personnelles et à la conformité sectorielle, et appliquer des principes de moindre privilège ainsi que du masquage des données aux bases de connaissances, aux ensembles d’entraînement et aux journaux.

Guide d'utilisation d’Aliyun Bailian

Terminer une tâche de base

  1. Inscrivez-vous à Alibaba Cloud BaiLian et créez une API Key réservée uniquement à l’environnement de test ;
  2. Sélectionner le modèle en fonction du type d’entrée, du contexte, de la qualité, de la vitesse et du prix ;
  3. Appeler d’abord le service de modèle pour effectuer la requête minimale et vérifier la structure de réponse ;
  4. Utiliser ensuite trois modèles de construction d’applications pour tester la sortie en flux, les paramètres et les réponses aux exceptions ;
  5. Enregistrer les tokens, le nombre d’appels, le délai, le taux d’erreurs et le coût par appel ;
  6. Transférez la clé dans le gestionnaire de clés du serveur avant de l’intégrer à l’application officielle ;

Créer des flux de travail professionnels réutilisables

  1. Utiliser des clés et des quotas différents pour les environnements de développement, de test et de production ;
  2. Créer un ensemble d’évaluation représentatif en fonction des services de modèle, des trois modes de construction d’applications et de la base de connaissances RAG ;
  3. Définir les délais d’attente, la concurrence, les tentatives de réessai, le throttling et les plafonds budgétaires ;
  4. Effectuer des vérifications sur la sortie en ce qui concerne les faits, la sécurité, le format et les informations sensibles ;
  5. Surveiller les changements de version, de prix, de délai et de taux d’échec des modèles de surveillance ;
  6. Préparer des plans de dégradation du modèle, de coupure et de prise en main manuelle ;

À qui s’adresse-t-il ?

  • Développeurs qui appellent Tongyi Qianwen et les API de modèles nationaux et internationaux ;
  • Créer rapidement des équipes d’assistance client, d’assistants de connaissances et d’assistants de tâches à l’aide d’agents sans code ;
  • Les entreprises qui ont besoin de visualiser les flux de travail pour mettre en œuvre des processus métier fixes ;
  • Ingénieurs souhaitant déployer des backends d’IA complexes de manière Pythonic ;
  • Organisation d’une base de connaissances RAG nécessitant des documents, des images, des tableaux et du contenu audiovisuel ;
  • Clients qui accordent de l’importance aux permissions, au monitoring, à la registration et au système de services d’entreprise d’Ali Cloud.

Avantages du produit

  • Toute la série de Tongyi Qianwen et les modèles tiers sont connectés en masse ;
  • Les interfaces compatibles DashScope et OpenAI réduisent les coûts de migration ;
  • Les agents, les flux de travail et la couverture à haut niveau de code présentent des niveaux d’accès au développement différents ;
  • Base de connaissances, mémoire, compétences, plugins et capacités MCP complètes ;
  • L’optimisation du modèle, l’évaluation, l’observation et les droits forment un cycle fermé ;
  • Prend en charge l’optimisation des coûts en batch, en mémoire tampon et avec plusieurs niveaux de modèles.

Restrictions et précautions

  • Il existe de nombreuses fonctionnalités d’affinage et éléments de facturation, le token du modèle n’étant qu’une partie du coût total ; la base de connaissances, l’analyse, le réarrangement, les outils, l’exécution de code et d’autres services cloud doivent être comptabilisés séparément.
  • Les quotas gratuits, les événements et le modèle Latest peuvent changer ;
  • L’agent peut générer des hallucinations, des appels d’outils erronés et des parcours imprévisibles ;
  • Les flux de travail peuvent également cesser de fonctionner en raison de mises à jour de nœuds, d’interfaces ou de modèles ;
  • Les applications de production doivent disposer d’une version fixe, de tests d’évaluation, de validation manuelle, d’audits de sécurité et de possibilité de rollback ;

Questions fréquentes

Est-ce que Alibaba Cloud BaiLian est gratuit ?

Il est possible d’obtenir une quantité gratuite de modèles répondant aux critères ainsi que des offres d’essai, mais l’utilisation des modèles en mode permanent, la base de connaissances et les ressources cloud sont facturées au forfait ; la quantité gratuite a généralement une durée de validité de 90 jours.

Combien coûte le Qianwen 3.7 Max ?

Actuellement, le prix de référence pour la version fixe dans la région de Pékin est de 12 yuans pour l’entrée et 36 yuans par million de tokens pour la sortie ; les prix varient en fonction du modèle spécifique, du nombre de tokens dans le contexte d’entrée/sortie, du batch et du cache.

Combien coûte la base de connaissances Bai Lian ?

La version standard coûte 0,03 yuan par heure, la version phare à partir de 0,2 yuan par heure ; il faut en plus prendre en compte les frais réels liés à l’analyse, aux vecteurs, à la recherche, au réarrangement et à l’appel des grands modèles.

Est-ce que cela prend en charge l’SDK OpenAI ?

Soutien. Il est possible d’utiliser le SDK multilingue d’OpenAI pour appeler des interfaces compatibles, ou bien les SDK officiels DashScope en Python et Java.

Peut-on déployer Bai Lian en mode privé ?

Bailian est une plateforme hébergée par Alibaba Cloud, elle n’est pas équivalente à un logiciel open source auto-hébergé. Pour les besoins liés aux clouds exclusifs ou hybrides des entreprises, il est nécessaire de consulter les solutions d’Alibaba Cloud et d’évaluer en combinant PAI, le cloud privé et le déploiement de modèles locaux.

Aliyun Bai Lian est-il open source ?

La plateforme elle-même n’est pas open source ; certains modèles Qwen, le SDK DashScope et les outils le sont, mais les licences doivent être consultées séparément et ne représentent pas l’ensemble des services de la plateforme.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outil similaire à Bai Lian d’Ali Cloud