Arche volcanique
Plateforme de services et de développement de grands modèles d’entreprise lancée par Volcano Engine
Étiquettes :Modèle d’entraînement d’IAQu’est-ce que l’Arche volcanique ?
Arche Volcanique est une plateforme intégrée de services et de développement pour les grands modèles fournie par Volcano Engine, destinée aux entreprises et aux développeurs. Elle offre des fonctionnalités telles que l’expérience avec les modèles, les appels API, l’évaluation, le fin-tuning, le déploiement pour l’inference ainsi que l’amélioration des applications. La plateforme repose sur le modèle DouBao comme noyau central, tout en intégrant également les modèles les plus répandus du secteur, couvrant des tâches telles que la génération de texte, la réflexion approfondie, la compréhension visuelle, le traitement du langage parlé, les images, les vidéos, le 3D et la vectorisation.
Ce n’est pas l’application Doubao conçue pour les conversations avec des utilisateurs ordinaires, ni un modèle unique. Les développeurs choisissent un modèle dans la console Ark, créent une clé API ou un point d’accès à l’inference, puis l’intègrent dans leurs systèmes de service client, de production de contenu, de recherche, de bureautique et d’agents via des SDK, des API HTTP, une CLI ou des composants d’application.
Fonctionnalités clés
1. Place du modèle et centre d’expérience
La place des modèles sert à consulter les capacités de la série DouBao ainsi que celles des modèles d’autres fournisseurs, le contexte, les types d’entrée, les appels d’outils et les prix. Le centre d’expérimentation permet de tester directement des prompts, du texte et des entrées multimodales dans la console, puis de comparer les sorties des modèles avant de décider s’y connecter ou non.
Les noms des modèles sont similaires, mais leurs versions, capacités et modes de facturation peuvent varier. Lors du choix, il convient de vérifier l’ID du modèle, la date de publication, la longueur du contexte, sa compatibilité avec la réflexion approfondie, les fonctionnalités visuelles, les appels de fonctions et les sorties structurées, ainsi que de prendre connaissance des annonces concernant la mise hors service du modèle.
2. API Chat et Responses
Arche propose des APIs de dialogue Chat API et Responses API, prenant en charge une sortie en flux continu ou non, plusieurs tours de messages, des prompts système, des appels d’outils, des paramètres de raisonnement et l’entrée de fichiers. Le style des interfaces est similaire à celui des APIs des grands modèles actuels, ce qui facilite leur intégration dans les applications Web, les serveurs et les frameworks d’agents.
Les requêtes API nécessitent que les clés soient stockées du côté serveur, et que les droits d’accès soient contrôlés via IAM, les projets et les quotas. Les pages web frontales ou les applications mobiles ne doivent pas intégrer directement des clés API à long terme, car elles pourraient être extraites et entraîner des frais de fraude.
3. Raisonnement approfondi, modèles de texte et de code
Le modèle universel DouBao propose des versions Pro, Lite, Mini, etc., avec différents niveaux de capacités et de coûts, couvrant le raisonnement complexe, les textes longs, l’extraction d’informations, l’écriture et les tâches d’agent ; le modèle Code est optimisé pour la compréhension du code, sa génération et le coding agentic.
La plateforme propose également des options d’abonnement telles que Agent Plan et Coding Plan, adaptées aux CLI et aux outils de codage.
Les classements de modèles et les démonstrations ne peuvent pas remplacer l’évaluation des performances en conditions réelles. Les entreprises doivent utiliser leurs propres termes techniques en chinois, des contextes longs, des sorties structurées, des appels d’outils et des tests avec des échantillons sécurisés, tout en enregistrant séparément le taux de précision, le délai et le coût par transaction.
4. Images, vidéos, voix et génération 3D
Arche propose des API pour la génération et l’édition d’images, la création de vidéos, des modèles liés à la voix ainsi que la génération d’actifs 3D. Les développeurs peuvent soumettre du texte, des images, des frames de début et de fin ou d’autres conditions, demander de manière asynchrone la génération d’une tâche, et enregistrer les résultats une fois celle-ci terminée.
Les modèles multimédias sont généralement facturés en fonction des images, de la durée vidéo, des tokens, des caractères ou de spécifications précises, et la résolution, la durée ainsi que la présence ou l’absence d’entrée vidéo influencent le coût. La création de contenu nécessite également une vérification des droits d’auteur, des droits de portrait, des marques déposées, des autorisations sonores et des exigences relatives à l’identité de la plateforme.
5. Compréhension des vidéos et des images
Les modèles visuels peuvent comprendre le texte, les objets, les scènes, les tableaux et les relations dans les images, les vidéos et les PDF, et sont utilisés pour les questions-réponses sur les documents, le contrôle de qualité, la modération du contenu et la localisation visuelle. L’API File permet de télécharger et de prétraiter d’abord des vidéos, des images ou des PDF de grande taille, avant de les mentionner dans la demande du modèle.
Les modèles visuels peuvent manquer de détecter les textes en petite taille, les légendes et les cadres clés, et il peut y avoir des erreurs de localisation des coordonnées. Les images médicales, les défauts industriels et les audits de sécurité ne peuvent pas se fier uniquement à des modèles multimodaux généraux ; il convient d’utiliser des données spécialisées et une vérification manuelle.
6. Incorporation et vectorisation
Les modèles de vecteurs textuels et multimodaux peuvent encoder du texte, des images et d’autres contenus en vecteurs, afin d’utiliser ces derniers pour la recherche sémantique, les recommandations, le clustering et les bases de connaissances RAG. L’API de segmentation peut estimer le nombre de tokens avant l’appel, ce qui aide à contrôler le contexte et le budget.
Les espaces vectoriels générés par différents modèles d’Embedding ne sont pas compatibles ; il est nécessaire de reconstruire l’index après avoir changé de modèle. La dimension des vecteurs, la taille des lots, la normalisation et les algorithmes de distance doivent également correspondre à la configuration de la base de données vectorielle.
7. Évaluation du modèle
La plateforme prend en charge des ensembles d’évaluation prédéfinis et des ensembles de données utilisateur, et il est possible de lancer des évaluations depuis le marché des modèles, le entrepôt de modèles, les tâches de fine-tuning ou les services de la plateforme d’apprentissage automatique. Le mode d’inference peut être choisi entre inference en ligne ou inference par lots ; les résultats des évaluations servent à comparer les modèles et leurs versions affinées.
L’inférence en ligne convient aux tâches en temps réel à petite échelle, tandis que l’inférence par lots utilise des ressources hors période de pointe pour traiter des grands ensembles de données où des délais tolérables sont acceptables. L’évaluation doit prendre en compte à la fois la qualité, la fiabilité factuelle, la sécurité, les délais, la stabilité et les coûts, afin d’éviter de se baser uniquement sur un seul indicateur automatique pour tirer des conclusions.
8. Ajustement fin des modèles SFT et DPO
Arche Volcanique offre le fine-tuning supervisé SFT et l’optimisation des préférences directe DPO : les utilisateurs téléchargent des ensembles de données conformes au format, configurent le modèle de base et les paramètres d’entraînement pour générer un modèle affiné, qui peut ensuite être déployé en tant que service de raisonnement en ligne. Il convient pour un format de sortie fixe, des langages sectoriels, des styles de rôle et l’amélioration de tâches spécifiques.
Le ajustement fin ne revient pas à injecter des connaissances en temps réel, et il ne peut pas remplacer RAG. Les données d’entraînement doivent être dédoublées, masquées, autorisées et divisées en ensemble de validation ;
Des échantillons erronés ou biaisés seront appris par le modèle.
Les ressources pour l’entraînement, l’évaluation et le déploiement peuvent engendrer des frais respectifs.
9. Solution optimale rapide
PromptOptimal offre des capacités de génération, d’optimisation et de gestion de prompts, permettant d’étendre des exigences simples en instructions système plus structurées, grâce à des exemples et à des itérations d’évaluation. Les équipes peuvent enregistrer les versions de leurs prompts, réduisant ainsi les essais et erreurs répétitifs pour chaque projet.
L’optimisation automatique peut modifier les contraintes ou ajouter du redondant ; avant le déploiement officiel, il faut vérifier les rôles, les interdictions, la structure JSON de sortie, les cas limites et la protection contre les injections, ainsi que définir une version réversible.
10. Base de connaissances et RAG
Les plugins de base de connaissances permettent d’importer des données depuis des sources locales, du stockage d’objets, des liens de téléchargement publics ou des documents Feishu, en prenant en charge des formats tels que PDF, DOC, DOCX, PPTX, Markdown, TXT, tableaux FAQ, JSONL, CSV et XLSX. Une fois la analyse, le découpage, la vectorisation et l’indexation effectués par le système, il est possible de rechercher les connaissances internes lors des appels aux outils de modèles.
La base de connaissances de Volcano Engine prend également en charge la recherche mixte sémantique et par mots-clés, le réarrangement, le filtrage scalaire, la modification des tronçons, le suivi des références et l’assemblage texte-image. Les extraits de recherche sont utilisés comme entrée pour le modèle et consomment des tokens supplémentaires.
Les scans, les formulaires et les images doivent encore faire l’objet d’un contrôle aléatoire pour vérifier la qualité de la reconnaissance.
11. Recherche en ligne et plugin de traitement d’images
La recherche sur le Web permet au modèle d’obtenir des informations en temps réel sur Internet, les outils de traitement d’images aident au recadrage, à la reconnaissance ou à la compréhension, tandis que l’assistant DouBao regroupe des fonctionnalités couramment utilisées. Les plugins connectés sont facturés en fonction du nombre d’appels aux sources de contenu et peuvent augmenter le nombre de tokens du modèle.
Le service Pro peut également comporter des frais minimaux de consommation et des frais d’extension.
Les résultats de recherche peuvent être obsolètes, erronés ou soumis à des restrictions de droits d’auteur. L’application doit indiquer la source et la date, et gérer les cas sans résultat ainsi que les informations conflictuelles ; dans les domaines médical, financier et juridique, les résultats générés en ligne ne peuvent pas être utilisés directement comme recommandations finales.
12. Appel de fonction et MCP
L’appel de fonction permet au modèle de sélectionner et de remplir les paramètres des fonctions métier selon un schéma prédéfini, afin de consulter des commandes, d’appeler une base de données ou d’exécuter des opérations. Ark prend également en charge le déploiement cloud MCP et Remote MCP, permettant d’intégrer des outils externes dans les processus d’Agent.
Les paramètres de fonction générés par le modèle ne sont pas fiables ; le serveur doit vérifier le type, la plage, l’identité et les permissions. Les opérations à haut risque telles que la suppression, le paiement ou l’envoi nécessitent une confirmation supplémentaire. Le service MCP doit limiter l’accès au réseau et aux clés, ainsi que prévenir l’injection de prompts.
13. Raisonnement par lots et mémoire de contexte
L’inférence en lot convient à l’étiquetage des données, à la rédaction d’extraits hors ligne, à l’évaluation et au traitement de contenu, en améliorant le débit et en réduisant les coûts grâce à des tâches asynchrones. Le cache de contexte permet de réutiliser des prompts système fixes, des documents longs ou des préfixes communs, afin de diminuer les calculs répétitifs et les coûts d’entrée.
La mémoire cache a une durée de validité et des règles de succès ; le contenu dynamique ou les données sensibles des utilisateurs ne doivent pas être réutilisés entre différents locataires. Les tâches en batch nécessitent un traitement des tentatives échouées, un alignement des résultats, une annulation de tâches, ainsi qu’une durée de conservation des données et des plafonds de coût.
14. Stabilité et répartition des coûts
La plateforme offre des statistiques d’utilisation, un partage des coûts par projet, une gestion du débit limité, une optimisation du trafic soudain et des points d’accès de raisonnement personnalisés. La console permet de consulter les entrées, les sorties et le nombre total de tokens en fonction du raisonnement en ligne, expérimental ou en lot, ce qui facilite le calcul des coûts selon les besoins métier.
Les applications de production doivent disposer de délais d’attente, d’un recul exponentiel, de files d’attente concurrentes, de mécanismes de coupure et de modèles de secours, et surveiller le TPM, le RPM, le taux d’erreurs ainsi que le solde. La limitation par défaut ne garantit pas la capacité de gestion des pics de charge ; il est donc nécessaire de réaliser des tests de charge à l’avance et de demander une augmentation des ressources.
Prix et facturation
| Forfait ou version | Prix, plafonds et avantages clés |
|---|---|
| Pro | La page des événements du Nouvel An 2026 présentait également des offres telles que le pack de ressources DouBao 2.0 pour 19 yuans équivalant à environ 8 millions de tokens, 100 yuans pour les nouveaux clients équivalant à environ 40 millions de tokens, ainsi que CodingPlanPro à 200 yuans par mois. Cependant, certaines produits sont indiqués comme indisponibles temporairement et ne peuvent donc pas servir de prix standard à long terme. |
| Lite | Ce prix ne concerne que le modèle affiché sur la page et n’est pas applicable aux modèles Lite, Mini, Code, visuel, anciennes versions ou de tiers. |
L’Arche volcanique est facturée en fonction du modèle spécifique et des capacités correspondantes. Les modèles de texte distinguent généralement les tokens d’entrée et de sortie, tandis que les images, vidéos, sons, 3D, embeddings, bases de connaissances, fine-tuning, traitements par lots et plugins ont chacun leurs propres règles.
La plateforme ne propose pas de frais mensuels fixes uniques couvrant toutes les fonctionnalités.
À la date de cette vérification, le prix de référence du dernier modèle phare DouBao affiché sur la page d’accueil du site officiel de Volcano Engine est de 6 yuans par million de tokens pour l’entrée et de 30 yuans par million de tokens pour la sortie. Ce prix ne concerne que le modèle présenté sur la page et n’est pas applicable aux modèles Lite, Mini, Code, visuels, aux versions anciennes ou aux modèles tiers.
La page des événements du Nouvel An 2026 présentait également des offres telles que le pack de ressources DouBao 2.0 pour 19 yuans équivalant à environ 8 millions de tokens, 100 yuans pour les nouveaux clients équivalant à environ 40 millions de tokens, ainsi que le Coding Plan Pro à 200 yuans par mois. Cependant, certaines offres indiquent qu’elles ne peuvent pas être achetées pour le moment et ne constituent donc pas des prix standards à long terme. Les entreprises doivent se référer à la page des prix des services de modèles, à la page d’activation de la console et aux commandes passées.
Les plugins, la recherche de connaissances et les outils à plusieurs tours augmentent le nombre de tokens supplémentaires ainsi que le nombre d’appels. Avant utilisation, il convient d’estimer l’ensemble du flux métier, plutôt que de simplement multiplier le prix unitaire du modèle principal ;
Les forfaits de ressources prépayés, les crédits gratuits, les remises par volume, les remises de cache et les plans d’économie ont également une durée de validité ainsi que des limites liées aux modèles applicables.
SDK, CLI et GitHub
Arche propose des SDK pour Python, Java, Go et d’autres langages, un API Explorer ainsi que l’Ark CLI. Le runtime Python prend en charge les appels synchrones, asynchrones et en flux, tandis que le SDK universel de Volcano Engine offre également AK/SK, STS, des rôles, des délais d’attente, des tentatives de réessai et des paramètres de proxy.
Volcano Engine a rendu publics sur GitHub des SDK en Python, Java, etc., ainsi que des kits de développement d’agents tels qu’AgentKit et VEA DK, certains étant soumis à la licence Apache 2.0. Le fait que les SDK soient open source ne signifie pas que la plateforme Volcano Ark, les poids des modèles Doubao ou les services de traitement dédiés le soient également.
Les modèles de base et les plateformes cloud restent des services commerciaux propriétaires.
Sécurité des données et conformité
Arche fournit des droits de projet IAM, des clés d’accès, des journaux, des quotas et des solutions de confiance mutuelle en matière de sécurité. Certaines spécifications de services en ligne personnalisés indiquent que les journaux des demandes ne sont visibles ni par le fournisseur du modèle ni par la plateforme, mais la manière concrète de traiter les données dépend toujours du modèle choisi, des protocoles du produit et de l’autorisation active d’utiliser les données.
Les accords de plateforme peuvent inclure des autorisations relatives aux données des clients, les zones géographiques de prestation des services et les conditions d’utilisation commerciale. Avant de télécharger des ensembles d’entraînement, des bases de connaissances, des vidéos ou des visages, les entreprises doivent vérifier les informations personnelles, les droits d’auteur, les accords de confidentialité, les exigences relatives à l’exportation des données et les réglementations sectorielles.
Les applications d’IA générative en ligne peuvent également nécessiter une enregistrement des algorithmes, une identification du contenu et une évaluation de la sécurité.
Guide d'utilisation de l’Arche volcanique
Terminer une tâche de base
- Inscrivez-vous à Arche Volcanique et créez une clé API réservée uniquement à l’environnement de test ;
- Sélectionner le modèle en fonction du type d’entrée, du contexte, de la qualité, de la vitesse et du prix ;
- Appeler d’abord la place du modèle et le centre d’expérience pour effectuer la requête minimale et vérifier la structure de réponse ;
- Testez ensuite la sortie en flux, les paramètres et les réponses en cas d’erreur à l’aide de l’API Chat et Responses ;
- Enregistrer les tokens, le nombre d’appels, le délai, le taux d’erreurs et le coût par appel ;
- Transférez la clé dans le gestionnaire de clés du serveur avant de l’intégrer à l’application officielle ;
Créer des flux de travail professionnels réutilisables
- Utiliser des clés et des quotas différents pour les environnements de développement, de test et de production ;
- Créer des ensembles d’évaluation représentatifs en fonction de la place du modèle et du centre d’expérience, des API Chat et Responses ainsi que du raisonnement avancé, et des modèles de texte et de code ;
- Définir les délais d’attente, la concurrence, les tentatives de réessai, le throttling et les plafonds budgétaires ;
- Effectuer des vérifications sur la sortie en ce qui concerne les faits, la sécurité, le format et les informations sensibles ;
- Surveiller les changements de version, de prix, de délai et de taux d’échec des modèles de surveillance ;
- Préparer des plans de dégradation du modèle, de coupure et de prise en main manuelle ;
À qui s’adresse-t-il ?
- Développeurs qui ont besoin d’appeler les API des modèles de texte, de raisonnement, de vision et de génération de DouBao ;
- Les entreprises qui souhaitent effectuer le choix du modèle, son évaluation, son ajustement fin et l’inference sur la même plateforme ;
- Équipes pour développer des services clients intelligents, une recherche d’entreprise, ainsi que des systèmes de production et de modération de contenu ;
- Application nécessitant une base de connaissances, des recherches en ligne, des fonctions et des améliorations MCP pour l’agent ;
- Des services à forte concurrence nécessitant un raisonnement en batch, du caching, une limitation du débit et un contrôle des coûts par partage ;
- Organisations ayant besoin de services cloud nationaux, ainsi que de documents contractuels et d’enregistrement.
Avantages du produit
- La série DouBao et divers modèles majeurs sont intégrés en masse ;
- API complètes pour le texte, l’image visuelle, les photos, la vidéo, la voix, le 3D et les vecteurs ;
- Couvre l’expérience utilisateur, les évaluations, le fine-tuning SFT/DPO, ainsi que l’inference en ligne et en batch ;
- Fournir une base de connaissances, un réseau, des appels de fonctions et une chaîne d’outils MCP ;
- Le cache de contexte, les tâches en lot et les modèles à plusieurs niveaux facilitent l’optimisation des coûts ;
- SDK, CLI, IAM, surveillance et conformité entreprise bien développés.
Restrictions et précautions
- L’Arche volcanique offre de nombreuses fonctionnalités et ses frais sont dispersés : les coûts liés aux modèles, aux plugins, à la base de connaissances et à la génération de médias doivent être calculés séparément.
- L’efficacité du centre d’expérience ne correspond pas aux SLA de production, et les quotas gratuits ainsi que les prix promotionnels peuvent également expirer.
- Le modèle peut produire des erreurs factuelles, des biais, des erreurs de format ou des appels incorrects d’outils ;
- Les entreprises doivent mettre en place des mécanismes d’évaluation, de sécurité du contenu, de révision manuelle, de contrôle des droits et de rollback, et veiller aux mises à jour des versions des modèles ainsi qu’aux annonces de mise hors service.
Questions fréquentes
L’Arche volcanique, c’est pareil que Dou Bao ?
Ce n’est pas pareil. DouBao est un modèle et une marque d’application orientée utilisateur, tandis que Volcano Ark est une plateforme cloud permettant aux entreprises et aux développeurs d’utiliser DouBao ainsi que d’autres modèles pour des évaluations, des ajustements précis et le déploiement.
L’Arche Volcanique est-elle gratuite ?
La console peut offrir une expérience d’essai ou des crédits pour les nouveaux utilisateurs, mais l’API officielle, les paramétrisations avancées, la base de connaissances et les services de génération sont facturés selon la consommation ou des forfaits de ressources, selon les conditions indiquées sur la page de mise en service du modèle.
Combien coûte l’API Arche Volcanique ?
Les prix varient selon les modèles. Pour le modèle phare présenté actuellement sur le site officiel, le coût est de 6 yuans pour l’entrée et de 30 yuans par million de tokens pour la sortie ;
Pour Lite, Mini, Visual, Vidéo et les plugins, veuillez consulter leurs prix respectifs.
Prend-il en charge des interfaces compatibles OpenAI ?
La manière d’appeler les dialogues lors du fonctionnement de l’Arche est similaire aux interfaces de chat courantes, et elle offre Chat, Responses ainsi qu’un SDK officiel ; lors du transfert, il faut encore vérifier l’URL de base, l’ID du modèle, les paramètres et le format des outils.
Peut-on affiner le modèle ?
Oui, il prend en charge SFT et DPO, et permet d’évaluer et de déployer des modèles finement ajustés. Les données d’entraînement, le calcul d’entraînement et les services en ligne peuvent être facturés séparément.
Arca Volcanique est-elle open source ?
La plateforme et le modèle Doubao ne sont pas open source ; l’éditeur a publié sur GitHub des SDK multilingues ainsi que certains kits de développement d’Agents, mais la licence du SDK ne peut être assimilée à la licence du modèle ou des services cloud.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164