Vulkanarche
Die von Volcano Engine angebotenen Dienste für große Unternehmensmodelle sowie die Entwicklungsplattformen
Tags:KI-TrainingsmodelleWas ist das Vulkanaufgebot?
Volcano Ark ist eine umfassende Service- und Entwicklungsplattform für große KI-Modelle, die von Volcano Engine bereitgestellt wird. Sie bietet Unternehmen und Entwicklern Möglichkeiten zur Nutzung von Modellen, zum Aufrufen von APIs, zur Bewertung, Anpassung sowie zum Einsatz der Modelle in Anwendungen. Die Plattform basiert auf dem Doubao-Modell und integriert zugleich gängige Modelle aus der Branche. Sie ermöglicht die Erstellung von Texten, tiefgehende Analysen, das Verständnis visueller Inhalte, die Verarbeitung von Sprache, Bildern, Videos sowie 3D-Daten – also eine Vielzahl von Aufgaben.
Es handelt sich weder um die für den Alltagsgebrauch konzipierte Chat-App DouBao noch um ein einzelnes Modell. Entwickler wählen in der Ark-Konsole ein Modell aus, erstellen eine API-Schlüssel oder einen Inferenz-Endpunkt und integrieren dieses anschließend über SDKs, HTTP-APIs, CLI oder Anwendungskomponenten in ihre eigenen Systeme für Kundenservice, Inhaltsproduktion, Suchfunktionen, Büroaufgaben sowie Agenten.
Kernfunktionen
1. Modellplatz und Erlebniszentrum
Der Modell-Platz dient dazu, die Fähigkeiten der BeanBao-Serie sowie der Modelle anderer Anbieter, den Kontext, die Eingabetypen, die Aufrufe von Tools und die Preise zu überprüfen. Im Erlebniszentrum können Prompte, Texte sowie multimodale Eingaben direkt in der Konsole getestet werden. Nach dem Vergleich der Ausgaben der Modelle kann entschieden werden, ob sie genutzt werden sollen.
Die Namen der Modelle ähneln sich, doch die Versionen, Fähigkeiten und Abrechnungsmodalitäten können unterschiedlich sein. Bei der Auswahl sollte man den Modell-ID, das Veröffentlichungsdatum, die Länge des Kontexts, die Unterstützung für tiefes Denken, visuelle Funktionen, Funktionsaufrufe sowie strukturierte Ausgaben überprüfen und auf Ankündigungen zur Einstellung des Modells achten.
2. Chat- und Responses-API
Ark bietet die Chat-API und die Responses-API an, die eine fließende sowie nicht-fließende Ausgabe, mehrfache Nachrichtenaustausche, Systemhinweise, Aufrufe von Tools, Inferenzparameter sowie Dateieingaben unterstützen. Der API-Stil ähnelt dem der gängigen großen Modell-APIs, was eine einfache Integration in Webanwendungen, Server-Systeme und Agent-Frameworks ermöglicht.
API-Anfragen erfordern, dass Schlüssel auf der Serverseite gespeichert werden und die Berechtigungen über IAM, Projekte und Quoten gesteuert werden. Frontend-Webseiten oder Mobile Apps sollten keine dauerhaften API-Schlüssel direkt enthalten, da diese sonst leicht entwendet werden können und zu unbefugten Gebühren führen.
3. Tiefgehende Schlussfolgerungen, Text- und Codemodelle
Das allgemeine DouBao-Modell bietet verschiedene Leistungs- und Kostenstufen wie Pro, Lite, Mini usw., die komplexe Schlussfolgerungen, lange Texte, Informationsextraktion, Schreiben sowie Agentenaufgaben abdecken; das Code-Modell ist auf das Verständnis, die Erstellung von Code sowie agiles Programmieren optimiert.
Die Plattform bietet außerdem Abonnementmöglichkeiten wie den Agent Plan und den Coding Plan, die für CLI-Tools sowie Programmierwerkzeuge geeignet sind.
Model-Listen und Demonstrationen können keine Ersatz für Geschäftsbeurteilungen sein. Unternehmen sollten ihre eigenen fachlichen Begriffe in Chinesisch, lange Kontexte, strukturierte Ausgaben, Aufrufe von Tools sowie Sicherheitstests mit Beispielen verwenden und dabei die Genauigkeit, die Verzögerung sowie die Kosten pro Vorgang separat dokumentieren.
4. Bilder, Videos, Audiodateien und 3D-Generierung
Ark bietet APIs für die Erstellung und Bearbeitung von Bildern, die Erstellung von Videos, Modelle für Sprachverarbeitung sowie die Erstellung von 3D-Assets. Entwickler können Texte, Bilder, Anfangs- und Endframes oder andere Bedingungen einreichen, asynchrone Abfragen zur Erstellung von Inhalten senden und die Ergebnisse nach Abschluss speichern.
Multimediamodelle werden in der Regel nach Anzahl der Bilder, Länge der Videos, Tokens, Zeichen oder spezifischen Spezifikationen abgerechnet. Außerdem beeinflussen die Auflösung, die Länge sowie die Angabe, ob ein Videoinhalt enthalten ist, die Kosten. Bei der Erstellung von Inhalten müssen zudem Urheberrechte, Persönlichkeitsrechte, Markenrechte, Lizenzen für Tonaufnahmen sowie Anforderungen bezüglich der Plattformidentifikation geprüft werden.
5. Verständnis von Videos und Bildern
Visuelle Modelle können Texte, Objekte, Szenen, Tabellen und Beziehungen in Bildern, Videos und PDF-Dateien verstehen. Sie werden zur Beantwortung von Fragen zu Dokumenten, zur Qualitätskontrolle, zur Überprüfung von Inhalten sowie zur visuellen Lokalisierung eingesetzt. Die File API ermöglicht es, größere Videos, Bilder oder PDF-Dateien zunächst hochzuladen und vorzuverarbeiten, bevor sie in den Anfragen an das Modell verwendet werden.
Visuelle Modelle können kleine Schriftzeichen, Legenden und Schlüsselframes übersehen, und es können auch Fehler bei der Koordinatenbestimmung auftreten. Bei medizinischen Bildern, industriellen Defekten sowie Sicherheitsprüfungen darf man sich nicht ausschließlich auf allgemeine multimodale Modelle verlassen – stattdessen sollten spezialisierte Daten sowie menschliche Überprüfungen genutzt werden.
6. Einbetten und Vektorisierung
Text- und multimodale Vektormodelle können Texte, Bilder usw. in Vektoren kodieren, die für semantische Suche, Empfehlungen, Clustering sowie RAG-Wissensdatenbanken verwendet werden. Die Tokenisierungs-API kann vor dem Aufruf die Anzahl der Tokens schätzen, um Kontext und Ressourcenverbrauch zu steuern.
Die Vektorräume, die von verschiedenen Embedding-Modellen erzeugt werden, sind nicht kompatibel. Nach dem Wechsel des Modells muss der Index neu erstellt werden. Auch die Dimension des Vektors, die Größe der Batchs, die Normalisierung sowie die Distanzalgorithmen müssen mit der Konfiguration der Vektordatenbank übereinstimmen.
7. Modellbewertung
Die Plattform unterstützt vorgefertigte Bewertungssätze sowie Benutzerdatensätze. Die Bewertungen können über den Modellmarkt, das Modellarchiv, Optimierungsaufgaben oder die Dienste der Machine-Learning-Plattform durchgeführt werden. Als Inferenzmethode kann entweder Online-Inferenz oder Batch-Inferenz gewählt werden. Die Ergebnisse der Bewertungen dienen dazu, Modelle mit ihren optimierten Versionen zu vergleichen.
Online-Reasoning eignet sich für Echtzeit-Aufgaben in kleinem Umfang, während Batch-Reasoning Ressourcen außerhalb der Spitzenzeiten nutzt, um große Datensätze mit tolerierbaren Verzögerungen zu verarbeiten. Die Bewertung sollte Qualität, Faktengenauigkeit, Sicherheit, Verzögerung, Stabilität und Kosten umfassen, um nicht allein auf einem einzigen automatisierten Indikator zu basieren.
8. Feinabstimmung der SFT- und DPO-Modelle
Volcano Ark bietet überwachtes Feintuning von SFT sowie direktes Präferenzoptimieren mit DPO. Der Benutzer lädt datenbankkonforme Datensätze hoch, konfiguriert das Grundmodell und die Trainingsparameter, um so ein feinabgestimmtes Modell zu erzeugen, das als Online-Inferenzdienst eingesetzt werden kann. Es eignet sich zur Optimierung fester Ausgabeformate, Branchensprachen, Rollenstile sowie spezifischer Aufgaben.
Präzise Anpassung bedeutet nicht das Einbringen von Echtzeitwissen und kann RAG auch nicht ersetzen. Die Trainingsdaten müssen dupliziert werden, anonymisiert, autorisiert sowie in eine Validierungsgruppe aufgeteilt werden;
Fehlerhafte oder voreingenommene Beispiele werden vom Modell gelernt.
Für Training, Bewertung und Bereitstellung von Ressourcen können jeweils Kosten anfallen.
9. Optimale Prompt-Lösung
Prompt-Optimierung bietet Funktionen zur Erstellung, Anpassung und Verwaltung von Prompt-Befehlen, um kurze Anforderungen in strukturiertere Systemanweisungen zu entwickeln, und dies durch Beispiele sowie iterative Bewertungen. Das Team kann Versionen der Prompts speichern, um wiederholtes Ausprobieren bei jedem Projekt zu reduzieren.
Automatische Optimierungen können Einschränkungen ändern oder Redundanzen hinzufügen. Vor der offiziellen Veröffentlichung müssen Rollen, Verbote, die JSON-Ausgabestruktur, Grenzsituationen sowie Schutzmaßnahmen gegen Injection-Angriffe überprüft werden, und eine zurückrollbare Version festgelegt werden.
10. Wissensdatenbanken und RAG
Der Wissensdatenbank-Plugin kann Daten aus lokalen Quellen, Objektspeichern, öffentlichen Download-Links oder Lark-Dokumenten importieren. Es unterstützt Formate wie PDF, DOC, DOCX, PPTX, Markdown, TXT, FAQ-Tabellen, JSONL, CSV und XLSX. Nachdem das System die Daten analysiert, in Teile aufgeteilt, vektorisiert und indiziert hat, kann es auf private Wissensinhalte in Modellwerkzeugen zugegriffen werden.
Die Wissensdatenbank von Volcano Engine unterstützt außerdem eine Kombination aus semantischer und schlagwortbasierter Suche, Umordnung, skalare Filterung, Änderung von Ausschnitten, Rückverfolgung von Referenzen sowie die Mischung von Text und Bildern. Suchergebnisse werden als Eingabe für das Modell verwendet und verbrauchen zusätzliche Tokens.
Scans, Tabellen und Bilder müssen weiterhin stichprobenartig auf die Qualität der Analyse überprüft werden.
11. Vernetzte Suchfunktionen und Bildverarbeitungspakete
Die Web-Suche ermöglicht es dem Modell, aktuelle Internetinformationen abzurufen. Tools zur Bildverarbeitung helfen bei der Bearbeitung, Erkennung oder Interpretation von Bildern. Das Doubao-Assistenten-Tool bündelt gängige Funktionen. Vernetzte Erweiterungen werden nach der Anzahl der Aufrufe der Inhaltsquellen abgerechnet und können außerdem die Anzahl der Modell-Tokens erhöhen.
Bei dem Pro-Service können außerdem Mindestverbrauchsgebühren sowie Kosten für eine Erweiterung der Kapazitäten anfallen.
Die Suchergebnisse können veraltet, fehlerhaft oder urheberrechtlich geschützt sein. Die Anwendung sollte die Quelle sowie das Datum anzeigen und mit Informationen zu keinem Ergebnis sowie zu Konflikten umgehen. In medizinischen, finanziellen oder rechtlichen Situationen dürfen Ergebnisse, die über das Internet erzeugt werden, nicht direkt als endgültige Empfehlungen herangezogen werden.
12. Funktionsaufrufe und MCP
Funktionaufrufe ermöglichen es dem Modell, gemäß einem vordefinierten Schema Parameter von Geschäftsfunktionen auszuwählen und einzugeben, um Bestellungen abzurufen, auf die Datenbank zuzugreifen oder Aktionen auszuführen. ARK unterstützt außerdem die cloudbasierte Implementierung von MCP sowie Remote MCP, um externe Tools in den Agentenprozess einzubinden.
Die Funktionsparameter der Modellausgabe sind nicht zuverlässig; der Server muss Typ, Bereich, Identität und Berechtigungen überprüfen. Hochriskante Operationen wie Löschung, Zahlung oder Versand erfordern eine zweite Bestätigung. Der MCP-Service sollte den Zugriff auf das Netzwerk und die Schlüssel beschränken sowie Angriffe durch Eingabe von Befehlen verhindern.
13. Massenabfolgenlogik und Kontextcaching
Batch-Inferenz eignet sich für die Datenauswertung, das Offline-Zusammenfassen, die Bewertung sowie die Verarbeitung von Inhalten. Durch asynchrone Aufgaben wird die Durchsatzrate erhöht und die Kosten gesenkt. Der Kontext-Cache ermöglicht die Wiederverwendung festgelegter Systemanweisungen, langer Dokumente oder gemeinsamer Präfixe, wodurch wiederholte Berechnungen sowie Eingabekosten reduziert werden.
Der Cache hat eine Gültigkeitsdauer sowie Regeln für Treffer. Dynamische Inhalte oder sensible Benutzerdaten sollten nicht zwischen verschiedenen Nutzern wiederverwendet werden. Bei Batch-Aufgaben müssen Fehlversuche erneut versucht werden, die Ausgabe muss angepasst werden, Aufgaben können storniert werden, es gibt Fristen für die Speicherung der Daten sowie Obergrenzen bezüglich der Kosten.
14. Stabilität und Aufteilung der Kosten
Die Plattform bietet Statistiken zur Nutzung, eine Aufteilung der Kosten auf die einzelnen Projekte, eine Verwaltung der Datenflussbegrenzungen, Optimierungen für plötzliche Anstiege des Datenverkehrs sowie eigene Schnittstellen für die Ausführung von Berechnungen. Über die Konsole können Eingaben, Ausgaben sowie die Gesamtanzahl an Tokens nach Art der Verarbeitung – online, in Batch-Modus oder für experimentelle Zwecke – angezeigt werden, was die Kostenerfassung erleichtert.
Produktionsanwendungen sollten Timeout-Einstellungen, exponentielles Backoff, Konkurrenzschlangen, Circuit Breaker sowie Ersatzmodelle bereitstellen und TPM, RPM, Fehlerrate sowie den verfügbaren Speicher überwachen. Die standardmäßigen Limitierungen stellen keine Garantie für die Belastungsspitzen des Unternehmens dar; daher sind Vor-Tests sowie Anfragen zur Erweiterung der Kapazitäten notwendig.
Preise und Abrechnung
| Paket oder Version | Preise, Limits und Kernvorteile |
|---|---|
| Pro | Auf der Seite zu den Neujaahrsevents 2026 wurden außerdem Angebote wie das Resource-Paket „Doubao 2.0“ für 19 Yuan – was etwa 8 Millionen Token entspricht –, ein Angebot für Neukunden für 100 Yuan – was etwa 40 Millionen Token entspricht – sowie CodingPlanPro für 200 Yuan pro Monat gezeigt. Einige dieser Produkte sind jedoch als vorübergehend nicht käuflich gekennzeichnet und können daher nicht als dauerhafte Standardpreise gelten. |
| Lite | Dieser Preis gilt nur für das auf der Seite dargestellte Modell und ist nicht für Lite, Mini, Code, Visual, ältere Versionen oder Drittanbieter-Modelle gültig. |
Die Vulkan-Arche wird je nach konkretem Modell und Funktionalitäten abgerechnet. Textmodelle unterscheiden in der Regel zwischen Eingangs- und Ausgabetokens, während für Bilder, Videos, Sprache, 3D-Daten, Embeddings, Wissensdatenbanken, Feinabstimmungen, Batch-Verarbeitung sowie Plugins jeweils eigene Regeln gelten.
Es gibt keine einzige, feste Monatsgebühr für die Plattform, die alle Funktionen abdeckt.
Stand der Überprüfung zeigt die Startseite der offiziellen Website von Volcano Engine für das neueste Flaggschiff-Modell DouBao einen Referenzpreis von 6 Yuan pro Million Token für die Eingabe und 30 Yuan pro Million Token für die Ausgabe an. Dieser Preis gilt nur für das auf der Seite dargestellte Modell und ist nicht auf Lite-, Mini-, Code-, Visual-Modelle, ältere Versionen oder Drittanbieter-Modelle anwendbar.
Auf der Seite zu den Neujahrsaktionen 2026 wurden außerdem Angebote wie das Paket „Doubao 2.0“ für 19 Yuan – was etwa 8 Millionen Token entspricht –, ein Angebot für neue Kunden für 100 Yuan – was etwa 40 Millionen Token entspricht – sowie der „Coding Plan Pro“ für 200 Yuan pro Monat gezeigt. Einige dieser Produkte sind jedoch als vorübergehend nicht käuflich gekennzeichnet und können daher nicht als dauerhafte Preisangaben herangezogen werden. Unternehmen sollten sich an den Preisen auf der Seite zu den Modellservices, auf der Seite zur Aktivierung des Kontos sowie an den Bestellinformationen orientieren.
Plugins, Wissensabfragen und mehrfache Tools führen zu zusätzlichen Tokens und Aufrufanzahlen. Vor der Verwendung sollte ein vollständiger Geschäftsablauf berechnet werden, anstatt nur den Preis pro Hauptmodell zu verwenden;
Auch Vorauszahlungspakete, kostenlose Kontingente, Mengenrabatte, Cache-Rabatte sowie Sparpläne haben eine Gültigkeitsdauer sowie Einschränkungen hinsichtlich der anwendbaren Modelle.
SDK, CLI und GitHub
Arche bietet SDKs für Python, Java, Go und andere Sprachen, einen API Explorer sowie die Ark CLI. Die Python-Laufzeitumgebung unterstützt synchrones, asynchrones sowie strömungsbasiertes Aufrufen. Das allgemeine Volcano-Engine-SDK stellt zudem AK/SK, STS, Rollen, Timeout-Einstellungen, Wiederholungsmechanismen sowie Proxy-Einstellungen bereit.
Volcano Engine hat auf GitHub SDKs für Python, Java usw. sowie Entwicklungssets für Agenten wie AgentKit und VEA DK veröffentlicht, wobei einige unter der Apache 2.0-Lizenz stehen. Die Offenlegung der SDKs als Open Source bedeutet jedoch nicht, dass die Volcano Ark-Plattform, die Gewichte der Doubao-Modelle sowie die gehosteten Inferenzdienste offen zugänglich sind.
Die Kernmodelle und Cloud-Plattformen bleiben proprietäre Geschäftsdienste.
Daten Sicherheit und Konformität
Arche bietet IAM-Projektrechte, Zugriffsschlüssel, Protokolle, Quoten sowie Lösungen für gegenseitiges Vertrauen in Bezug auf Sicherheit. Laut den Anweisungen für einige benutzerdefinierten Online-Dienste sind die Anfragenprotokolle weder für den Anbieter des Modells noch für die Plattform sichtbar. Die genaue Art der Datenverarbeitung hängt jedoch vom gewählten Modell, den Produktvereinbarungen sowie davon ab, ob die Nutzung der Daten ausdrücklich gestattet wird.
Die Plattformvereinbarungen können Vorgaben zur Genehmigung von Kundendaten, zum Einsatzgebiet der Dienste sowie zu den Bedingungen für den kommerziellen Einsatz enthalten. Bevor Unternehmen Trainingsdatensätze, Wissensdatenbanken, Videos und Gesichtserkennungsinformationen hochladen, sollten sie die persönlichen Daten, Urheberrechte, Vertraulichkeitsvereinbarungen sowie die Anforderungen bezüglich der Datenübermittlung ins Ausland und der branchenspezifischen Regulierungen überprüfen.
Für die Einführung generativer KI-Anwendungen sind möglicherweise auch eine Registrierung der Algorithmen, eine Kennzeichnung des Inhalts sowie eine Sicherheitsbewertung erforderlich.
Anleitung zur Verwendung des Vulkanaufklärers
Eine grundlegende Aufgabe erledigen
- Registrieren Sie das Vulkan-Arche und erstellen Sie einen API-Schlüssel, der ausschließlich für die Testumgebung verwendet wird;
- Wählen Sie das Modell entsprechend der Eingabetypen, des Kontexts, der Qualität, der Geschwindigkeit und des Preises aus;
- Rufen Sie zunächst den Modellplatz und das Erlebniszentrum auf, um die minimale Anfrage durchzuführen und die zurückgegebene Struktur zu überprüfen;
- Testen Sie anschließend die fließende Ausgabe, Parameter und Fehlerantworten mit der Chat- und Responses-API;
- Protokollieren Sie Tokens, Anrufanzahl, Verzögerung, Fehlerrate und Kosten pro Aufruf;
- Tragen Sie den Schlüssel in den Server-basierten Schlüsselmanager ein, bevor Sie die eigentliche Anwendung anschließen;
Erstellung wiederverwendbarer professioneller Workflows
- Für die Entwicklungs-, Test- und Produktionsumgebungen werden unterschiedliche Schlüssel und Limits verwendet;
- Erstellen Sie repräsentative Bewertungssätze für den Modellplatz und das Erlebniszentrum, die Chat- und Responses-API sowie die tiefgehende Inferenz sowie für Text- und Codemodelle.
- Einstellen von Timeout, Konkurrenz, Wiederholungsversuchen, Limitierung sowie Budgetobergrenzen;
- Durchführung von Überprüfungen hinsichtlich Fakten, Sicherheit, Formatierung und sensibler Informationen am Ausgangsinhalt;
- Überwachung von Änderungen bei Modellversionen, Preisen, Verzögerungen und Ausfallraten;
- Vorbereitung von Plänen für die Herabstufung des Modells, Schutzmaßnahmen sowie manuelle Übernahme.
Für welche Nutzer geeignet?
- Entwickler, die die APIs für Textverarbeitung, Inferenz, Visualisierung und Generierung von DouBao aufrufen müssen;
- Unternehmen, die hoffen, die Auswahl, Bewertung, Feinabstimmung und Inferenz auf derselben Plattform durchführen zu können;
- Team zur Entwicklung von intelligenten Kundenservice-Systemen, Unternehmenssuchfunktionen sowie Systemen für die Erstellung und Überprüfung von Inhalten;
- Anwendung von Wissensdatenbanken, vernetztem Suchen sowie Funktionen und MCP zur Verbesserung von Agenten;
- Businesss mit hoher Konkurrenzlast, die Batch-Verarbeitung, Caching, Bandbreitenbegrenzung sowie Kostentransparenz benötigen;
- Organisationen, die Unterstützung in Form von inländischen Cloud-Diensten sowie Vertrags- und Registrierungsunterlagen benötigen.
Vorteile des Produkts
- Die DouBao-Serie sowie verschiedene gängige Modelle werden zentral integriert;
- Vollständige API für Text, Visuals, Bilder, Videos, Sprache, 3D und Vektoren;
- Abdeckung von Erlebnis, Bewertungen, SFT/DPO-Feinabstimmung, Online- und Batch-Inferenz;
- Bietet eine Wissensdatenbank, Vernetzung, Funktionsaufrufe sowie die MCP-Toolkette;
- Context-Caching, Batch-Aufgaben und mehrere Modellversionen erleichtern die Kostensenkung;
- SDK, CLI, IAM, Überwachung und Unternehmenskonformität sind gut ausgestaltet.
Einschränkungen und Hinweise
- Die Funktionen des Vulkan-Arches sind vielfältig und die Gebühren sind in verschiedene Posten aufgeteilt; Kosten für Modelle, Plugins, Wissensdatenbanken sowie Medienerstellung müssen separat erfasst werden.
- Die Leistungen des Erlebniszentrums stellen keine Garantien für die Produktionsbedingungen dar; die kostenlosen Zugriffsrechte sowie die Preise für Aktionen können ebenfalls auslaufen.
- Das Modell kann faktische Fehler, Vorurteile, Formatierungsfehler oder falsche Aufrufe von Tools verursachen;
- Unternehmen müssen Mechanismen für Bewertung, Inhaltssicherheit, manuelle Überprüfung, Berechtigungen sowie Rollback-Einrichtungen einrichten und sich außerdem um die Aktualisierung der Modellversionen sowie die Ankündigungen zu deren Aussetzung kümmern.
Häufige Fragen
Ist das Vulkangleiterboot wie der DouBao?
Es ist nicht dasselbe. DouBao ist eine Marke für Modelle und benutzerorientierte Anwendungen, während Volcano Ark eine Cloud-Plattform ist, über die Unternehmen und Entwickler DouBao sowie andere Modelle nutzen können, um sie zu testen, anzupassen und einzusetzen.
Ist das Vulkan-Arche kostenlos?
Die Konsole kann eine Einführungsversion oder einen Kontingent für neue Nutzer anbieten, doch die offizielle API, die feinabgestimmten Funktionen, die Wissensdatenbank sowie die Erstellungsdienste werden nach Verbrauch oder in Form von Ressourpaketen abgerechnet – genaue Konditionen entnehmen Sie der Seite zur Aktivierung des Modells.
Wie viel kostet die Vulkan-Arche-API?
Die Preise für die verschiedenen Modelle unterscheiden sich. Das Flaggschiff-Modell auf der offiziellen Website kostet derzeit 6 Yuan für die Eingabe und 30 Yuan pro Million Token für die Ausgabe;
Für Lite, Mini, Visual, Video und Plugins müssen die jeweiligen Preise angezeigt werden.
Wird eine OpenAI-kompatible Schnittstelle unterstützt?
Die Art und Weise, wie während des Betriebs der Ark Dialoge ausgelöst werden, ähnelt den gängigen Chat-Schnittstellen. Es stehen Chat-, Responses- sowie offizielle SDKs zur Verfügung. Bei der Migration muss man weiterhin die Base URL, die Modell-ID, die Parameter sowie das Format der Tools überprüfen.
Kann das Modell feinjustiert werden?
Ja, es werden SFT und DPO unterstützt, und es ist möglich, feinabgestimmte Modelle zu bewerten und einzusetzen. Trainingsdaten, die Berechnungen zum Training sowie Online-Dienste können separat berechnet werden.
Ist die Vulkan Ark Open Source?
Sowohl die Plattform als auch das Doubao-Modell selbst sind nicht open source. Die Entwickler haben auf GitHub SDKs für mehrere Sprachen sowie einige Agent-Entwicklungstools veröffentlicht. Die Lizenz für diese SDKs kann jedoch nicht mit der Lizenz für die Modelle oder Cloud-Dienste gleichgesetzt werden.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164