Aliyun Bai Lian
Kostenloser Mehrwert
KI-Agenten AI Agent

Aliyun Bai Lian

Modellaufrufe für Unternehmen, Anwendungsentwicklung und Agentenplattformen

Tags:

Was ist Alibaba Cloud Bai Lian?

Alibaba Cloud Model Studio, der englische Name von Aliyun Bailian, ist eine Plattform von Alibaba Cloud, die eine umfassende Lösung für die Entwicklung großer KI-Modelle sowie die Erstellung von AI-Anwendungen bietet. Entwickler können in einer einzigen Konsole Modelle von Tongyi Qianwen sowie Drittanbieter-Modelle auswählen, API-Schlüssel erhalten, Prompte testen, Wissensdatenbanken erstellen, Agenten und Workflows konfigurieren und ihre Anwendungen auf eigenen Webseiten, mobilen Geräten sowie Geschäfts-systemen veröffentlichen.

Bailian ist weder die Chats-App Qianwen für normale Nutzer noch ein einzelnes Modell. Tongyi Qianwen ist eine von Alibaba Cloud selbst entwickelte Modellfamilie, während Bailian eine Cloud-Plattform bietet, die Modellaufrufe, RAG, Agenten, Tools, Optimierung, Bewertung, Überwachung sowie Unternehmensführung ermöglicht.

Modellservice

1. Tongyi Qianwen-Text- und Inferenzmodell

Die Plattform bietet verschiedene Versionen wie Max, Plus, Flash usw., sowie Modelle für Code, Mathematik, Übersetzung, lange Texte und tiefgehende Schlussfolgerungen. Die Nutzer können je nach Qualität, Kontext, Verzögerung und Preis zwischen einer festen Version oder dem Alias „Latest“ wählen.

„Latest“ passt sich mit den verbesserten Modellfähigkeiten der Plattform an und eignet sich zur schnellen Erzielung neuer Ergebnisse, doch die Ausgabe kann sich ändern; Produktionsysteme sollten stattdessen eine feste Version bevorzugen und Regressionstests durchführen, wobei auf Ankündigungen bezüglich des Ausschaltens und der Migration des Modells geachtet werden sollte.

2. Multimodale und generative Modelle

Bailian umfasst Modelle für visuelle Verarbeitung, Bilderzeugung und -bearbeitung, Videogenerierung, Spracherkennung, Sprachsynthese, Echtzeit-Audio- und Videodaten, Embedding sowie Reranking. Die Anwendung kann Texte, Bilder, Audiodateien, Videos und Dokumente verarbeiten und verschiedene Modelle kombinieren, um Anwendungen wie Podcasts, visuelle Fragen-und-Antwort-Systeme sowie digitale Avatare zu erstellen.

Die Abrechnungseinheit bei multimodalen Modellen kann Tokens, Sekunden, Zeichen, Bild- oder Videoauflösungen sein. Auflösung, Dauer, Konkurrenz und ob das Nachdenken aktiviert ist, beeinflussen die Kosten – man kann nicht alle Aufgaben mit den Preisen von Textmodellen schätzen.

3. Drittanbieter-Modelle

Neben Qianwen bietet Model Square auch DeepSeek, GLM, Kimi, MiniMax sowie einige Open-Source-Modell-Dienste an. Die Plattform bietet ein einheitliches Konto- und Überwachungssystem, doch jedes Modell weist unterschiedliche geografische Einschränkungen, kostenlose Nutzungslimits, Kontexte, Inhaltspolitiken und Preise auf.

4. OpenAI-kompatible Schnittstelle

Bailian bietet eine mit OpenAI kompatible Schnittstelle an, über die man die offiziellen OpenAI-SDKs für Python, Node.js, Java, Go usw. nutzen kann. Zudem werden auch die offiziellen DashScope-SDKs für Python und Java bereitgestellt. Bei der Migration bestehender Anwendungen ist es in der Regel notwendig, die API-Adressen, Schlüssel sowie die Modell-ID zu ersetzen. Außerdem müssen die Parameter für die Aufrufe der Tools sowie die Eingabedaten in Form von Bildern, Datenströmen oder strukturierten Daten überprüft werden.

Drei Anwendungsentwicklungsmodelle

1. Agent 2.0

Die neue Version des Agents wird durch natursprachliche Anweisungen gesteuert, kann die Absichten der Benutzer verstehen, selbstständig planen und auf Wissensdatenbanken, Erinnerungen, Fähigkeiten, MCP sowie Erweiterungen zugreifen. Sie eignet sich für einen offenen Kundenservice, Wissensfragen, Aufgabenassistenten, Reiseplanung sowie mehrfache Interaktionen.

Je höher die Autonomie des Agenten ist, desto schwieriger ist es, den Ausführungsweg vorherzusagen. Bei Aufträgen, Zahlungen, Versendungen, Löschungen sowie internen Daten sollten eine Whiteliste für Tools, Parameterüberprüfungen, Berechtigungen sowie manuelle Bestätigungen eingestellt werden. Man darf sich nicht allein auf Hinweismeldungen verlassen, um unbefugtes Handeln zu verhindern.

2. Visualisierung von Workflows

Der Workflow legt durch Knoten eine feste Ausführungsreihenfolge fest und kann große Modelle, Intent-Klassifizierung, Wissensdatenbanken, Dokumentenanalyse, Code, APIs, Funktionsberechnungen, Entscheidungen, Parallelisierung, Schleifen, Variablen, Agenten sowie Unterprozesse kombinieren. Er eignet sich für Aufgaben, bei denen eine zuverlässige Wiederholbarkeit erforderlich ist, wie z. B. Berichtserstellung, Bestellverarbeitung, Freigabe, Datenelementierung und Inhaltssicherung.

Der Workflow unterstützt die Debugging-Funktionen sowie Session-Variable. Zudem kann er als Anwendung für Echtzeit-Audio- und Videokommunikation bereitgestellt werden und über H5 oder Audio-/Video-SDKs in Web-, iOS- und Android-Plattformen integriert werden. Die Nutzung von Modellen, Wissensdatenbanken sowie Cloud-Diensten bei der Aufrufung der Knoten verursacht jeweils zusätzliche Kosten.

3. Hochcode-Anwendungen

Die High-Code-Anwendung richtet sich an professionelle Entwickler und ermöglicht es, mithilfe von Python einen AI-Backend zu erstellen. Dabei können MCPs, Datenverbindungen sowie vorhandene Agenten/Workflow-Komponenten genutzt werden. Zudem kann die Anwendung mit einem Klick in eine Cloud-Umgebung bereitgestellt werden. Sie eignet sich für proprietäre Algorithmen, komplexe Abhängigkeiten sowie tiefgreifende Systemintegrationen.

Der Code sollte mit höheren Berechtigungen ausgeführt werden; Abhängigkeiten sollten festgelegt, Sicherheitslücken überprüft, das Netzwerk sowie Anmeldeinformationen eingeschränkt werden. Zudem sollten Regeln für Zeitüberschreitungen, Skalierung, Protokollierung und Fehlerverwaltung festgelegt werden.

RAG-Wissensdatenbank

Dokumente, Tabellen, Bilder sowie Wissen zu Audio- und Videoinhalten

Die Wissensdatenbank „Bailian“ unterstützt Suchfunktionen für Dokumente, Datenabfragen, Fragen zu Bildern sowie Suchfunktionen für Audio- und Videodateien. Es ist möglich, Daten aus lokalen Dateien, OSS, Webseiten und anderen Quellen einzubinden. Die Analyse von Dokumenten umfasst PDF, DOC, DOCX, WPS, PPT, PPTX, Markdown, TXT und Excel. Reiche Textdokumente können mithilfe großer KI-Modelle in Bezug auf Illustrationen und Diagramme analysiert werden.

Verschiedene Arten von Wissensdatenbanken können nicht in derselben Datenbank kombiniert werden. Die neuere Version von Agent 2.0 ermöglicht es jedoch, mehrere Wissensdatenbanken miteinander zu verknüpfen und sie als Standardwerkzeuge unabhängig zu nutzen. Die verwendeten Wissensdatenbanken können entweder fest oder dynamisch festgelegt werden; außerdem lassen sich TopK-Werte sowie Suchparameter separat einstellen.

Suchen und Neuordnen

Die Wissensdatenbank teilt Dokumente in Blöcke auf, vektorisiert sie und erstellt Indexe. Bei der Suche können semantische Übereinstimmungen, Schlüsselwörter, Neuanordnungen sowie Metadatenfilter verwendet werden. Der Treffer-Test dient dazu, die zurückgegebenen Abschnitte anzusehen; die Priorität der API-Parameter liegt über der der Konfiguration in der Konsole.

Die Erhöhung von TopK kann die Abdeckung verbessern, führt aber auch zu mehr Eingabetokens und Rauschen im Modell. Das Team muss Slicing-, Vektormodelle, Schwellenwerte und Neuansortierungen anhand echter Probleme testen, wobei die Schlüsselantworten weiterhin im Originaltext überprüft werden müssen.

Wissensdatenbank-SDK

Neben der Verwendung in BaiLian-Anwendungen können auch externe Anwendungen die Suchfunktionen der Wissensdatenbank direkt über das BaiLian-SDK aufrufen. Auf diese Weise können die RAG-Ergebnisse an selbst entwickelte Modell-Orchestrierungsmechanismen oder andere Agenten weitergeleitet werden. Dennoch muss weiterhin der Geschäftsbereich, die ID der Wissensdatenbank sowie die Authentifizierung und Rate Limiting verwaltet werden.

Erinnerungen, Fähigkeiten, Erweiterungen und MCP

Die Speicherdatenbank dient dazu, Benutzerpräferenzen sowie langfristige Informationen zu speichern, damit der Agent über verschiedene Sitzungen hinweg personalisiert bleibt. Skills sind Fähigkeitspakete, die dem Agent hinzugefügt werden können; offizielle Skills umfassen gängige Aufgaben wie die Verarbeitung von Dateien.

Die Erweiterungen umfassen einen Code-Interpreter, eine Rechenmaschine, Bildgenerierung, Suchfunktionen, QR-Codes sowie die Suche auf GitHub. Zudem wird die Anpassung von APIs unterstützt.

MCP ermöglicht es den Agenten, auf Google Maps, Datenbanken, interne Dienste sowie Tools Dritter zuzugreifen; auch Anwendungen mit hohem Codeanteil können durch MCP ihren Datenzugriff erweitern.

Die Beschreibungen der Tools sowie die Parameter werden der Entscheidungsfindung des Modells überlassen. Der Server muss Identität, Berechtigungen und Geschäftsbedingungen überprüfen, um Angriffe durch das Einfügen von Befehlen zu verhindern.

Modelloptimierung und Bewertung

Bailian unterstützt Funktionen wie Prompt-Verwaltung, Modellbewertung sowie überwachtes Feintuning. Mit eigenen Daten können Basismodelle mit den optimierten Versionen verglichen werden. Bei der Anwendungsbewertung werden die Leistungen des Agents sowie der Workflows aus Sicht der endgültigen Antworten, der Wissensabruffähigkeit sowie der Ausführung von Tools überprüft.

Feinabstimmung eignet sich zum Erlernen von Format, Stil und Aufgabemustern, ist aber nicht geeignet für häufige Aktualisierungen von Fakten; für Echtzeit-Private-Kenntnisse sollte RAG verwendet werden.

Die Trainingsdaten müssen lizenziert sein und gedämpft werden, wobei eine Trennung in Trainings- und Validierungssets erfolgen sollte, um das Speichern von Privatdaten und Überanpassung zu vermeiden.

Veröffentlichung, API und Überwachung

Agenten und Workflows können über API-Aufrufe oder über Teilen-Seiten integriert werden. Die Modellservices sind außerdem direkt über kompatible Schnittstellen von DashScope und OpenAI zugänglich. Die Plattform bietet Statistiken zu den Aufrufen, Tokens, Erfolgsraten, Verzögerungen, Anwendungsprotokolle, Überwachung der Abläufe sowie Verwaltung von Berechtigungen.

Der API-Schlüssel sollte auf der Serverseite gespeichert werden und nach Geschäftsbereichen sowie RAM-Rechten getrennt werden. Es sollten Beschränkungen bezüglich der Anzahl der Anfragen, Alarme bei Überschreitung von Budgets, Maskierung von Protokolldaten, Wiederholungsversuche bei Fehlern sowie regelmäßige Erneuerung des Schlüssels eingestellt werden. Der Hauptkontoschlüssel darf weder im Browser noch in öffentlichen Repositorien gespeichert werden.

Preis- und Versionsvergleich

Paket oder VersionPreise, Limits und Kernvorteile
ModellpreisDas BaiLian-Modell wird standardmäßig nach Verbrauch abgerechnet. Bei Textmodellen werden die Eingangs- und Ausgabetoken separat berechnet; für Bilder, Videos, Sprache, Vektoren und Umordnungen gelten eigene Berechnungsmethoden. Einige Modelle verlangen eine gestaffelte Gebühr je nach Länge der eingegebenen Tokens – für die gesamte Anfrage wird dann der Preis entsprechend dem jeweiligen Tariffaktor berechnet. Stand der Überprüfung beträgt der Referenzpreis für die feste Version von Qianwen 3.7 Max in der Region Nordchina/Beijing 12 Yuan pro Million Token für den Eingang und 36 Yuan pro Million Token für den Ausgang. Zudem steht eine kostenlose Menge von 1 Million Token zur Verfügung. Diese kostenlose Menge ist in der Regel 90 Tage gültig, beginnend mit dem Zeitpunkt, an dem BaiLian aktiviert wird, das Modell veröffentlicht wird oder die Anfrage genehmigt wird. In anderen Regionen könnte diese kostenlose Menge nicht gewährt werden. Bei Modellen, die Batch-Verarbeitung unterstützen, werden die Eingangs- und Ausgabedaten in der Regel zu 50 Prozent des Preises für die Echtzeitverarbeitung abgerechnet. Für den Kontextspeicher gelten weitere Preise: Die Erstellung eines expliziten Speichers kostet 125 Prozent des Standardpreises für Eingabedaten, während ein Treffer im Speicher nur 10 Prozent kostet. Der Rabatt für Batch-Verarbeitung und den Kontextspeicher gilt nicht gleichzeitig. Die Preise für verschiedene Qianwen-Versionen sowie für Drittanbietermodelle unterscheiden sich stark. In der Konsole können außerdem Sonderangebote vorhanden sein. Im Verzeichnis darf nicht nur ein einziger Preis pro Million Token angegeben werden.
Preis der WissensdatenbankDie Wissensdatenbank wird nach Verbrauch abgerechnet, wobei die Kosten pro Stunde ermittelt werden. Auf der Erstellungsseite werden aktuell 0,03 Yuan pro Stunde für die Standardversion sowie 0,2 Yuan pro Stunde für die Premiumversion angegeben. Zudem können Kosten für Speicherung, Verarbeitung, Embedding, Suchfunktionen, Reranking sowie Token für große Nachbearbeitungsmodelle anfallen. Selbst wenn die Wissensdatenbank nicht genutzt wird, können weiterhin Kosten für die Laufzeit der jeweiligen Konfiguration anfallen. Ressourcen, die nach den Tests nicht mehr benötigt werden, sollten rechtzeitig gelöscht oder deaktiviert werden. Zudem sollten im Kostenmanagement Budgets sowie Alarme eingestellt werden.
Kostenloser Probemonat und Abonnement-PläneDie aktuelle Testaktion von Alibaba Cloud AI ermöglicht es, mehr als 100 Millionen Token großer Modelle zu nutzen. Dafür ist jedoch eine Identitätsüberprüfung erforderlich, die Aktion muss über ein bestimmtes Testzentrum aktiviert werden, und es gelten Einschränkungen bezüglich des ersten Tests, der Nutzerkonten sowie der Gültigkeitsdauer der Modelle. Die im Rahmen dieser Aktion zur Verfügung stehenden Ressourcen gelten nicht als dauerhafter Vorteil für alle Konten. BaiLian bietet außerdem Abonnementprodukte wie CodingPlan und TokenPlan an. Der Umfang der verfügbaren Modelle, die automatische Verlängerung sowie die Richtlinien zur fairen Nutzung unterscheiden sich von denen der pay-per-use-APIs. Vor dem Kauf sollte man sich die aktuellen Pakete ansehen – die Abonnementrechte dürfen nicht für nicht unterstützte API-Anfragen oder für kommerzielle Zwecke verwendet werden.

Modellpreis

Das BaiLian-Modell wird standardmäßig nach Verbrauch abgerechnet. Bei Textmodellen werden die Eingangs- und Ausgangstoken separat berechnet; für Bilder, Videos, Sprache, Vektoren und Umordnungen gelten eigene Einheiten.

Einige Modelle verlangen eine schrittweise Gebührenstruktur je nach Länge des einzugebenden Tokens; für die gesamte Anfrage wird der Preis entsprechend dem jeweiligen Tarifbereich berechnet.

Stand dieser Überprüfung beträgt der Referenzpreis für die festgelegte Version von Qianwen 3.7 Max in der Region Nordchina/Beijing 12 Yuan pro Million Token für die Eingabe und 36 Yuan pro Million Token für die Ausgabe. Zudem steht eine kostenlose Menge von 1 Million Token zur Verfügung. Diese kostenlose Menge ist in der Regel 90 Tage lang gültig, beginnend mit dem späteren der drei Zeitpunkte: der Aktivierung von BaiLian, der Veröffentlichung des Modells oder der Genehmigung der Anfrage. In anderen Regionen kann es diese kostenlose Menge nicht geben.

Die Eingaben und Ausgaben von Modellen, die Batch-Verarbeitung unterstützen, werden in der Regel zu 50 % des Preises für Echtzeit-Verarbeitungen abgerechnet. Für den Kontext-Cache gelten andere Preise: Die Erstellung eines expliziten Caches kostet 125 % des Preises für eine Standard-Eingabe, während bei einem Treffer nur 10 % berechnet werden.

Batch- und Cache-Rabatte können nicht gleichzeitig gelten.

Die Preise für die verschiedenen Qianwen-Ebenen sowie für Drittanbieter-Modelle unterscheiden sich stark. In der Konsole können außerdem Sonderangebote vorhanden sein. Im Katalog darf nicht nur ein einziger Preis pro Million Token angegeben werden; der tatsächliche Kostenrahmen sollte nach dem Modell-ID, der Region, der Länge der Eingabe, den Ausgabeergebnissen, dem Caching sowie der Menge der zu verarbeitenden Daten berechnet werden.

Preis der Wissensdatenbank

Die Wissensdatenbank wird nach Verbrauch abgerechnet, wobei die Gebühren pro Stunde ermittelt werden. Auf der Aktivierungsseite werden für die Standardversion 0,03 Yuan pro Stunde und für die Premiumversion 0,2 Yuan pro Stunde angegeben. Zudem können Kosten für Speicherung, Verarbeitung, Embedding, Suchfunktionen, Reranking sowie für Token der untergeordneten großen Modelle anfallen.

Auch wenn die Wissensdatenbank nicht genutzt wird, kann dennoch eine Gebühr für die Laufzeit der Spezifikationen anfallen. Ressourcen, die nach den Tests nicht mehr benötigt werden, sollten umgehend gelöscht oder deaktiviert werden. Zudem sollten im Kostenmanagement Budgets und Alarme eingestellt werden.

Kostenloser Probemonat und Abonnement-Pläne

Die aktuelle Testaktion von Alibaba Cloud AI bietet die Möglichkeit, mit Bai Lian mehr als 100 Millionen Token großer Modelle auszuprobieren. Dafür ist jedoch eine Identitätsüberprüfung erforderlich, die Aktion muss über ein bestimmtes Testzentrum gestartet werden, und es gelten Einschränkungen bezüglich des ersten Tests, von Konten derselben Person sowie der Gültigkeitsdauer der jeweiligen Modelle. Die im Rahmen dieser Aktion zur Verfügung stehenden Ressourcen können nicht als dauerhafter Vorteil für alle Konten angesehen werden.

Bailian bietet außerdem Abonnementprodukte wie CodingPlan und TokenPlan an. Der Umfang der Modelle, die automatische Verlängerung sowie die Richtlinien für einen fairen Gebrauch sind von den API-Optionen nach Verbrauch unabhängig. Vor dem Kauf sollte man sich das jeweilige Paket ansehen – man sollte die Abonnementsberechtigungen nicht für nicht unterstützte APIs oder zur Weitervermarktung in der Produktion verwenden.

GitHub und der Open-Source-Zustand

Aliyun stellt auf GitHub das DashScope SDK, Beispiele für APIs sowie Projekte im Zusammenhang mit dem Tongyi Qianwen-Modell öffentlich zur Verfügung. Einige Modellgewichte und Tools werden unter der Apache 2.0-Lizenz oder unter jeweils eigenen Lizenzen bereitgestellt. Entwickler können außerdem das offizielle OpenAI-SDK nutzen, um kompatible Schnittstellen anzurufen.

Die BaiLian-Cloud-Plattform, die gehosteten Wissensdatenbanken, die Anwendungskonsole sowie die Dienste zum Aufbau von Geschäftsmodellen sind keine Open-Source-Software, die privat bereitgestellt werden kann. Die Tatsache, dass ein bestimmtes Qwen-Modell oder SDK unter Open-Source-Lizenz verfügbar ist, bedeutet nicht, dass alle Modelle, Daten und Dienste in BaiLian dieselbe Lizenz verwenden. Vor der kommerziellen Nutzung muss jede Komponente einzeln überprüft werden.

Daten Sicherheit und Region

Laut offiziellen Angaben werden die bei der Erstellung von Anwendungen oder beim Trainieren von Modellen übertragenen Daten verschlüsselt. Die Plattform bietet zudem RAM, Arbeitsbereiche, Protokolle sowie unternehmensweite Cloud-Sicherheitsfunktionen.

Modelle, kostenlose Nutzungsoptionen und Funktionalitäten können je nach Region unterschiedlich sein, und es gibt auch Unterschiede in den verfügbaren Funktionen zwischen der internationalen und der chinesischen Plattform.

Verschlüsselter Datenverkehr bedeutet nicht, dass Daten bedingungslos hochgeladen werden können. Unternehmen sollten die Dienstleistungsvereinbarungen, Vorgaben zur Datenspeicherung, Nutzung zur Ausbildung, grenzüberschreitende Aspekte sowie Anforderungen bezüglich personenbezogener Daten und branchenspezifischer Vorschriften prüfen. Zudem sollten für Wissensdatenbanken, Trainingsdatensätze und Protokolle minimale Berechtigungen sowie Maskierungstechniken angewandt werden.

Anleitung zur Nutzung von Alibaba Cloud BaiLian

Eine grundlegende Aufgabe erledigen

  1. Registrieren Sie Alibaba Cloud BaiLian und erstellen Sie einen API-Schlüssel, der ausschließlich für die Testumgebung verwendet wird;
  2. Wählen Sie das Modell entsprechend der Eingabetypen, des Kontexts, der Qualität, der Geschwindigkeit und des Preises aus;
  3. Rufen Sie zunächst den Modellservice auf, um die minimale Anfrage abzuschicken und die zurückgegebene Struktur zu überprüfen;
  4. Testen Sie anschließend die fließende Ausgabe, Parameter sowie die Reaktion auf Fehler mithilfe von drei weiteren Implementierungsmodellen;
  5. Protokollieren Sie Tokens, Anrufanzahl, Verzögerung, Fehlerrate und Kosten pro Aufruf;
  6. Tragen Sie den Schlüssel in den Server-basierten Schlüsselmanager ein, bevor Sie die eigentliche Anwendung anschließen;

Erstellung wiederverwendbarer professioneller Workflows

  1. Für die Entwicklungs-, Test- und Produktionsumgebungen werden unterschiedliche Schlüssel und Limits verwendet;
  2. Ein repräsentatives Bewertungsset wird anhand von Modellservices, drei Anwendungsarchitekturen und der RAG-Wissensdatenbank erstellt;
  3. Einstellen von Timeout, Konkurrenz, Wiederholungsversuchen, Limitierung sowie Budgetobergrenzen;
  4. Durchführung von Überprüfungen hinsichtlich Fakten, Sicherheit, Formatierung und sensibler Informationen am Ausgangsinhalt;
  5. Überwachung von Änderungen bei Modellversionen, Preisen, Verzögerungen und Ausfallraten;
  6. Vorbereitung von Plänen für die Herabstufung des Modells, Schutzmaßnahmen sowie manuelle Übernahme.

Für welche Nutzer geeignet?

  • Entwickler, die die APIs von Tongyi Qianwen sowie inländischen und ausländischen Modellen aufrufen;
  • Mit Zero-Code-Agenten lassen sich schnell Teams für Kundenservice, Wissensassistenten und Aufgabenhilfen erstellen;
  • Unternehmen, die eine Visualisierung der Workflows benötigen, um festgelegte Geschäftsprozesse umzusetzen;
  • Entwickler, die eine komplexe AI-Backend-Lösung auf Python-basierter Weise implementieren möchten;
  • Organisation einer RAG-Wissensdatenbank für Dokumente, Bilder, Tabellen sowie Audio- und Videodaten;
  • Kunden, die den Schutz der Rechte in Alibaba Cloud, die Überwachung, die Registrierung sowie das Unternehmensservice-System schätzen.

Vorteile des Produkts

  • Die gesamte Tongyi Qianwen-Serie sowie Drittanbieter-Modelle werden zentral integriert;
  • Die kompatiblen Schnittstellen von DashScope und OpenAI senken die Kosten für den Umstieg.
  • Agenten, Workflows und hoher Code-Coverage weisen unterschiedliche Entwicklungsbarrieren auf;
  • Wissensdatenbank, Erinnerung, Fähigkeiten, Erweiterungen und MCP-Fähigkeiten sind vollständig vorhanden;
  • Modelloptimierung, Bewertung, Beobachtung und Berechtigungen bilden einen geschlossenen Kreislauf;
  • Unterstützung für Batch-, Cache- und mehrstufige Modelloptimierungskosten.

Einschränkungen und Hinweise

  • Es gibt viele Funktionen und Abrechnungspunkte, wobei das Modell-Token nur einen Teil der Gesamtkosten darstellt. Wissensdatenbanken, Analysefunktionen, Umordnungen, Tools, Codeausführung sowie weitere Cloud-Dienste müssen separat berechnet werden.
  • Die kostenlosen Limits, Aktivitäten und die neuesten Modelle können sich ändern.
  • Agenten können Halluzinationen, fehlerhafte Aufrufe von Werkzeugen sowie unvorhersehbare Verläufe erzeugen;
  • Workflows können auch aufgrund von Aktualisierungen von Knoten, Schnittstellen oder Modellen nicht mehr funktionieren.
  • Produktionsanwendungen müssen eine feste Version haben, Überprüfungen durchführen, manuelle Bestätigung, Sicherheitsaudits sowie die Möglichkeit zur Rücksetzung bieten.

Häufige Fragen

Ist Alibaba Cloud BaiLian kostenlos?

Man kann kostenlose Zugriffsrechte auf geeignete Modelle sowie Probierphasen erhalten, doch die tatsächliche Nutzung der Modelle, der Wissensdatenbanken und der Cloud-Ressourcen wird nach Verbrauch abgerechnet. Die kostenlosen Zugriffsrechte haben in der Regel eine Gültigkeitsdauer von 90 Tagen.

Wie viel kostet Qianwen 3.7 Max?

Der aktuelle Referenzpreis für die feste Version in Peking beträgt 12 Yuan für die Eingabe und 36 Yuan pro Million Token für die Ausgabe; der Preis ändert sich je nach konkretem Modell, Kontextdokumenten, Batch-Größe sowie Cache.

Wie viel kostet die BaiLian-Wissensdatenbank?

Die Standardversion kostet 0,03 Yuan pro Stunde, die Flaggschiffversion ab 0,2 Yuan pro Stunde. Zudem müssen die tatsächlichen Kosten für Aufgaben wie Analyse, Vektorenverarbeitung, Suchfunktionen, Umordnung sowie den Aufruf großer Modelle berücksichtigt werden.

Wird das OpenAI SDK unterstützt?

Unterstützung: Es ist möglich, die kompatiblen Schnittstellen über das mehrsprachige OpenAI SDK zu nutzen, oder man kann auch die offiziellen DashScope Python- und Java-SDKs verwenden.

Kann Bai Lian privat bereitgestellt werden?

Bailian ist eine von Alibaba Cloud betriebene Plattform und entspricht nicht offenen, selbstbetreuten Softwarelösungen. Für Anforderungen an eine exklusive oder hybride Cloud sollten Sie sich an Alibaba Cloud wenden, um gemeinsam mit PAI, einer proprietären Cloud sowie der Implementierung lokaler Modelle eine Lösung zu erarbeiten.

Ist Alibaba Cloud BaiLian open source?

Die Plattform selbst ist nicht open source; einige Qwen-Modelle, das DashScope SDK sowie die Tools sind hingegen open source. Die jeweiligen Lizenzen müssen separat geprüft werden; sie gelten nicht für alle Dienste der Plattform.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Werkzeuge, die dem Alibaba Cloud Bai Lian ähneln