ZhiPu AI
Kostenloser Mehrwert
KI-Agenten Plugins und Fähigkeiten

ZhiPu AI

Als führender Akteur bei der Entwicklung großer KI-Modelle nutzt ZhiPu AI zusammen mit den hochwertigen, umfangreichen Wissensgraphen, die es selbst erstellt hat, ein Framework für künstliche Intelligenz, das Daten und Wissen in Einklang bringt. Dadurch wird die Grenze durchbrochen, an der sich die derzeitige zweite Generation der KI-Technologien bereits befindet...

Tags:

Was ist Zhipu AI?

Zhipu AI ist ein Plattform für die Entwicklung und Nutzung großer KI-Modelle, die von der Beijing Zhipu Huazhang Technology Co., Ltd. betrieben wird.

Ihre Dienstleistungen umfassen GLM-Modelle, die offene BigModel-Plattform sowie native Anwendungen und Unternehmenslösungen wie Zhipu Qingyan.

Produkt- und Dienstleistungsmatrix

ProdukteHauptfunktionZielgruppe
GLM-ModellBereitstellung von Text-, multimodalen und AgentenfähigkeitenForschung und Anwendungsentwicklung
BigModelModell- und Toolaufrufe über APIEntwickler und Unternehmen
Intelligente SpracheAllgemeiner KI-Assistent für chinesische NutzerPrivat- und Geschäftskunden
Z.aiBietet Chatten-, Programmier- und AgentenerfahrungenWeltweite Nutzer und Entwickler
AutoGLMPlanung und Ausführung von cross-App-AufgabenAgenten-User
AutoClawEinsatz eines persönlichen AI-Assistenten für langfristige NutzungAutomatisierung und Bürobenutzer
Zread.aiHilfsmittel zur Lektüre und zum VerständnisForscher und Wissensarbeiter
AMinerAkademische Suche, Experten- und TechnologieinformationenWissenschaftliche und industrielle Nutzer

GLM-Modellfamilie

Zhipu bietet eine Vielzahl von Modellen, die von allgemeinem Text über visuelle Inhalte, Sprache, Bilder, Videos bis hin zu Agenten reichen.

  • GLM-5.3 legt Wert auf Programmierung, langfristige Aufgaben sowie Fähigkeiten im Bereich der Netzwerksicherheit.
  • GLM-5.2 ist für den Projektumfeld-Engineering-Kontext sowie die Ausführung langfristiger Aufgaben konzipiert.
  • GLM-5V-Turbo unterstützt die Eingabe von Bildern, Videos, Texten und Dateien.
  • GLM-5-Turbo und GLM-5 richten sich an allgemeine Intelligenzen und komplexe Aufgaben.
  • Die GLM-4.7-Serie bietet hohe Intelligenz, niedrige Preise sowie eine kostenlose Version.
  • Den spezifischen Kontext, die Ausgabeobergrenzen sowie die Fähigkeiten der Tools sollten auf der entsprechenden Modellseite nachgeprüft werden.

GLM-5.3

GLM-5.3 wurde im August 2026 veröffentlicht und verwendet dieselbe Basis wie GLM-5.2; die Hauptverbesserungen stammen aus dem Nachtrainieren.

  • Offiziell wird der Fokus auf komplexe Programmierung und die Fähigkeit zu langfristigen Aufgaben gelegt.
  • Das Modell zeigt auch Fähigkeiten zur Abwehr von Netzwerkbedrohungen wie dem Aufdecken von Sicherheitslücken.
  • Die offiziellen Gewichte sind in der zai-org-Organisation auf Hugging Face veröffentlicht worden.
  • Die Standardversion hat etwa 753 Milliarden Parameter, es gibt außerdem die GLM-5.3-Flash-Serie.
  • Die Lizenzkarte des Modells ist als glm-5.3 gekennzeichnet und kann nicht direkt mit MIT gleichgesetzt werden.
  • Der Einsatz von Netzwerksicherheit in Hochrisikosituationen muss den gesetzlichen Vorschriften, Genehmigungen und Modellbedingungen entsprechen.

Text und Agent-API

Die offene Plattform bietet Textgenerierung, Denkprozesse, Aufruf von Tools, strukturierte Ausgaben, Caching sowie fließende Antworten.

  • Bei der Auswahl eines Modells sollten Leistung, Kontext, Geschwindigkeit sowie die Kosten für Eingang und Ausgang verglichen werden.
  • Eine Funktionsaufrufung kann Beschreibungen von Geschäftswerkzeugen zur Verfügung stellen, die für die Auswahl des Modells herangezogen werden.
  • Strukturierte Ausgaben eignen sich zur Erstellung von JSON für anschließende Geschäftsprozesse.
  • Der Kontext-Cache kann die Rechengebühren für wiederholte, lange Hinweise verringern.
  • Der Streaming-Ausgang eignet sich für Chats und Anwendungen, die eine sofortige Rückmeldung erfordern.
  • Die von dem Modell zurückgegebenen Toolsparameter müssen auf der Serverseite überprüft werden.

Sehen, Bilder und Videos

Multimodale Modelle können Bilder, Videos, Dokumentenseiten und Benutzeroberflächen verstehen sowie Bilder oder Videos erzeugen.

FähigkeitenRepräsentationsmodellTypische Anwendungen
Visuelle VerarbeitungGLM-5V-Turbo, GLM-4.6VAnalyse von Bildern, Videos und Dokumenten
BildgenerierungCogView, GLM-ImageKreatives Design und Marketingmaterialien
VideoerstellungCogVideoX-SerieKurzvideos und Kameraentwürfe
Interface-AgentModelle im Zusammenhang mit AutoGLMVisuelle Wahrnehmung und Operationenplanung
  • Die Ergebnisse der visuellen Verarbeitung können kleine Schriftzeichen, Tabellen, Verdeckungen sowie komplexe Diagramme falsch interpretieren.
  • Bei der Erstellung von Bildern und Videos muss die Genehmigung für Personen, Materialien und Markenzeichen sichergestellt werden.
  • Die Bedienung der Benutzeroberfläche erfordert Zugriffskontrollen, BestätigungsSchritte und Audit-Logs.

Sprachfähigkeit

  • GLM-TTS wird für die Text-zu-Stimme-Übersetzung und die Darstellung von Emotionen verwendet.
  • GLM-TTS-Clone kann auf der Grundlage kurzer Audiodateien einen ähnlichen Klang erzeugen.
  • Die GLM-ASR-Serie wird für Spracherkennung und benutzerdefinierte Schlüsselwörter verwendet.
  • GLM-Realtime unterstützt Echtzeit-Audio- und Videokommunikation sowie längere Gespräche.
  • GLM-4-Voice unterstützt die Verarbeitung und Erzeugung von Sprache in Chinesisch und Englisch.
  • Bevor man einen echten menschlichen Stimmton klonen kann, muss eine klare und nachweisbare Genehmigung vorliegen.

Vernetzte Suche und Wissensdatenbanken

Die offene Plattform bietet Suchwerkzeuge, Vektorisierung, Umordnung, Parsing, Bildverständnis und Speicherung in einer Wissensdatenbank.

  • Search-Std eignet sich für schnelle Grundsuchen.
  • Search-Pro legt Wert auf eine höhere Rückholrate und die Zusammenarbeit mehrerer Suchmaschinen.
  • Die Vektorisierung von Wissen wandelt Dokumente in suchbare semantische Repräsentationen um.
  • Das Umordnungsmodell wird verwendet, um die Reihenfolge der Relevanz der Kandidatensegmente zu optimieren.
  • Eine detaillierte Analyse eignet sich für komplexe Dokumente, ist aber pro Seite kostenpflichtig.
  • Antworten aus der Wissensdatenbank müssen weiterhin ihre Begründung aufzeigen und auf die Quellen zurückgeführt werden.

Anleitung zur Verwendung der Zhipu AI API

  1. Registrieren Sie ein Konto auf der BigModel-Offenplattform und führen Sie die erforderliche Authentifizierung durch.
  2. Erstellen Sie in der Konsole eine API-Key, um den Zugriff zu beschränken und sie sicher aufzubewahren.
  3. Wählen Sie je nach Aufgabe einen Text-, Visuell-, Bild-, Video- oder Sprachmodell aus.
  4. Lesen Sie die entsprechende Modellseite, um Kontext, Ausgabeobergrenze und Preis zu überprüfen.
  5. Führen Sie den ersten Aufruf mit den offiziellen cURL-, Python- oder Java-Beispielen aus.
  6. Einstellen von Timeout, Wiederholungsversuchen, Konkurrenz, Protokollierung und Kostenwarnungen.
  7. Es wird eine JSON-Prüfung sowie eine Prüfung der Geschäftsfelder für die strukturierte Ausgabe durchgeführt.
  8. Einstellen einer Allowlist für Toolaufrufe, Berechtigungen und manuelle Bestätigung.
  9. Die Genauigkeit, die Verzögerung und die Kosten pro Vorgang werden mit einem echten Testdatensatz bewertet.
  10. Nach dem Go-Live werden Version des Modells, Fehlerrate und abweichendes Verbrauchsmuster überwacht.

Grundlegende Vorgehensweise bei der Aufrufung

Bei einer Textaufrufung werden in der Regel der Modellname sowie eine Liste der Nachrichten an die Chat-Completions-Schnittstelle übermittelt, anschließend wird der von dem Modell zurückgegebene Inhalt ausgelesen.

  • Systemhinweise dienen dazu, Rollen, Grenzen und das Ausgabeformat zu erklären.
  • Die Benutzernachrichten sollten nur die Informationen enthalten, die zur Erfüllung der aktuellen Aufgabe notwendig sind.
  • Wenn historische Nachrichten zu lang sind, können sie zusammengefasst werden oder durch Caching die Kosten gesenkt werden.
  • Der API-Schlüssel wird nur im Serverumfeld gespeichert und nicht in Webseiten oder Client-Code geschrieben.
  • Schreiben Sie keine unüberprüften Modellausgaben direkt in die Hauptdatenbank.
  • Bei Zahlungen, Löschungen oder Versendung von Nachrichten muss eine Bestätigung hinzugefügt werden.

Preise für die API der Hauptmodelle

Bis zum 30. August 2026 erfolgt bei der offenen Plattform eine differenzierte Abrechnung nach Modell, Eingabelänge und Ausgabelänge.

ModellEingabepreisAuslieferungspreis
GLM-5.28 Yuan/Million Tokens28 Yuan/Million Tokens
GLM-5.1 Kurze Eingabe6 Yuan/Million Tokens24 Yuan/Million Tokens
GLM-5-Turbo kurze Eingabe5 Yuan/Million Tokens22 Yuan/Million Tokens
GLM-5 Kurze Eingabe4 Yuan/Million Tokens18 Yuan/Million Tokens
GLM-4.7 Grundlegende kurze Ausgabe2 Yuan/Million Tokens8 Yuan/Million Tokens
GLM-4.5-Air-Basis0,8 Yuan/Million Tokens2 Yuan/Million Tokens
GLM-4.7-FlashX0,5 Yuan/Million Tokens3 Yuan/Million Tokens
GLM-4.7-FlashKostenlosKostenlos

Einige Modelle sind bei langen Eingabedaten oder langen Ausgabedaten teurer und können nicht allein anhand des niedrigsten Preises in der Tabelle geschätzt werden.

Preise, die Anzahl der gleichzeitigen kostenlosen Modelle sowie die Limits für Aktionen können sich ändern; letztendlich gelten die Angaben in der Konsole und auf der aktuellen Preistabelle.

Multimodale Ansätze und Preis der Tools

ProjektOffizieller VerkaufspreisErklärung
GLM-5V-Turbo kurze EingabeEingabe: 5 Yuan, Ausgabe: 22 Yuan/Million TokensBilder, Video-Dateien und Texteingabe
GLM-4.6V BasisEingabe: 1 Yuan, Ausgabe: 3 Yuan/Million TokensLange Eingaben führen zu einem höheren Preisbereich
CogView-40,06 Yuan pro MalDer Preis für Batch-Verarbeitung ist niedriger.
CogVideoX-20,5 Yuan pro MalMehrere Auflösungen
CogVideoX-31 Yuan pro MalBatchverarbeitung in Tabellen nicht unterstützt.
CogTTS4 Yuan pro 10.000 MalenText zu Sprache
CogTTS-Clone6 Yuan pro MalKlangklonierung
Suchwerkzeug0,01 bis 0,05 Yuan pro MalAbrechnung nach Art des Suchdienstes

Preis der Wissensdatenbank

ProjektPreisErklärung
Vektorisierung0,5 Yuan/Million TokensGeeignet für verschiedene Embedding-Modelle
Umordnung0,8 Yuan/Million TokensEinige open-source-Modellrearrangierungen sind kostenlos
Tiefgehende Analyse0,12 Yuan/SeiteAbgerechnet nach Anzahl der Dokumentenseiten
Speichern0,04 Yuan/GB/StundeAb der kostenlosen Kapazität wird abgerechnet
Kostenloser Speicherplatz1GBOffizielle Erläuterung zur dauerhaft kostenlosen Gebühr

Bei einem Überschreiten der Regelgrenzen bezüglich der Nutzung des Wissensspeichers können die über das kostenlose Volumen hinausgehenden Daten gelöscht werden. Es sollten daher unabhängige Backups angefertigt werden.

Kostenlose Kontingente und Abrechnungsmethoden

  • Auf der Preisseite wird derzeit angezeigt, dass neue Nutzer 20 Millionen Tokens als Geschenk erhalten.
  • Die Seite zeigt außerdem 120 Pakete mit Bild- und Videoresten.
  • Kostenlose Ressourcenpakete sind an Bedingungen wie Registrierung, echte Identität, Modelle und Gültigkeitsdauer gebunden.
  • Bei der Aufrufung werden in der Regel zunächst die entsprechenden Ressourcenpakete abgezogen, anschließend der Bargeldsaldo.
  • Wenn die Suchergebnisse als Eingabe für das Modell verwendet werden, können auch Kosten für Modell-Tokens entstehen.
  • Die Aktivitätslimits und die Strategien für kostenlose Modelle werden in Echtzeit über die Account-Konsole angezeigt.

Batchverarbeitung, Feinabstimmung und private Instanzen

  • Die Batch-API eignet sich für die Verarbeitung großer Datenmengen außerhalb der Echtzeit; der Preis für einige Modelle beträgt die Hälfte dessen, was bei einer Echtzeitaufrufung anfällt.
  • Das Fine-Tuning des Modells unterstützt LoRA oder vollständiges Training und wird nach den trainierten Tokens abgerechnet.
  • Private Cloud-Instanzen werden nach Rechenleistungseinheiten und Tagen abgerechnet.
  • Verschiedene Modelle benötigen unterschiedliche Anzahl an Recheneinheiten, um eine Instanz zu betreiben.
  • Bei Unternehmensbeschaffungen müssen Durchsatz, Verzögerungen, Konkurrenz sowie die Daten- und Servicelevel überprüft werden.
  • Private Instanzen bedeuten nicht, dass die Modellgewichte frei heruntergeladen oder weiterverbreitet werden können.

Unterschiede zwischen Open-Source-Modellen und Cloud-Diensten

ZhiPu hat die Gewichte vieler Modelle sowie den Forschungscodex veröffentlicht, doch der Umfang der Lizenzen für die verschiedenen Projekte unterscheidet sich.

  • Die offiziellen Gewichte von GLM-5 unterliegen der MIT-Lizenz.
  • Die GLM-5.3-Modellkarte ist derzeit mit einer speziellen glm-5.3-Lizenz versehen.
  • Frühe GLM-, ChatGLM-, visuelle und sprachbasierte Projekte könnten unterschiedliche Lizenzen verwenden.
  • Lesen Sie vor dem Herunterladen des Modells den gesamten Inhalt des Repositoriums, der Modellkarte sowie der Lizenz.
  • Die BigModel-Cloud-Plattform, die kommerziellen APIs sowie Zhipu Qingyan sind nicht vollständig open source.
  • Offene Gewichte entsprechen nicht automatisch Open-Source-Software im Sinne der OSI-Definition.

Für welche Benutzer geeignet

  • Normalnutzer: Beantworten von Fragen und Erledigen von Büroarbeiten über Zhipu Qingyan oder Z.ai.
  • Entwickler: Aufruf von Text-, multimodalen, Sprach- und Tool-APIs.
  • Unternehmen: Aufbau von Wissensdatenbanken, Agenten und Geschäftsanwendungen.
  • Inhalte-Team: Erstellung von Bildern, Videos, Dokumenten und Sprachmaterialien.
  • Forscher: Laden Sie die Modellgewichte herunter und führen Sie Bewertungen oder Feinabstimmungen durch.
  • Automatisiertes Team: Ausführung von Aufgaben durch Kombination von AutoGLM und Function Call.

Einsatzbeschränkungen und Hinweise

  • Modelle können fehlerhafte, veraltete, voreingenommene oder unbegründete Inhalte erzeugen.
  • Ein langer Kontext bedeutet nicht, dass alle Informationen genau extrahiert und abgeleitet werden können.
  • Für die Erstellung von Bildern, Klangfarben und Videos müssen Rechte sowie Zustimmung der betreffenden Person bestätigt werden.
  • Ein Datenleck der API-Schlüssel kann zu Datengefahren und unerwarteten Kosten führen.
  • Funktionen zur Aufrufung von Tools sowie zur Bedienung der Benutzeroberfläche erfordern Berechtigungen, Genehmigungen und Audits.
  • Die kostenlosen Mengen, die Namen der Modelle, der Kontext sowie die Preise werden ständig aktualisiert.
  • Medizinische, rechtliche, finanzielle und Sicherheitsfragen müssen von Fachleuten überprüft werden.

Häufige Fragen

Was bietet Zhipu AI hauptsächlich an?

Es bietet Produkte wie GLM-Modelle, die Open-Platform BigModel, Zhipu Qingyan, Z.ai und AutoGLM an.

Welche Modalitäten werden von der Open-Platform von ZhiPu AI unterstützt?

Unterstützung für Texte, Bilder, Videos, Sprache, Bildgenerierung, Suchfunktionen, Wissensdatenbanken und Agentenwerkzeuge.

Wie wird die Gebührenberechnung für die ZhiPu AI API erfolgen?

Texte und multimodale Inhalte werden in der Regel nach den eingegebenen/Ausgegebenen Tokens abgerechnet, während Bilder, Videos, Suchanfragen usw. pro Nutzung abgerechnet werden.

Hat Zhipu AI kostenlose Modelle?

Auf der aktuellen Preistabelle wird GLM-4.7-Flash als kostenlos angezeigt; die genauen Regeln bezüglich der gleichzeitigen Nutzung sowie der Aktionen gelten entsprechend der Konsole.

Haben neue Nutzer von ZhiPu AI einen kostenlosen Datenvolumen?

Die aktuelle Seite zeigt 20 Millionen Tokens sowie Pakete mit Bild- und Video-Ressourcen. Die Voraussetzungen und Gültigkeitsdauer richten sich nach der Account-Seite.

Sind alle ZhiPu AI-Modelle offen zugänglich?

Nein, bei einigen Modellen sind die Gewichte offen zugänglich und die Lizenzen variieren; Cloud-Plattformen, APIs und native Anwendungen sind nicht vollständig open source.

Unterstützt Zhipu AI eine private Implementierung?

Die offene Plattform bietet private Instanzen sowie Unternehmenslösungen; die Modellspezifikationen, Rechenleistung und Dienste müssen je nach Lösung festgelegt werden.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Werkzeuge, die dem ZhiPu AI ähneln