ZhiPu AI
Als führender Akteur bei der Entwicklung großer KI-Modelle nutzt ZhiPu AI zusammen mit den hochwertigen, umfangreichen Wissensgraphen, die es selbst erstellt hat, ein Framework für künstliche Intelligenz, das Daten und Wissen in Einklang bringt. Dadurch wird die Grenze durchbrochen, an der sich die derzeitige zweite Generation der KI-Technologien bereits befindet...
Tags:Plugins und FähigkeitenWas ist Zhipu AI?
Zhipu AI ist ein Plattform für die Entwicklung und Nutzung großer KI-Modelle, die von der Beijing Zhipu Huazhang Technology Co., Ltd. betrieben wird.
Ihre Dienstleistungen umfassen GLM-Modelle, die offene BigModel-Plattform sowie native Anwendungen und Unternehmenslösungen wie Zhipu Qingyan.
Produkt- und Dienstleistungsmatrix
| Produkte | Hauptfunktion | Zielgruppe |
|---|---|---|
| GLM-Modell | Bereitstellung von Text-, multimodalen und Agentenfähigkeiten | Forschung und Anwendungsentwicklung |
| BigModel | Modell- und Toolaufrufe über API | Entwickler und Unternehmen |
| Intelligente Sprache | Allgemeiner KI-Assistent für chinesische Nutzer | Privat- und Geschäftskunden |
| Z.ai | Bietet Chatten-, Programmier- und Agentenerfahrungen | Weltweite Nutzer und Entwickler |
| AutoGLM | Planung und Ausführung von cross-App-Aufgaben | Agenten-User |
| AutoClaw | Einsatz eines persönlichen AI-Assistenten für langfristige Nutzung | Automatisierung und Bürobenutzer |
| Zread.ai | Hilfsmittel zur Lektüre und zum Verständnis | Forscher und Wissensarbeiter |
| AMiner | Akademische Suche, Experten- und Technologieinformationen | Wissenschaftliche und industrielle Nutzer |
GLM-Modellfamilie
Zhipu bietet eine Vielzahl von Modellen, die von allgemeinem Text über visuelle Inhalte, Sprache, Bilder, Videos bis hin zu Agenten reichen.
- GLM-5.3 legt Wert auf Programmierung, langfristige Aufgaben sowie Fähigkeiten im Bereich der Netzwerksicherheit.
- GLM-5.2 ist für den Projektumfeld-Engineering-Kontext sowie die Ausführung langfristiger Aufgaben konzipiert.
- GLM-5V-Turbo unterstützt die Eingabe von Bildern, Videos, Texten und Dateien.
- GLM-5-Turbo und GLM-5 richten sich an allgemeine Intelligenzen und komplexe Aufgaben.
- Die GLM-4.7-Serie bietet hohe Intelligenz, niedrige Preise sowie eine kostenlose Version.
- Den spezifischen Kontext, die Ausgabeobergrenzen sowie die Fähigkeiten der Tools sollten auf der entsprechenden Modellseite nachgeprüft werden.
GLM-5.3
GLM-5.3 wurde im August 2026 veröffentlicht und verwendet dieselbe Basis wie GLM-5.2; die Hauptverbesserungen stammen aus dem Nachtrainieren.
- Offiziell wird der Fokus auf komplexe Programmierung und die Fähigkeit zu langfristigen Aufgaben gelegt.
- Das Modell zeigt auch Fähigkeiten zur Abwehr von Netzwerkbedrohungen wie dem Aufdecken von Sicherheitslücken.
- Die offiziellen Gewichte sind in der zai-org-Organisation auf Hugging Face veröffentlicht worden.
- Die Standardversion hat etwa 753 Milliarden Parameter, es gibt außerdem die GLM-5.3-Flash-Serie.
- Die Lizenzkarte des Modells ist als glm-5.3 gekennzeichnet und kann nicht direkt mit MIT gleichgesetzt werden.
- Der Einsatz von Netzwerksicherheit in Hochrisikosituationen muss den gesetzlichen Vorschriften, Genehmigungen und Modellbedingungen entsprechen.
Text und Agent-API
Die offene Plattform bietet Textgenerierung, Denkprozesse, Aufruf von Tools, strukturierte Ausgaben, Caching sowie fließende Antworten.
- Bei der Auswahl eines Modells sollten Leistung, Kontext, Geschwindigkeit sowie die Kosten für Eingang und Ausgang verglichen werden.
- Eine Funktionsaufrufung kann Beschreibungen von Geschäftswerkzeugen zur Verfügung stellen, die für die Auswahl des Modells herangezogen werden.
- Strukturierte Ausgaben eignen sich zur Erstellung von JSON für anschließende Geschäftsprozesse.
- Der Kontext-Cache kann die Rechengebühren für wiederholte, lange Hinweise verringern.
- Der Streaming-Ausgang eignet sich für Chats und Anwendungen, die eine sofortige Rückmeldung erfordern.
- Die von dem Modell zurückgegebenen Toolsparameter müssen auf der Serverseite überprüft werden.
Sehen, Bilder und Videos
Multimodale Modelle können Bilder, Videos, Dokumentenseiten und Benutzeroberflächen verstehen sowie Bilder oder Videos erzeugen.
| Fähigkeiten | Repräsentationsmodell | Typische Anwendungen |
|---|---|---|
| Visuelle Verarbeitung | GLM-5V-Turbo, GLM-4.6V | Analyse von Bildern, Videos und Dokumenten |
| Bildgenerierung | CogView, GLM-Image | Kreatives Design und Marketingmaterialien |
| Videoerstellung | CogVideoX-Serie | Kurzvideos und Kameraentwürfe |
| Interface-Agent | Modelle im Zusammenhang mit AutoGLM | Visuelle Wahrnehmung und Operationenplanung |
- Die Ergebnisse der visuellen Verarbeitung können kleine Schriftzeichen, Tabellen, Verdeckungen sowie komplexe Diagramme falsch interpretieren.
- Bei der Erstellung von Bildern und Videos muss die Genehmigung für Personen, Materialien und Markenzeichen sichergestellt werden.
- Die Bedienung der Benutzeroberfläche erfordert Zugriffskontrollen, BestätigungsSchritte und Audit-Logs.
Sprachfähigkeit
- GLM-TTS wird für die Text-zu-Stimme-Übersetzung und die Darstellung von Emotionen verwendet.
- GLM-TTS-Clone kann auf der Grundlage kurzer Audiodateien einen ähnlichen Klang erzeugen.
- Die GLM-ASR-Serie wird für Spracherkennung und benutzerdefinierte Schlüsselwörter verwendet.
- GLM-Realtime unterstützt Echtzeit-Audio- und Videokommunikation sowie längere Gespräche.
- GLM-4-Voice unterstützt die Verarbeitung und Erzeugung von Sprache in Chinesisch und Englisch.
- Bevor man einen echten menschlichen Stimmton klonen kann, muss eine klare und nachweisbare Genehmigung vorliegen.
Vernetzte Suche und Wissensdatenbanken
Die offene Plattform bietet Suchwerkzeuge, Vektorisierung, Umordnung, Parsing, Bildverständnis und Speicherung in einer Wissensdatenbank.
- Search-Std eignet sich für schnelle Grundsuchen.
- Search-Pro legt Wert auf eine höhere Rückholrate und die Zusammenarbeit mehrerer Suchmaschinen.
- Die Vektorisierung von Wissen wandelt Dokumente in suchbare semantische Repräsentationen um.
- Das Umordnungsmodell wird verwendet, um die Reihenfolge der Relevanz der Kandidatensegmente zu optimieren.
- Eine detaillierte Analyse eignet sich für komplexe Dokumente, ist aber pro Seite kostenpflichtig.
- Antworten aus der Wissensdatenbank müssen weiterhin ihre Begründung aufzeigen und auf die Quellen zurückgeführt werden.
Anleitung zur Verwendung der Zhipu AI API
- Registrieren Sie ein Konto auf der BigModel-Offenplattform und führen Sie die erforderliche Authentifizierung durch.
- Erstellen Sie in der Konsole eine API-Key, um den Zugriff zu beschränken und sie sicher aufzubewahren.
- Wählen Sie je nach Aufgabe einen Text-, Visuell-, Bild-, Video- oder Sprachmodell aus.
- Lesen Sie die entsprechende Modellseite, um Kontext, Ausgabeobergrenze und Preis zu überprüfen.
- Führen Sie den ersten Aufruf mit den offiziellen cURL-, Python- oder Java-Beispielen aus.
- Einstellen von Timeout, Wiederholungsversuchen, Konkurrenz, Protokollierung und Kostenwarnungen.
- Es wird eine JSON-Prüfung sowie eine Prüfung der Geschäftsfelder für die strukturierte Ausgabe durchgeführt.
- Einstellen einer Allowlist für Toolaufrufe, Berechtigungen und manuelle Bestätigung.
- Die Genauigkeit, die Verzögerung und die Kosten pro Vorgang werden mit einem echten Testdatensatz bewertet.
- Nach dem Go-Live werden Version des Modells, Fehlerrate und abweichendes Verbrauchsmuster überwacht.
Grundlegende Vorgehensweise bei der Aufrufung
Bei einer Textaufrufung werden in der Regel der Modellname sowie eine Liste der Nachrichten an die Chat-Completions-Schnittstelle übermittelt, anschließend wird der von dem Modell zurückgegebene Inhalt ausgelesen.
- Systemhinweise dienen dazu, Rollen, Grenzen und das Ausgabeformat zu erklären.
- Die Benutzernachrichten sollten nur die Informationen enthalten, die zur Erfüllung der aktuellen Aufgabe notwendig sind.
- Wenn historische Nachrichten zu lang sind, können sie zusammengefasst werden oder durch Caching die Kosten gesenkt werden.
- Der API-Schlüssel wird nur im Serverumfeld gespeichert und nicht in Webseiten oder Client-Code geschrieben.
- Schreiben Sie keine unüberprüften Modellausgaben direkt in die Hauptdatenbank.
- Bei Zahlungen, Löschungen oder Versendung von Nachrichten muss eine Bestätigung hinzugefügt werden.
Preise für die API der Hauptmodelle
Bis zum 30. August 2026 erfolgt bei der offenen Plattform eine differenzierte Abrechnung nach Modell, Eingabelänge und Ausgabelänge.
| Modell | Eingabepreis | Auslieferungspreis |
|---|---|---|
| GLM-5.2 | 8 Yuan/Million Tokens | 28 Yuan/Million Tokens |
| GLM-5.1 Kurze Eingabe | 6 Yuan/Million Tokens | 24 Yuan/Million Tokens |
| GLM-5-Turbo kurze Eingabe | 5 Yuan/Million Tokens | 22 Yuan/Million Tokens |
| GLM-5 Kurze Eingabe | 4 Yuan/Million Tokens | 18 Yuan/Million Tokens |
| GLM-4.7 Grundlegende kurze Ausgabe | 2 Yuan/Million Tokens | 8 Yuan/Million Tokens |
| GLM-4.5-Air-Basis | 0,8 Yuan/Million Tokens | 2 Yuan/Million Tokens |
| GLM-4.7-FlashX | 0,5 Yuan/Million Tokens | 3 Yuan/Million Tokens |
| GLM-4.7-Flash | Kostenlos | Kostenlos |
Einige Modelle sind bei langen Eingabedaten oder langen Ausgabedaten teurer und können nicht allein anhand des niedrigsten Preises in der Tabelle geschätzt werden.
Preise, die Anzahl der gleichzeitigen kostenlosen Modelle sowie die Limits für Aktionen können sich ändern; letztendlich gelten die Angaben in der Konsole und auf der aktuellen Preistabelle.
Multimodale Ansätze und Preis der Tools
| Projekt | Offizieller Verkaufspreis | Erklärung |
|---|---|---|
| GLM-5V-Turbo kurze Eingabe | Eingabe: 5 Yuan, Ausgabe: 22 Yuan/Million Tokens | Bilder, Video-Dateien und Texteingabe |
| GLM-4.6V Basis | Eingabe: 1 Yuan, Ausgabe: 3 Yuan/Million Tokens | Lange Eingaben führen zu einem höheren Preisbereich |
| CogView-4 | 0,06 Yuan pro Mal | Der Preis für Batch-Verarbeitung ist niedriger. |
| CogVideoX-2 | 0,5 Yuan pro Mal | Mehrere Auflösungen |
| CogVideoX-3 | 1 Yuan pro Mal | Batchverarbeitung in Tabellen nicht unterstützt. |
| CogTTS | 4 Yuan pro 10.000 Malen | Text zu Sprache |
| CogTTS-Clone | 6 Yuan pro Mal | Klangklonierung |
| Suchwerkzeug | 0,01 bis 0,05 Yuan pro Mal | Abrechnung nach Art des Suchdienstes |
Preis der Wissensdatenbank
| Projekt | Preis | Erklärung |
|---|---|---|
| Vektorisierung | 0,5 Yuan/Million Tokens | Geeignet für verschiedene Embedding-Modelle |
| Umordnung | 0,8 Yuan/Million Tokens | Einige open-source-Modellrearrangierungen sind kostenlos |
| Tiefgehende Analyse | 0,12 Yuan/Seite | Abgerechnet nach Anzahl der Dokumentenseiten |
| Speichern | 0,04 Yuan/GB/Stunde | Ab der kostenlosen Kapazität wird abgerechnet |
| Kostenloser Speicherplatz | 1GB | Offizielle Erläuterung zur dauerhaft kostenlosen Gebühr |
Bei einem Überschreiten der Regelgrenzen bezüglich der Nutzung des Wissensspeichers können die über das kostenlose Volumen hinausgehenden Daten gelöscht werden. Es sollten daher unabhängige Backups angefertigt werden.
Kostenlose Kontingente und Abrechnungsmethoden
- Auf der Preisseite wird derzeit angezeigt, dass neue Nutzer 20 Millionen Tokens als Geschenk erhalten.
- Die Seite zeigt außerdem 120 Pakete mit Bild- und Videoresten.
- Kostenlose Ressourcenpakete sind an Bedingungen wie Registrierung, echte Identität, Modelle und Gültigkeitsdauer gebunden.
- Bei der Aufrufung werden in der Regel zunächst die entsprechenden Ressourcenpakete abgezogen, anschließend der Bargeldsaldo.
- Wenn die Suchergebnisse als Eingabe für das Modell verwendet werden, können auch Kosten für Modell-Tokens entstehen.
- Die Aktivitätslimits und die Strategien für kostenlose Modelle werden in Echtzeit über die Account-Konsole angezeigt.
Batchverarbeitung, Feinabstimmung und private Instanzen
- Die Batch-API eignet sich für die Verarbeitung großer Datenmengen außerhalb der Echtzeit; der Preis für einige Modelle beträgt die Hälfte dessen, was bei einer Echtzeitaufrufung anfällt.
- Das Fine-Tuning des Modells unterstützt LoRA oder vollständiges Training und wird nach den trainierten Tokens abgerechnet.
- Private Cloud-Instanzen werden nach Rechenleistungseinheiten und Tagen abgerechnet.
- Verschiedene Modelle benötigen unterschiedliche Anzahl an Recheneinheiten, um eine Instanz zu betreiben.
- Bei Unternehmensbeschaffungen müssen Durchsatz, Verzögerungen, Konkurrenz sowie die Daten- und Servicelevel überprüft werden.
- Private Instanzen bedeuten nicht, dass die Modellgewichte frei heruntergeladen oder weiterverbreitet werden können.
Unterschiede zwischen Open-Source-Modellen und Cloud-Diensten
ZhiPu hat die Gewichte vieler Modelle sowie den Forschungscodex veröffentlicht, doch der Umfang der Lizenzen für die verschiedenen Projekte unterscheidet sich.
- Die offiziellen Gewichte von GLM-5 unterliegen der MIT-Lizenz.
- Die GLM-5.3-Modellkarte ist derzeit mit einer speziellen glm-5.3-Lizenz versehen.
- Frühe GLM-, ChatGLM-, visuelle und sprachbasierte Projekte könnten unterschiedliche Lizenzen verwenden.
- Lesen Sie vor dem Herunterladen des Modells den gesamten Inhalt des Repositoriums, der Modellkarte sowie der Lizenz.
- Die BigModel-Cloud-Plattform, die kommerziellen APIs sowie Zhipu Qingyan sind nicht vollständig open source.
- Offene Gewichte entsprechen nicht automatisch Open-Source-Software im Sinne der OSI-Definition.
Für welche Benutzer geeignet
- Normalnutzer: Beantworten von Fragen und Erledigen von Büroarbeiten über Zhipu Qingyan oder Z.ai.
- Entwickler: Aufruf von Text-, multimodalen, Sprach- und Tool-APIs.
- Unternehmen: Aufbau von Wissensdatenbanken, Agenten und Geschäftsanwendungen.
- Inhalte-Team: Erstellung von Bildern, Videos, Dokumenten und Sprachmaterialien.
- Forscher: Laden Sie die Modellgewichte herunter und führen Sie Bewertungen oder Feinabstimmungen durch.
- Automatisiertes Team: Ausführung von Aufgaben durch Kombination von AutoGLM und Function Call.
Einsatzbeschränkungen und Hinweise
- Modelle können fehlerhafte, veraltete, voreingenommene oder unbegründete Inhalte erzeugen.
- Ein langer Kontext bedeutet nicht, dass alle Informationen genau extrahiert und abgeleitet werden können.
- Für die Erstellung von Bildern, Klangfarben und Videos müssen Rechte sowie Zustimmung der betreffenden Person bestätigt werden.
- Ein Datenleck der API-Schlüssel kann zu Datengefahren und unerwarteten Kosten führen.
- Funktionen zur Aufrufung von Tools sowie zur Bedienung der Benutzeroberfläche erfordern Berechtigungen, Genehmigungen und Audits.
- Die kostenlosen Mengen, die Namen der Modelle, der Kontext sowie die Preise werden ständig aktualisiert.
- Medizinische, rechtliche, finanzielle und Sicherheitsfragen müssen von Fachleuten überprüft werden.
Häufige Fragen
Was bietet Zhipu AI hauptsächlich an?
Es bietet Produkte wie GLM-Modelle, die Open-Platform BigModel, Zhipu Qingyan, Z.ai und AutoGLM an.
Welche Modalitäten werden von der Open-Platform von ZhiPu AI unterstützt?
Unterstützung für Texte, Bilder, Videos, Sprache, Bildgenerierung, Suchfunktionen, Wissensdatenbanken und Agentenwerkzeuge.
Wie wird die Gebührenberechnung für die ZhiPu AI API erfolgen?
Texte und multimodale Inhalte werden in der Regel nach den eingegebenen/Ausgegebenen Tokens abgerechnet, während Bilder, Videos, Suchanfragen usw. pro Nutzung abgerechnet werden.
Hat Zhipu AI kostenlose Modelle?
Auf der aktuellen Preistabelle wird GLM-4.7-Flash als kostenlos angezeigt; die genauen Regeln bezüglich der gleichzeitigen Nutzung sowie der Aktionen gelten entsprechend der Konsole.
Haben neue Nutzer von ZhiPu AI einen kostenlosen Datenvolumen?
Die aktuelle Seite zeigt 20 Millionen Tokens sowie Pakete mit Bild- und Video-Ressourcen. Die Voraussetzungen und Gültigkeitsdauer richten sich nach der Account-Seite.
Sind alle ZhiPu AI-Modelle offen zugänglich?
Nein, bei einigen Modellen sind die Gewichte offen zugänglich und die Lizenzen variieren; Cloud-Plattformen, APIs und native Anwendungen sind nicht vollständig open source.
Unterstützt Zhipu AI eine private Implementierung?
Die offene Plattform bietet private Instanzen sowie Unternehmenslösungen; die Modellspezifikationen, Rechenleistung und Dienste müssen je nach Lösung festgelegt werden.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164