LLM Pricing
LLM-Preisgestaltung – intelligente Werkzeuge für den Trainingsprozess von KI-Modellen
Tags:KI-TrainingsmodelleWas ist LLM Price Check?
LLM Price Check ist ein Web-Tool zur Vergleich der Preise für APIs großer Sprachmodelle. Es bietet Felder wie Modell, Anbieter, Kontextfenster, Einheitspreis für Eingaben, Einheitspreis für Ausgaben sowie Qualitätsbewertung. Die Website stellt außerdem einen Kostenschätzer zur Verfügung, der den Nutzern hilft, die Kosten anhand der Anzahl der verwendeten Tokens zu schätzen.
Es eignet sich zur ersten Kostenprüfung von Modellen, ist aber kein offizielles Abrechnungssystem der Hersteller. Bei der Überprüfung enthält die Seite weiterhin viele alte Modelle und historische Preise; für die endgültige Kostenschätzung muss man auf die aktuelle Preisliste des jeweiligen Herstellers zurückgreifen.
Aktueller Datenzustand
Stand dieser Überprüfung sind die Haupttabellen auf der Startseite weiterhin hauptsächlich mit den Modellen GPT-4o, Claude 3, Gemini 1.5, Llama 3.1 sowie frühen Mistral-Modellen gefüllt und zeigen mehrere bereits geänderte historische Einzelpreise an. Auf der Seite wird nicht klar angegeben, wann die jeweilige Zeile zuletzt aktualisiert wurde.
Daher sollte das Verzeichnis nicht länger als zuverlässige Datenbank mit Echtzeitpreisen bezeichnet werden. Eine genauere Beschreibung wäre „kostenloses Werkzeug zur Erfassung der Preisstruktur und für historische Vergleiche; Echtzeitpreise müssen von offiziellen Quellen überprüft werden“.
Kernfunktionen
Vergleichstabelle der Modellpreise
Die Haupttabelle listet nach Modell die Anbieter, die Qualitätseinstufung, die Länge des Kontexts, den Eingabepreis, den Ausgabepreis, die Kenntnisstandsgrenze sowie die Testmöglichkeiten auf. So können Benutzer schnell die Kostenunterschiede zwischen den verschiedenen Modellen erkennen.
Token-Kostenrechner
Die Rechnerkalkulation schätzt die Kosten für eine einzelne Aufrufung oder für mehrere Aufrufe anhand der eingegebenen Token, der ausgegebenen Token sowie des Preises pro Million Token. Sie eignet sich zur groben Kostenschätzung; die tatsächliche Rechnung kann jedoch weitere Kosten für Caching, Toolaufrufe, Bilder, Audioinhalte und Batchverarbeitungen beinhalten.
Modell-Detailseite
Einige Modelle verfügen über eigene Detailseiten, auf denen man den Anbieter, den Kontext sowie die Preisangaben einsehen kann. Die Inhalte der Detailseiten basieren auf demselben Datensystem wie die Haupttabelle; dennoch ist weiterhin auf das Update-Datum zu achten.
Qualitätsindikatoren
Die Seite verwendet Ranglisten von Drittanbieter-Modellen, um eine Qualitätswertung zu erzeugen, die den Nutzern dabei hilft, sowohl Preis als auch Leistung in Betracht zu ziehen. Ein einziger Qualitätswert gleicht die Unterschiede der Modelle in Bezug auf Code, Inferenzfähigkeit, Sprachverarbeitung und langfristige Kontexte aus.
Offizielle Preisquellen-Link
Die Seite listet Quellen für die Preise von OpenAI, Anthropic, Google, Mistral, Cohere, Amazon Bedrock und Groq auf. Die Nutzer sollten diese Anbieterseiten als Endquelle zur Überprüfung heranziehen.
Übersicht der Hauptfunktionen
- Vergleichen Sie die Preis pro Token für Eingabe und Ausgabe bei verschiedenen Anbietern und Modellen.
- Prüfen Sie das Modellkontextfenster und die grundlegenden Qualitätsindikatoren.
- Die API-Kosten werden anhand der erwarteten Eingangs- und Ausgangsdatenmenge berechnet.
- Sie können die Informationen zu einem einzelnen Modell auf der Detailseite des Modells einsehen.
- Von der Preisliste zum Online-Test für bestimmte Modelle.
- Überprüfen Sie die Preise erneut anhand der offiziellen Quellen des Lieferanten.
- Schnelle Erkennung von Modellen, bei denen die Eingaben günstig sind, aber die Ausgaben teuer.
- Erstellen Sie einen ersten Budgetplan für Prototypen, Batch-Verarbeitung und Produktionsströme.
Für welche Anwendungsszenarien geeignet
- Entwickler von KI-Anwendungen: Erkennen Sie die grundlegende Struktur der Abrechnung nach Token.
- Produktmanager: Schätzt in der Anfangsphase die Kosten für verschiedene Modellvarianten ein.
- Gründerteam: Schnelle Filterung der API-Modelle, die weitere Tests benötigen.
- Dozent: Zeigt die Unterschiede zwischen den Eingangs- und Ausgabepreisen der Tokens auf.
- Kostenanalytiker: Etablierung eines Vergleichs zwischen historischen Preisen und Modellgenerationen.
- Einzelentwickler: Schätzung der monatlichen Aufrufkosten für kleine Projekte.
In welchen Fällen ist es nicht geeignet
- Einkaufsentscheidungen erfordern das neueste Modell für 2026 sowie genaue, aktuelle Preise.
- Komplexe Rechnungen, die Caching, Batch-Verarbeitung sowie Layer-basierte Preise für lange Kontexte und regionale Preise erfordern.
- Vergleichen Sie multimodale Projekte mit Preisen für Bilder, Videos, Sprache, Embeds und Fine-Tuning.
- Unternehmen, die API-Verfügbarkeit, Verzögerungen, Durchsatz und Service-Level-Garantien benötigen.
- Es wird gehofft, eine Kostenplattform zu nutzen, die über eine Programmierschnittstelle in Echtzeit Preise abruft.
- Kunden, die Kanäle in China, Steuern und Gebühren in Renminbi sowie Informationen zu lokalen Rechnungen benötigen.
Anleitung zur Preisvergleichsanwendung
- Zuerst müssen Art der Aufgabe, Zielsprache, Länge des Kontexts sowie die Mindestanforderungen an die Qualität festgelegt werden.
- Filtern Sie in der Tabelle die Modelle, die den Anforderungen des Kontexts entsprechen.
- Erhalten Sie getrennte Aufzeichnungen der Eingangs- und Ausgangspreise – schauen Sie nicht nur auf einen einzigen Preis pro Stück.
- Prüfen Sie die Qualitätsbewertung, aber suchen Sie gleichzeitig nach unabhängigen Benchmarks für die jeweilige Aufgabe.
- Tragen Sie die Kandidat-Modelle und Preise in eine Liste zur Überprüfung ein.
- Gehen Sie auf die offiziellen Preisseiten der Hersteller, um den aktuellen Modelltyp und den Einzelpreis zu überprüfen.
- Verwenden Sie echte Anfragsbeispiele, um Token, Verzögerungen und Erfolgsraten zu messen.
Leitfaden zur Kostenermittlung
- Erstellen Sie eine Statistik für den durchschnittlichen Eingabetoken und Ausgabetoken einer typischen Anfrage.
- Schätzen Sie die tägliche Anfragenanzahl, die Spitzenbelastung sowie das monatliche Wachstum.
- Multipliziert jeweils mit dem Preis pro Million Token für Eingang und Ausgang.
- Hinzufügen von Systemhinweisen, Tool-Ergebnissen, Wiederholungen und mehrfachem Historie-Token.
- Separat werden Zusatzkosten für Cache, Batchverarbeitung, Bilder oder Suchfunktionen berechnet.
- Ein Puffer für Wechselkurse, Steuern und Übernutzung einplanen.
- Überprüfen Sie die Schätzungen mit den Rechnungen des Herstellers und kalibrieren Sie sie regelmäßig.
Leitfaden zur Auswahl von Modellen
- Wählen Sie ein hochwertiges Modell und ein kostengünstiges Modell als Baseline aus.
- Erstellen Sie interne Testdatensätze für einfache, gewöhnliche und schwierige Aufgaben.
- Führen Sie den Kandidatensimulator mit festgelegten Prompten und Parametern aus.
- Protokollieren Sie Qualität, Token, Verzögerung, Fehlerrate und tatsächliche Kosten.
- Berechnen Sie die Kosten für jede erfolgreich abgeschlossene Aufgabe, und nicht nur den Preis pro Million Token.
- Versuchen Sie, einfache Aufgaben an kleinere Modelle zu routen.
- Setzen Sie vor der Produktion Budgets, Limitierungen und Rückfallstrategien fest.
Wie versteht man Eingangs- und Ausgangspreise?
| Preispositionen | Abrechnungsinhalte | Häufige Einflussfaktoren | Optimierungsmethoden |
|---|---|---|---|
| Token eingeben | Systemhinweise, Benutzernachrichten, Historie und Tool-Ergebnisse | Länge des Kontexts und wiederholter Inhalte | Kürzen von Hinweisen, Zusammenfassungen der Historie, Nutzung des Caches |
| Ausgabe-Token | Von dem Modell erzeugte Texte oder strukturierte Ergebnisse | Länge der Antwort und Schlussfolgerungsprozess | Beschränkung der maximalen Ausgabe, Anforderung an eine klare Formatierung |
| Cache-Lesung | Wiederholter Präfix oder bereits gecachter Kontext | Cache-Hit und Gültigkeitsdauer | Stabiles Systemhinweis und gemeinsamer Präfix |
| Cache-Schreiben | Erstellung eines wiederverwendbaren Caches | Lieferantenregeln und Aufbewahrungsfristen | Bewerten Sie die Anzahl der Wiederverwendungen, bevor Sie schreiben. |
| Batchverarbeitung | Asynchrone Verarbeitung großer Anfragenmengen | Fristen und Lieferantenrabatte | Nicht-echtzeitige Aufgaben in Batches umwandeln |
| Werkzeuge und Suchfunktionen | Vernetzung, Codeausführung oder externe Tools | Anzahl der Aufrufe und Länge des Ergebnisses | Unnötige Aufrufe reduzieren und Ergebnisse kürzen |
Kostenrechnungsformel
Die grundlegende Schätzung für ein Textmodell lässt sich wie folgt ausdrücken: Der Eingabetokenwert geteilt durch eine Million, multipliziert mit dem Preis pro Eingabetoken, plus der Ausgabetokenwert geteilt durch eine Million, multipliziert mit dem Preis pro Ausgabetoken. Bei mehreren Dialogrunden müssen außerdem die in jeder Runde erneut übermittelten Inhalte berücksichtigt werden.
| Szene | Token eingeben | Ausgabe-Token | Wichtige Punkte für die Schätzung |
|---|---|---|---|
| Kurze Fragen und Antworten | Weniger | Weniger | Preisdifferenzen sind in der Regel nicht auffällig. |
| Zusammenfassung des langen Textes | Viele | Mittel | Die Eingabe und die Hierarchisierung der Preise im langen Kontext sind wichtiger. |
| Inhaltsgenerierung | Mittel | Viele | Der Auslieferungspreis ist die Hauptkostenstelle. |
| RAG-Fragen und Antworten | Systemhinweise, Suchauszüge und viel Historie | Mittel | Das Suchen nach Redundanzen erhöht die Eingabekosten. |
| Agenten | Die Ergebnisse mehrerer Durchgänge des Tools sammeln sich kontinuierlich an. | Mehrfache Ausgaben | Wiederholungen und Schleifen können die Rechnung schnell in die Höhe treiben. |
| Massenklassifizierung | Kurze Eingaben werden oft wiederholt. | Sehr kurze Ausgabe | Geeignet für kleine Modelle und Batch-Verarbeitung |
Warum bedeutet der niedrigste Einzelpreis nicht unbedingt die niedrigsten Kosten
Bei billigen Modellen kann der Gesamtkosten für jede erfolgreich abgeschlossene Aufgabe höher sein, falls mehr Versuche nötig sind, längere Anleitungen erforderlich sind oder manuelle Nacharbeiten durchgeführt werden müssen. Hochwertige Modelle hingegen können, da sie die Aufgabe auf einen Schlag erledigen, im gesamten Prozess kostengünstiger sein.
- Vergleichen Sie die durchschnittliche Anzahl an Aufrufen, die für eine erfolgreiche Aufgabe erforderlich sind.
- Berücksichtigen Sie die Zeit für die manuelle Überprüfung und Fehlerbehebung in den Kosten.
- Man sollte die tatsächliche Ausgangslänge des Modells messen, anstatt nur den theoretischen Preis zu betrachten.
- Berücksichtigen Sie Geschwindigkeitsbeschränkungen, Zeitüberschreitungen und Fehlerrückfallstrategien.
- Je nach Schwierigkeit der Aufgabe wird ein mehrmodellbasiertes Routing verwendet.
- Gleichermaßen werden die Auswirkungen von Verzögerungen und Durchsatz auf das Geschäft verglichen.
Häufig fehlende Kosten in der Preisliste
| Kostenkategorien | Abdeckung von LLM Price Check | Wo muss man das überprüfen? |
|---|---|---|
| Hinweis-Cache | Die meisten alten Einträge sind nicht vollständig dargestellt. | Offizielle Preisangaben des Modellherstellers und Cache-Dokumentation |
| Batch-Discount | Nicht vollständig dargestellt | Hersteller-Batch-Hinweise |
| Lange Kontextschichtung der Preise | Nicht vollständig dargestellt | Preistabelle für die entsprechenden Modelle |
| Logik-Token | Nicht einheitlich dargestellt | Erklärung zur Abrechnung von Reasoning-Modellen |
| Bilder und Audio | Nicht zum Schwerpunkt der Haupttabelle gehörig | Preisseite für multimodale APIs |
| Vernetzte Suchfunktionen und Tools | Nicht einheitlich dargestellt | Erklärung zu den Kosten für Tool-Aufrufe |
| Feinabstimmung und Speichern | Nicht angezeigt | Feinabstimmung der Preise für die Dateispeicherung |
| Regionale Verarbeitung und Steuern | Nicht angezeigt | Kontoregion und Abrechnungsseite |
Wie sollte man die Qualitätseinheit interpretieren?
Die Qualitätsbewertung der Seiten stammt von externen Ranglisten und eignet sich nur für eine grobe Sortierung; sie zeigt nicht an, dass das Modell in allen Aufgaben gleich gut ist. Die Fähigkeiten im Umgang mit Code, Mathematik, Chinesisch, Aufrufen von Tools sowie bei der Verarbeitung langer Dokumente müssen separat getestet werden.
- Überprüfen Sie die Quelle der Qualitätsdaten sowie das Update-Zeitpunkt.
- Vergleichen Sie keine unbeschriebenen Bewertungen von verschiedenen Referenzpunkten und Versionen.
- Prüfen Sie die Klassifikationskriterien, die zur Branche passen.
- Auf den Kandidatenmodellen wird ein einheitliches internes Testset ausgeführt.
- Fügen Sie Halluzinationen, Sicherheit und Formatstabilität zur Bewertung hinzu.
- Berechnen Sie die Kosten für die Anfrage nach einer Qualität, die den Preisvorgaben entspricht.
Risiko der Aktualität der Daten
Die Preise und Namen der großen Modelle ändern sich häufig. Die Hersteller fügen neue Modelle hinzu, senken die Preise, deaktivieren alte Versionen oder ändern die Caching-Regeln. Tabellen von Drittanbietern verlieren innerhalb weniger Wochen ihre Bedeutung als Kaufreferenz, wenn das Update-Datum fehlt.
- Seien Sie wachsam, wenn im Tableau ausgemusterte oder veraltete Modelle auftauchen.
- Überprüfen Sie, ob die Modell-ID mit dem tatsächlichen Namen der API-Aufrufung übereinstimmt.
- Überprüfen Sie, ob die Preisangabe pro Tausend oder pro Million Token ist.
- Überprüfen Sie, ob Eingabe, Ausgabe, Cache und langer Kontext getrennt berechnet werden.
- Im Budgetdokument sollten das Prüfdatum sowie ein Screenshot der offiziellen Seite festgehalten werden.
- Nach dem Go-Live wird die Preisliste kontinuierlich mit den tatsächlichen Rechnungen kalibriert.
Ist die Website selbst kostenpflichtig?
Die Preisliste und Rechner von LLM Price Check sind direkt zugänglich; es werden keine Mitgliedschaften oder kostenpflichtigen Pakete für Nutzer angeboten. Dargestellt werden die Preise für APIs von Drittanbieter-Modellen, wobei nicht für den Verkauf dieser Modell-Lizenzen verantwortlich gemacht wird.
| Projekt | Kosten | Erklärung |
|---|---|---|
| Preistabelle ansehen | Kostenlos | Es ist nicht notwendig, Lizenzen für Modelle zu kaufen. |
| Verwenden Sie einen Taschenrechner. | Kostenlos | Nur Schätzungen – es werden keine API-Aufrufe generiert. |
| Modell öffnen, um es auszuprobieren | Wird von einer externen Plattform entschieden. | Es kann ein Anmelden oder Bezahlen erforderlich sein. |
| Modell-API aufrufen | Kosten durch den Anbieter des Modells | Gemäß der Rechnung des Dienstleisters. |
| Unternehmensbudget und -kontrolle | Die Website bietet keinen vollständigen Service an. | Ein separates Gateway oder Überwachungstool ist erforderlich. |
Daten und Privatsphäre
Die Rechner benötigen nur die Anzahl der Tokens sowie den Preis des Modells; in der Regel ist es nicht notwendig, echte Anweisungen, Kundeninhalte oder API-Schlüssel einzugeben. Benutzer sollten ihre Zugangsdaten nicht auf irgendwelchen Webseiten zur Preisvergleich mit Drittanbietern eingeben.
- Geben Sie nur die Anzahl der Tokens ein, senden Sie keinen echten Geschäftstext.
- Fügen Sie den API-Schlüssel nicht in die Webseitenparameter oder Anmerkungen ein.
- Die Verwendung eines sensiblen Budgets erfolgt durch die Berechnung mit lokalen Tabellen oder internen Kostensystemen.
- Formelle Beschaffungen werden über die Lieferantenkonsole und Vertragsbestätigungen abgewickelt.
- Unternehmen prüfen vor der Nutzung die Datenschutzrichtlinien der Website, die Cookie-Einstellungen sowie die Informationen über den Betreiber.
Vorteile des Produkts
- Die Benutzeroberfläche ist einfach, sodass man die Preise der eingegebenen und ausgegebenen Tokens schnell verstehen kann.
- Vergleichen Sie mehrere Modellanbieter in derselben Tabelle.
- Zusätzliche Felder wie Kontext, Qualität und Wissensstichtag werden bereitgestellt.
- Die Rechenuhr eignet sich für den Unterricht und zur ersten Kostenschätzung.
- Kostenloser Zugang, kein Abo erforderlich.
- Es werden einige offizielle Preisquellen aufgeführt, um eine Überprüfung zu erleichtern.
Einsatzbeschränkungen und Hinweise
- Das aktuelle Modell und die Preise sind deutlich veraltet und können daher nicht als Grundlage für Einkäufe in Echtzeit herangezogen werden.
- Jede Zeile weist kein klares, einheitliches Endprüfungsdatum auf.
- Alte Modelle könnten bereits außer Dienst gestellt, umbenannt oder im Kontext angepasst worden sein.
- Die Quellen der Qualitätsbewertung und die Versionen können nicht alle Geschäftsfähigkeiten widerspiegeln.
- Die Preise für Caching, Batchverarbeitung, Inferenz und langen Kontext werden nicht vollständig abgedeckt.
- Kosten für unberücksichtigte Bilder, Videos, Audiodateien, Einbettungen und Feinabstimmungen.
- Derselbe Modell kann bei verschiedenen Cloud-Anbietern unterschiedliche Preise und Bedingungen haben.
- Die Berechnungsergebnisse beinhalten keine Steuern, Wechselkurse, Versuche zur Wiederholung bei Fehlern sowie Personalkosten.
- Die Website verfügt weder über ein überprüfbares offizielles Quellcode-Repository noch über vollständige Betriebsinformationen.
GitHub und der Open-Source-Zustand
Zum Zeitpunkt der Überprüfung konnte kein offizielles Quellcode-Repository gefunden werden, auf das von der offiziellen Website von LLM Price Check explizit verlinkt wird und dessen Zugehörigkeit überprüft werden kann. Das mit der Datenbank verbundene OpenChat-Repository ist lediglich die Quelle für die Projekte des OpenChat-Modells in der Preisliste und nicht der Code der Website von LLM Price Check.
Daher sollte diese Website als „kein offizielles Open-Source-Repositorium gefunden“ gekennzeichnet werden. Andere Projekte mit ähnlichen Namen wie llm-prices, llmpricing oder PriceToken sind eigenständige Tools und dürfen nicht mit dem Quellcode dieser Website verwechselt werden.
Grundlegende Informationen
| Felder | Inhalt |
|---|---|
| Name des Tools | LLM Price Check |
| Arten von Werkzeugen | Vergleich der Preise für APIs großer Modelle sowie Kostenermittler |
| Hauptfelder | Modell, Anbieter, Qualität, Kontext, Eingangspreis, Ausgangspreis |
| Preis-Einheit | Hauptsächlich nach dem Preis pro Million Token in US-Dollar |
| Nutzungsgebühren | Kostenlos |
| Ist eine Registrierung erforderlich? | Grundtabellen und Rechner sind nicht erforderlich. |
| Datenstatus | Es besteht derzeit eine deutliche Verzögerung. |
| Wird eine API verkauft? | Nein |
| Wird eine öffentliche API bereitgestellt? | Nicht gefunden |
| Ob Open Source | Keine verifizierbaren offiziellen Lager gefunden. |
Empfehlungswert
3,2 / 5. Die Benutzeroberfläche von LLM Price Check ist intuitiv und eignet sich zur Verständnis der Token-Berechnung sowie zur ersten Überprüfung der historischen Preise; doch die aktuellen Daten sind offensichtlich veraltet, es fehlen Angaben zum Update-Zeitpunkt sowie zu komplexen Abrechnungskriterien, weshalb sie nicht direkt für die endgültige Auswahl im Jahr 2026 verwendet werden können.
Häufige Fragen
Ist die LLM Price Check kostenlos?
Preistabellen und Rechner können kostenlos genutzt werden; es gibt keine Mitgliedspakete. Für die Nutzung der Modelle in der Aufruftabelle muss weiterhin an den jeweiligen API-Anbieter gezahlt werden.
Sind die Preise auf der Website in Echtzeit?
Es ist nicht möglich, die Daten in Echtzeit zu verwenden. Die aktuelle Seite enthält weiterhin viele alte Modelle sowie historische Preise. Für die offiziellen Angaben zum Budget muss man auf der offiziellen Website des Anbieters nachschauen.
Wie wird die Kosten für eine Anfrage berechnet?
Teilen Sie die Eingangs- und Ausgabetoken jeweils durch eine Million, multiplizieren Sie das Ergebnis mit dem entsprechenden Preis pro Token und addieren Sie diese Werte. Zusätzlich müssen noch Kosten für Cache, Tools, Wiederholungsversuche sowie mehrmodale Funktionen hinzugefügt werden.
Je höher die Qualitätsbewertung, desto lohnender ist der Kauf?
Nicht unbedingt. Die Gesamtbewertung der Qualität kann die Qualität einer bestimmten Aufgabe nicht widerspiegeln; stattdessen sollten Qualität, Verzögerungen und Gesamtkosten jeder erfolgreich abgeschlossenen Aufgabe verglichen werden.
Kann man einen API-Schlüssel eingeben?
Es ist nicht notwendig und auch nicht erforderlich, etwas einzugeben. Das Tool dient lediglich als Preisliste und Rechner – es ist nicht dafür zuständig, die Modellkonten der Benutzer zu aufrufen.
Wird die Caching- und Batch-Preisberechnung unterstützt?
Die aktuelle Haupttabelle umfasst diese komplexen Abrechnungspunkte nicht vollständig. Es ist notwendig, die neuesten Preise sowie die Hilfedokumente des jeweiligen Herstellers zu prüfen.
Ist LLM Price Check open source?
Es wurde kein verifizierbarer offizieller Quellcode-Repository gefunden. OpenChat auf GitHub ist lediglich die Quelle für die Modelle in der Tabelle und hat nichts mit dem Quellcode der Website zu tun.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164