Google AI Studio
Entwicklungsplattform zur Erprobung des Gemini-Modells, zur Erstellung von Designvorschlägen und zur Generierung von API-Code
Tags:KI-TrainingsmodelleWas ist Google AI Studio?
Google AI Studio ist eine im Browser nutzbare Plattform für Experimente und die Erstellung von Anwendungen, die Google für Entwickler von Gemini bereitstellt. Benutzer können direkt Modelle auswählen, Systemanweisungen schreiben, mehrmodale Inhalte hochladen, Betriebsparameter anpassen und die Fähigkeiten der Gemini-API testen.
Die Plattform bietet außerdem den Build-Modus, mit dem vollständige Webanwendungen oder native Android-Anwendungen mithilfe natürlicher Sprache erstellt werden können. Diese Anwendungen können im Browser vorgesehen und weiterentwickelt werden. Nach Fertigstellung des Prototyps können Entwickler den Code erhalten, eine API-Key erstellen oder das Projekt exportieren, um mit der weiteren Entwicklung fortzufahren.
Hauptfunktionen von Google AI Studio
- Modellversuche:Wechseln Sie auf der Webseite zwischen den verfügbaren Gemini-Modellen, um die Qualität der Antworten, die Geschwindigkeit sowie die Inferenzfähigkeit schnell zu vergleichen.
- Systemanweisungen:Legen Sie Rollen, Tonfall, Ausgabeformat, Grenzen und Aufgabenregeln fest und testen Sie dies durch wiederholte Dialoge.
- Multimodale Eingabe:Verarbeitung von Inhaltstypen wie Text, Bilder, Audio, Video, PDF und Code.
- Betriebsparameter:Anpassung der Modellparameter, Sicherheitseinstellungen, Kontext und Generierungskonfiguration.
- Strukturierte Ausgabe:Lassen Sie das Modell Ergebnisse gemäß dem angegebenen JSON Schema zurückgeben, was sich gut für die Datenauswertung und die Programmverarbeitung eignet.
- Funktion aufrufen:Definieren Sie externe Funktionen und Parameter, damit das Modell entscheiden kann, wann das Geschäftssystem oder die Tools aufgerufen werden sollen.
- Codeausführung:Es wird dem Modell gestattet, kontrollierten Code auszuführen, um Aufgaben wie Berechnungen, Datenanalyse und Erstellung von Diagrammen durchzuführen.
- Suche nach Erdung:Durch die Verbindung mit Tools wie Google Search werden Antworten erzeugt, die den aktuellen Daten besser entsprechen.
- Live API:Testen der Fähigkeiten von Gemini in den Bereichen Audio mit niedriger Verzögerung, Video sowie Echtzeitinteraktion.
- Get code:Übersetzen Sie die bereits getesteten Prompt-Beispiele in Aufrufbeispiele für Python, JavaScript, REST usw.
- API-Schlüssel-Verwaltung:Erstellen und Verwalten der für die Gemini Developer API erforderlichen Projekte und Schlüssel.
- Build-Modus:Erstellen, ausführen und anpassen von Full-Stack-Web- oder nativen Android-Anwendungen durch Dialoge.
Vergleich von Prompt- und Build-Modus
| Muster | Hauptverwendungszweck | Typische Produkte |
|---|---|---|
| Chat Prompt | Testen von mehrfachigen Dialogen, Systemanweisungen und Modellverhalten | Wiederverwendbare Prompt-Sätze und API-Code |
| Structured Output | Strukturierte Daten nach Schema extrahieren und erzeugen | JSON-Ergebnisse und Programmierschnittstelle |
| Function Calling | Verbindung von Geschäftsfunktionen, Datenbanken und externen Diensten | Parameter für Toolaufrufe und Agent-Prototypen |
| Build Web | Erstellung einer Webanwendung mit Frontend, Serverseite und Abhängigkeiten | React-Frontend und Node.js-Server-Projekt |
| Build Android | Eigene Mobile-Apps erstellen und online voranschauen | Kotlin und Jetpack Compose-Projekte |
Was kann der Build-Modus leisten?
- Tipps zur Erstellung einer Website:Nach der Beschreibung von Produkten, Seiten und Interaktionen wird eine Anwendung mit mehreren Dateien erstellt, und es wird eine Echtzeit-Voransicht angezeigt.
- Projektimportieren:Man kann vorhandenen Code von GitHub importieren, damit der Agent ihn verstehen und weiter anpassen kann.
- Vollständige Ausführung:Die Webanwendung enthält standardmäßig eine React-Frontend-Schicht sowie einen Node.js-Server, wobei npm-Abhängigkeiten installiert werden können.
- Schlüsselverwaltung:Speichern Sie die API-Schlüssel Dritter in den Servereinstellungen, um zu vermeiden, dass sie direkt im Browsercode sichtbar werden.
- Firebase-Integration:Fähigkeiten wie die Verbindung von Webanwendungen mit Firestore und Firebase Authentication.
- Echtzeit-Kollaboration:Der Server kann im Betrieb mehrere Benutzerzustände sowie Verbindungsscenarien unterstützen.
- Erstellt von Android:Erstellen Sie ein standardmäßiges Gradle-Projekt und prüfen Sie die Kotlin-Anwendung im Cloud-Simulator.
- Geräteprüfung:Es wird die Installation der Erstellten Ergebnisse auf ein für die Debugging-Funktionen konfiguriertes Android-Gerät über kompatible Browser unterstützt.
- Testveröffentlichung:Es ist möglich, es über die Google Play Console auf die interne Teststrecke zu veröffentlichen; eine offizielle Veröffentlichung erfordert jedoch weiterhin die Verwaltung in der Play Console.
Preistypen für Google AI Studio und Gemini API
Google AI Studio bietet zwar eine kostenlose Möglichkeit zum Ausprobieren, doch die Nutzung ist durch die Verfügbarkeit der Modelle sowie durch regionale und zeitliche Beschränkungen eingeschränkt. Nach der Erstellung eines kostenpflichtigen Projekts wird die Gemini API nach den verwendeten Modellen, den Eingangs- und Ausgangstokens, der Erstellung von Medieninhalten sowie weiteren Tools abgerechnet – es handelt sich dabei nicht um eine monatliche Gebühr, mit der eine unbegrenzte Nutzung möglich wäre.
| Typ | Abrechnungsmethode | Verwendung der Daten | Passende Szenarien |
|---|---|---|---|
| Free | Modell und Limit für qualifizierte Fälle sind kostenlos, es gibt jedoch Geschwindigkeitsbeschränkungen. | Inhalt von kostenfreien Diensten kann zur Verbesserung des Produkts verwendet werden. | Lernen, Prompt-Experimente und kleine Prototypen |
| Paid | Vorauszahlung oder Abrechnung nach Verbrauch, berechnet nach Modell und Tool | Hinweise und Antworten dienen nicht zur Verbesserung des Produkts. | Produktionsanwendungen, höhere Limits und Kontextcaching |
| Enterprise | Kontaktieren Sie den Vertrieb, um ein Angebot entsprechend den Anforderungen und dem Umfang zu erhalten. | Gemäß den Unternehmensdaten und Compliance-Vorschriften verarbeiten. | Exklusiver Support, Sicherheitskonformität und reservierter Durchsatz |
Die Liste der Modelle in den kostenlosen, bezahlten und Unternehmensversionen ist nicht identisch. Region, Kontoinanspruch, Vorab-Modelle, Quoten sowie Zahlungsmethoden können variieren; es sollten stets die Angaben auf der AI Studio-Projektdetailseite sowie auf der offiziellen Preisliste herangezogen werden.
Beispiel für die Abrechnung über die Gemini-API
Im Folgenden finden Sie Beispiele für die Standardgebühren von Gemini 3.6 Flash, wie sie auf der offiziellen Preisseite bei der Überprüfung angegeben sind. Die Angaben beziehen sich jeweils auf den Preis pro 1 Million Tokens in US-Dollar. Da sich die Versionen des Modells ständig ändern, kann diese Tabelle nicht als einheitlicher Preis für andere Gemini-Modelle herangezogen werden.
| Schlussfolgerungsstufen | Eingabepreis | Auslieferungspreis | Zusammenhangsspeicherung für Eingaben |
|---|---|---|---|
| Standard | 1,50 US-Dollar | 7,50 US-Dollar, inklusive Gedanken-Token | 0,15 US-Dollar |
| Batch | 0,75 US-Dollar | 3,75 US-Dollar, inklusive Denk-Token | 0,075 US-Dollar |
| Flex | 0,75 US-Dollar | 3,75 US-Dollar, inklusive Denk-Token | 0,075 US-Dollar |
| Priority | 2,70 US-Dollar | 13,50 US-Dollar, inklusive Gedanken-Token | 0,27 US-Dollar |
Der Referenzpreis für die Caching-Speicherung in diesem Modell beträgt 1 US-Dollar pro Stunde für 1 Million Token. Bei der Standard-Preisklasse bietet Google Search und Maps monatlich 5000 kostenlose Suchanfragen an; ab dieser Menge liegt der offizielle Referenzpreis bei 14 US-Dollar pro 1000 Suchanfragen.
Aus welchen Bestandteilen setzen sich die API-Kosten zusammen?
- Eingeben Sie den Token:Systemanweisungen, Dialoghistorie, Texte, Dateien und Tool-Kontexte werden alle berücksichtigt.
- Ausgabetoken:Die Antworten des Modells sowie die durch das verwendete Modell erzeugten Gedanken-Tokens können zusammen abgerechnet werden.
- Context-Cache:Das Schreiben oder Lesen aus dem Cache sowie die dauerhafte Speicherung können jeweils Gebühren verursachen.
- Batchverarbeitung:Geeignet für große Mengen an Aufgaben, bei denen keine sofortige Rückgabe erforderlich ist, und ist in der Regel günstiger als Standard-Realtime-Anfragen.
- Medienproduktion:Bilder, Videos, Sprach- und Musikmodelle werden einzeln nach ihren jeweiligen Einheiten berechnet.
- Erdenwerkzeuge:Dienste wie Google Search und Maps können ab dem kostenlosen Umfang nach der Anzahl der Abfragen Gebühren verlangen.
- Modellversion:Die Preise, der Kontext und die Einschränkungen für die Pro-, Flash-, Flash-Lite- sowie Vorschauversionen unterscheiden sich.
- Langes Gespräch:Jede Anfrage enthält mehr historische Inhalte, wodurch der Tokenverbrauch bei anhaltendem Chatten schnell zunehmen kann.
Anleitungen zum Testen von Prompten
- Neuer Hinweis:Nach dem Anmelden wählen Sie das passende Gemini-Modell und den Chat-Prompt aus.
- Systemanweisungen schreiben:Klare Definitionen der Rollen, Aufgaben, Zielgruppen, Verbotene Handlungen, Anforderungen an Belege und Ausgabeformat.
- Beispiele hinzufügen:Bieten Sie ein bis zwei Beispiele für hochwertige Eingaben und Ausgaben, um dem Modell zu helfen, die Standards zu verstehen.
- Einstellungen anpassen:Konfigurieren Sie in den Laufeinstellungen die Modellparameter, Sicherheitsoptionen und die erforderlichen Tools.
- Umfassende Grenzen:Testen Sie normale Eingaben, unklare Fragen, überlange Inhalte, bösartige Befehle und leere Daten.
- Vergleichbare Versionen:Wechseln Sie mit dem gleichen Testset zwischen den Modellen und dokumentieren Sie Qualität, Verzögerung, Tokens sowie Fehlversuche.
- Code erhalten:Sobald das Ergebnis stabil ist, verwendet man „Get code“, um Beispiele für Aufrufe zu exportieren, und speichert den Schlüssel auf der Serverseite.
Lehrbuch zur strukturierten Ausgabe und Funktionsaufrufe
- Zuerst werden die für den Geschäftsbetrieb benötigten Felder, Datentypen, Pflichtfelder sowie zulässige Enumerierungswerte definiert.
- Aktivieren Sie die strukturierte Ausgabe und konfigurieren Sie das Schema, um fehlende Felder mit echten und abweichenden Beispielen zu testen.
- Wenn eine Aktion ausgeführt werden muss, müssen Name der Funktion, Zweck, Parameter und Einschränkungen definiert werden, damit das Modell keine hochriskanten Operationen direkt ausführt.
- Nach Erhalt der Parameter für die Funktionsaufrufe übernimmt die Anwendung die Authentifizierung, die Überprüfung der Berechtigungen sowie die Validierung der Daten.
- Funktionen werden auf der Serverseite ausgeführt, und das Ergebnis wird an das Modell zurückgegeben, um eine für den Benutzer lesbare Endantwort zu erzeugen.
- Für Operationen wie Zahlungen, Löschungen, Versendung von Nachrichten und externe Veröffentlichungen werden manuelle Bestätigungen sowie Audit-Logs hinzugefügt.
Anwendung mit dem Build-Modus erstellen
- Plattform auswählen:Im Build-Modus wird festgelegt, ob eine Webanwendung oder eine native Android-Anwendung erstellt werden soll.
- Beschreibung der Anforderungen:Erklärt Benutzer, Seiten, Daten, Berechtigungen, technische Einschränkungen und Akzeptanzkriterien.
- Projekt erstellen:Beginnen Sie mit leeren Vorlagen, einer Galerie von Vorlagen oder importierten GitHub-Projekten.
- Code überprüfen:Prüfen Sie gleichzeitig die Echtzeit-Voransicht sowie das Code-Tag, um Abhängigkeiten, Datenflüsse und die Positionen der Schlüssel zu überprüfen.
- Schrittweise Iteration:Ändern Sie jeweils nur ein klares Ziel und führen Sie nach jeder Änderung den Kernprozess aus.
- Sicherheitstests:Überprüfen Sie Anmelden, Übergriffe, Eingabekontrolle, Fehlerbehandlung und den Datenverlust sensibler Informationen.
- Exportieren der Bereitstellung:Laden Sie den Code vor der Produktveröffentlichung herunter oder synchronisieren Sie ihn, um Prozesse für Versionskontrolle, Testing und Überwachung einzurichten.
Für welche Nutzer eignet sich Google AI Studio?
- AI-Entwickler:Debugging des Gemini-Modells, Aufruf von Tools, strukturierte Ausgabe und multimodale Anfragen.
- Produktmanager:Es ist nicht notwendig, eine vollständige Backend-Infrastruktur aufzubauen, um die Funktionen der KI sowie die Interaktionsprozesse zu überprüfen.
- Frontend- und Full-Stack-Teams:Erstellen Sie über den Build-Modus eine ausführbare Anwendung und integrieren Sie sie anschließend in das offizielle Projekt.
- Android-Entwickler:Erstellen Sie mit natürlicher Sprache Kotlin-Prototypen und testen Sie sie in einem Cloud-Simulator.
- Daten-Team:Überprüfung von Dokumentenauszug, Klassifizierung, Zusammenfassung und Batch-Verarbeitungslösungen.
- Pädagogen und Forscher:Erkunden Sie multimodale Modelle, Prompting-Techniken und die Funktionen der Gemini-API.
- Gründerteam:Schnelles Erstellen von Prototypen, doch sie müssen noch ingenieurtechnisch weiterentwickelt werden, um zuverlässig in Betrieb genommen zu werden.
Vorteile des Produkts
- Es ist nicht notwendig, lokal zu installieren, um die neuesten Gemini-Modelle sowie ihre multimodalen Fähigkeiten zu testen;
- Systemanweisungen, Parameter, Werkzeuge und Sicherheitseinstellungen in einer einzigen Experimentieroberfläche zusammenfassen;
- Es ist möglich, API-Code in mehreren Sprachen direkt zu exportieren, wodurch der Weg vom Experiment bis zur Entwicklung verkürzt wird.
- Der Build-Modus kann Projekte mit mehreren Dateien für Frontend und Backend erstellen und diese in Echtzeit ausführen.
- Unterstützung für GitHub-Import, npm-Abhängigkeiten, Firebase und Server-Schlüssel;
- Erstellung von Standard-Kotlin- und Jetpack Compose-Projekten für Android;
- Das offizielle Kochbuch bietet zahlreiche Beispiele für eine schnelle Einarbeitung sowie Kombinationsmöglichkeiten.
Hinweise zur Datensicherheit und Privatsphäre
Laut den offiziellen Zusatzbedingungen gehören die kostenlosen Nutzungsrechte für Google AI Studio und Gemini API zu den kostenlosen Dienstleistungen. In diesem Fall können die eingereichten Inhalte sowie die erzeugten Antworten dazu verwendet werden, Produkte bereitzustellen, zu verbessern und weiterzuentwickeln. Zudem können sie von menschlichen Prüfern bearbeitet werden. Bei den kostenlosen Dienstleistungen sollten keine sensiblen, vertraulichen oder persönlichen Informationen eingereicht werden.
Für die bezahlten Dienste der Gemini-API erklärt Google, dass keine Prompts, Systemanweisungen, gespeicherte Inhalte, hochgeladene Dateien oder Antworten zur Verbesserung des Produkts verwendet werden. Daten werden jedoch aus Sicherheitsgründen, zur Prävention von Missbrauch sowie aufgrund rechtlicher Anforderungen für einen begrenzten Zeitraum aufgezeichnet. Die geltenden Bedingungen können je nach Region unterschiedlich sein.
- Schreiben Sie den API-Schlüssel nicht in den Browsercode, die Paketdateien der mobilen Anwendung, öffentliche Repositorien oder Screenshote.
- Verwenden Sie die Secrets-Funktion im Build-Modus oder ein zuverlässiges Server-basiertes Schlüsselverwaltungssystem;
- Stellen Sie vor dem Hochladen von Kundendaten, medizinischen, finanziellen und internen Dokumenten sicher, dass die verwendete Serviceebene sowie die Unternehmensrichtlinien eingehalten werden.
- Bei der Aufrufung einer Funktion müssen am Anwendungsseite Parameter, die Identität des Benutzers, Berechtigungen sowie der Umfang der Ausführung überprüft werden.
- Für APIs Budgetwarnungen, Geschwindigkeitsbeschränkungen, Maskierung von Protokollen sowie Schlüsselwechsel einrichten;
- Die Suche nach Referenzen und Modellantworten kann weiterhin fehlerhaft sein; wichtige Schlussfolgerungen müssen in der ursprünglichen Quelle überprüft werden.
Einsatzbeschränkungen und Hinweise
- Verfügbare Modelle, Vorabversionen und Bandbreitenbeschränkungen ändern sich häufig; in der Produktionsumgebung sollten die Modellversionen festgelegt und überwacht werden.
- Die kostenlose Nutzung von AI Studio bedeutet nicht, dass Anrufe an die Gemini-API dauerhaft kostenlos sind;
- Lange Gespräche wiederholen den Kontext, wodurch die Kosten und Verzögerungen in jeder Runde zunehmen können;
- Erstellte Anwendungen können fehlerhafte Abhängigkeiten, unsicheren Code oder unvollständige Fehlerbehandlung enthalten und müssen manuell überprüft werden;
- Der Android-Cloud-Emulator unterstützt nicht alle Hardwarefunktionen – Funktionen wie Kamera, NFC und Bluetooth müssen an einem echten Gerät getestet werden.
- Die Funktionen von AI Studio eignen sich für Prototypen und Tests, während Produktionsysteme weiterhin kontinuierliche Integration, Rollback-Möglichkeiten sowie Überwachung erfordern.
- Verschiedene Länder und Konten können möglicherweise nicht denselben Modellen, Zahlungsmethoden oder Experimentierfunktionen nutzen.
GitHub und Erklärungen zu Open Source
Google unterhält ein öffentliches Gemini API Cookbook, das Einführungen in Python, JavaScript und REST sowie Beispiele für multimodale Funktionen, Codeausführung, Live-APIs und Agenten enthält. Dieser Repository wird unter der Apache 2.0-Lizenz bereitgestellt, und Google stellt außerdem SDKs für Python, Node.js, Go, Java und C# zur Verfügung.
Die Google AI Studio-Plattform sowie das Gemini-Modell selbst sind keine Open-Source-Projekte. Dass die Cookbooks, SDKs und Beispielcodes offen zugänglich sind, bedeutet lediglich, dass die Entwicklungstools eingesehen und wiederverwendet werden können; daraus lässt sich jedoch nicht schließen, dass die Modellgewichte oder die Online-Plattform selbst open source sind.
Häufige Fragen
Ist Google AI Studio kostenlos?
Erfüllende Modelle und Limits können kostenlos genutzt werden, es gibt jedoch Einschränkungen hinsichtlich der Modelle, der Geschwindigkeit und der Regionen. Für Produktionsaufrufe ist in der Regel die kostenpflichtige Gemini API-Version erforderlich, wobei die Gebühren nach der tatsächlichen Anzahl der Tokens und der Nutzung des Tools berechnet werden.
Kann Google AI Studio vollständige Anwendungen erstellen?
Ja. Im Build-Modus können Webanwendungen mit einer React-Frontend-Schicht und einem Node.js-Server erstellt werden, außerdem können auch native Android-Projekte in Kotlin mit Jetpack Compose erstellt werden.
Ist Google AI Studio wie die Gemini-App?
Es ist unterschiedlich. Die Gemini-App dient dem täglichen Gespräch sowie als Hilfsprogramm für Inhalte, während Google AI Studio sich stärker auf das Testen von Modellen, die Konfiguration von APIs, den Export von Code sowie die Entwicklung von Anwendungen konzentriert.
Wird die Daten in Google AI Studio zur Trainierung verwendet?
Laut den offiziellen Bedingungen können Inhalte von kostenfreien Diensten zur Verbesserung des Produkts verwendet werden und möglicherweise einer manuellen Überprüfung unterzogen werden; Anfragen und Antworten bei kostenpflichtigen API-Diensten dienen hingegen nicht zur Verbesserung des Produkts.
Konkret muss dies noch in Abhängigkeit von der Region und den geltenden Bestimmungen beurteilt werden.
Ist Google AI Studio open source?
Die Plattform sowie das Gemini-Modell sind nicht open source. Das offizielle Cookbook, die SDKs sowie einige Beispielprojekte sind hingegen unter einer Open-Source-Lizenz verfügbar und können zum Lernen sowie zur Entwicklung von Anwendungen genutzt werden.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164