Future AGI
Future AGI – ein intelligentes Tool zur Bewertung von KI-Modellen
Tags:Bewertung von KI-ModellenWas ist künftige AGI?
Future AGI ist eine End-to-End-Plattform zur Erstellung, Testung, Überwachung und Verbesserung von LLM-Anwendungen sowie KI-Agenten. Sie verbindet Simulation, Bewertung, Sicherheitsmechanismen, Tracking, Gateways, Datensätze und Prompt-Optimierung zu einem einzigen Feedbackzyklus.
Die Plattform bietet sowohl gehosteten Cloud-Service als auch den öffentlich zugänglichen Quellcode für eine eigene Hosting-Lösung. Ingenieure, Produktmanager und Fachexperten können in einem und demselben Projekt Qualität, Kosten, Verzögerungen, Fehler sowie manuelle Annotationen einsehen.
Eine kurze Beschreibung
Future AGI hilft Teams dabei, KI-Agenten vor dem Go-Live zu simulieren, nach dem Go-Live zu überwachen und zu bewerten, sowie Anweisungen und Agentenprozesse kontinuierlich mit Echtzeit-Schutzmechanismen und Produktionsfeedback anzupassen.
Sechs Produktmodule
| Modul | Kernkompetenzen | Haupteingabe | Hauptergebnisse |
|---|---|---|---|
| Build | Agent Playground, Prompt und Dataset | Anleitungen, Werkzeuge, Daten | Definition und Version des Agents |
| Command Center | Routing, Caching, Schutzmechanismen und Kostenkontrolle | Modellanfrage | Einheitliches Modell für Reaktionen und Governance |
| Simulate | Synthetische Benutzer und Testszenarien | Personen, Drehbücher, Datensätze und Diagramme | Text- oder Sprachgespräch |
| Evaluate | Heuristiken, Code, Modellbewertung und agentebasierte Bewertung | Datensätze, Tracking oder Eingabe in Echtzeit | Noten, Erklärungen und Fehlerbezeichnungen |
| Observe | Tracking, Sessions, Fehlerstrom und Dashboard | Produktionsumfang und Ereignisse | Aufrufdiagramme, Kosten, Verzögerungen und Ausnahmen |
| Optimize | Anweisungen und Optimierung von Agenten | Produktionsverfolgung und Bewertungsergebnisse | Verbesserte Versionen und Experimente |
Simulation von KI-Agenten
Simulate ermöglicht es, mit vorgegebenen oder benutzerdefinierten Charakteren mehrere Runden an Text- und Sprachgesprächen vor dem Online-Gang durchzuführen. Die Szenarien können durch Skripte, Datensätze oder Graphenstrukturen definiert werden, wobei Transkripte, Vergleiche der Gespräche sowie Ergebnistreiber gespeichert werden.
Wofür eignet sich Simulation zur Tests?
- Der vollständige Ablauf für normale Benutzer von der Stellung einer Frage bis zur Erledigung der Aufgabe.
- Unklarheiten, Widersprüche, Überschreitung von Befugnissen und Eingabe von Hinweisen.
- Fehler bei den Tools, Zeitüberschreitung, wiederholte Aufrufe und fehlende Teildaten.
- Personen mit unterschiedlichen Sprachen, Tonfallen, Hintergründen und Wissensständen.
- Störungen in der Sprachübertragung, Stille, Akzente und Erkennungsfehler.
- Memorierung, Zustand und Ziele in langen Sitzungen verschleieren sich.
Mehrfachtyp-AI-Bewertung
Evaluate unterstützt heuristische Indikatoren, Code-Bewertungen, LLM-as-Judge sowie Agenten zur Bewertung. In den öffentlichen Repositorien sind über 50 Indikatoren aufgeführt, darunter Faktengrundlage, Halluzinationen, Richtigkeit der Werkzeugnutzung, persönliche Informationen und Tonfall.
Vergleich der Bewertungsmethoden
| Bewertungsmethode | Eigenschaften | Kosten | Für Aufgaben geeignet |
|---|---|---|---|
| Heuristiken | BLEU, ROUGE, reguläre Ausdrücke usw. zur Festlegung von Regeln | Die Plattform ist dauerhaft kostenlos. | Format, Wortlaut und klare Regeln |
| Code-Bewertung | Ausführung eines benutzerdefinierten Programms zur Bewertung des Ergebnisses | Nach AI-Credits abgerechnet | Strukturierte Geschäftslogik |
| LLM-as-judge | Das Modell bewertet die Ergebnisse nach Standardkriterien. | Das Hosting-Modell verwendet Kreditpunkte; die Gebühr für die BYOK-Plattform beträgt 0. | Qualität, Tonfall und Komplexitätsstandards |
| Agentic Eval | Spezielle Agenten zur Lokalisierung von RAG, Werkzeugen, Hinweisen und Fehlern | Verwendung von AI-Credits | Mehrschrittige Intelligenzagenten |
| Manuelle Annotation | Fachleute geben Etiketten und überprüfen. | Die Plattform erhebt keine Gebühren pro Sitzplatz. | Hohes Risiko und Goldstandard |
Produktionsverfolgung und Überwachbarkeit
Observe nutzt OpenTelemetry zur Erfassung von LLM- und Agenten-Tracking-Daten und zeigt Spannungsdiagramme, Sessions, Endbenutzer, Verzögerungen, Token sowie Kosten an. Das System unterstützt 11 Spanntypen, über 70 Filterbedingungen sowie eine Volltextsuche.
TraceAI-Integration
TraceAI bietet automatische Instrumentierung für mehr als 50 AI-Frameworks, darunter LangChain, LangGraph, LlamaIndex, CrewAI, AutoGen, DSPy usw. Es gibt entsprechende Anbindungen für Python, TypeScript, Java und C#.
Echtzeit-Schutzzäune Protect
Protect kann personenbezogene Informationen, Schlüssel, Jailbreaks, Prompt-Injection-Angriffe, Schadcode sowie andere unsichere Inhalte erkennen. 15 Regeln sind dauerhaft kostenlos, während Protect mit Machine Learning nach AI-Credits abgerechnet wird.
Betriebsmodus des Schutzzäuns
| Muster | Verhalten | Passende Phase |
|---|---|---|
| Enforce | Abfangen oder korrigieren, wenn der Schwellenwert erreicht wird | Herstellung von hochriskanten Eingängen |
| Monitor | Erkennen und aufzeichnen, aber nicht sofort blockieren | Anfangsphase im Betrieb und Anpassung der Schwellenwerte |
| Log | Nur die Testergebnisse speichern | Offline-Analyse und Auditing |
| Protect Flash | Kürzere Verzögerung, etwa 1 bis 3 Creditpunkte | Hochfrequente Echtzeit-Überprüfung |
| Protect Full | Eine umfassendere Überprüfung – etwa 3 bis 8 Creditpunkte. | Komplexe oder hochriskante Inhalte |
| External BYOK | Verbindung zu Lakera, Presidio, Llama Guard usw. | Es gibt bereits Sicherheitsanbieter. |
Agent Command Center
Das Command Center ist ein LLM-Gateway, das mit der OpenAI-Schnittstelle kompatibel ist und den Datenverkehr zwischen mehr als 100 Modellanbietern leiten kann. Es bietet automatische Fehlerübernahme, Wiederholungsversuche, virtuelle Schlüssel, Budgetkontrolle, Bandbreitenbegrenzung, Kostenverfolgung sowie präzises oder semantisches Caching.
Probleme, die ein Gateway lösen kann
- Zentrale Verwaltung der Schlüssel und Anfragen verschiedener Modellanbieter.
- Routen nach Verzögerung, Kosten, Gewicht oder Verfügbarkeit.
- Bei Ausfall des Anbieters erfolgt ein automatischer Umstieg und erneuter Versuch.
- Durch Caching werden wiederholte Aufrufe und Modellkosten reduziert.
- Legen Sie Budgets für Organisationen, Teams, Benutzer und virtuelle Schlüssel fest.
- Erfüllen Sie Echtzeit-Schutzmaßnahmen im Anfrage- oder Antwortpfad.
Datensätze, Experimente und manuelle Annotationen
Die Plattform unterstützt die Erstellung von Datensätzen in Form von manuellen Eingaben, CSV-Dateien, PDF-Dateien, über Hugging Face sowie mithilfe von SDKs. Es stehen 14 verschiedene Spaltenarten zur Verfügung. Es gibt keine Beschränkungen bezüglich der Anzahl der Datensätze und Experimente. Die Datensätze sowie die dazugehörigen Annotationen werden in allen Cloud-Lösungen dauerhaft gespeichert.
Die kostenlosen und nach Verbrauch berechneten Pakete bieten 3 Markierungskolonnen, Boost bietet 10, während die Pakete Scale und höher keine Beschränkungen haben. Für die Markierungen sind Zahlen, Texte, Kategorien, Sterne sowie „Gefällt mir“/„Nicht gefallen“ möglich.
Prompt-Wörter und Agent Playground
Der Prompt-Modul unterstützt Vorlagen, Versionen, Tags und Ordner. Prompt Playground kann mit den integrierten Modell-Schlüsseln kostenlos ausgeführt werden. Agent Playground bietet die Möglichkeit zur Erstellung visualisierter Diagramme, zum Aufrufen von Tools sowie zur Überprüfung der Ausgabeformatierung.
Falcon AI
Falcon AI kann Tracking und Bewertung, Clusterungsfehler, Erstellung von Erkenntnissen, automatische Beschriftung sowie Leistungsberichte analysieren. Es teilt sich monatlich 2.000 kostenlose AI-Credits mit anderen hostbasierten AI-Funktionen.
Anweisungen und Optimierung von Agenten
Optimize kann die Ergebnisse der Produktionsüberwachung und -bewertung zur Verbesserung der Prompte nutzen und Algorithmen wie GEPA, PromptWizard, ProTeGi, Bayesian, Meta-Prompt und Random bereitstellen. Die verbesserten Versionen müssen dennoch auf unabhängigen Testdatensätzen überprüft werden.
Erstellung des ersten Tracking-Tutorials
- Registrieren Sie sich bei Cloud oder bereitstellen Sie eigene Self-Hosted-Instanzen und erstellen Sie ein Projekt.
- Wählen Sie ein Splicing-Paket für Python, TypeScript, Java oder C#.
- Konfigurieren Sie den Projektnamen, die Endpunkte sowie die sicher gespeicherten Authentifizierungsdaten.
- Aktivieren Sie für das verwendete Modell oder Framework den entsprechenden Instrumentor.
- Führen Sie eine Testanfrage aus und überprüfen Sie den Spannungsgraphen, die Token sowie die Verzögerungen.
- Hinzufügen von Geschäftsattributen wie Benutzern, Sitzungen, Versionen und Umgebungen.
- Konfigurieren von Fehlersortierung, Dashboards und Alarmen.
Erstellen eines Bewertungstrainings
- Ordnen Sie die repräsentativen Eingaben, die Standardlösungen und die Geschäftsbedingungen zu einem Datensatz zusammen.
- Zuerst werden die Anforderungen an die Determiniertheit mit regulären Ausdrücken oder heuristischen Indikatoren überprüft.
- Erstellen Sie klare Skalen für die Qualitätsmessung sowie Beispiele für Misserfolge.
- Wählen Sie entweder das BYOK-Modell für die Bewertung oder eine verwaltete Turing-Bewertung.
- Fügen Sie Werkzeuge, RAG und einen Agenten zur fehlerhaften Lokalisierung von Hinweisen hinzu.
- Die automatischen Punktzahlen und Schwellenwerte werden mit manuell annotierten Beispielen kalibriert.
- Fügen Sie die wichtigsten Bewertungen zur kontinuierlichen Integration sowie zur Stichprobenprüfung in der Produktion hinzu.
Anleitung zur Einrichtung von Gateway und Schutzzäunen
- Fügen Sie einen Modellanbieter hinzu und erstellen Sie eine virtuelle Schlüssel mit minimalen Berechtigungen.
- Konfigurieren Sie das Hauptmodell, das Ersatzmodell, die Wiederholung und die Zeitüberschreitung.
- Wählen Sie den Caching-Backend aus und bestimmen Sie die sensiblen Anfragen, die nicht gekacht werden dürfen.
- Aktivieren Sie die Schutzmaßnahmen für persönliche Informationen, Schlüssel und Regeln zur Eingabe von Hinweisen.
- Zuerst werden mit dem Monitor Fehlalarme und übersehene Meldungen beobachtet, anschließend wird ein Enforce-Threshold festgelegt.
- Legen Sie Budgets und Beschränkungen nach Organisation, Team, Benutzer und Schlüssel fest.
- Überwachen von Kosten, Fehlern, Cache-Hits und Schutzmaßnahmen-Zeiten.
Docker-Self-Hosting-Tutorial
- Vorbereiten Sie den Docker Engine oder Docker Desktop sowie Compose.
- Klonen Sie den offiziellen future-agi-Repository und lesen Sie die Installations- und Sicherheitshinweise.
- Verwenden Sie das Installationsskript, um die Konfiguration zu erstellen und das veröffentlichte Image herunterzuladen.
- Erstellen Sie eine eigenständige Schlüssel für die Produktionsumgebung und fixieren Sie die Image-Version.
- Starten Sie Komponenten wie PostgreSQL, ClickHouse, Redis, RabbitMQ und Temporal.
- Beschränken Sie die Netzwerkeingänge, aktivieren Sie Backups und konfigurieren Sie die Überwachung.
- Zuerst sollten die Upgrades, Wiederherstellungen und Telemetrie-Einstellungen in einer nicht-produktiven Umgebung getestet werden.
Für welche Benutzer geeignet
- AI-Anwendungsingenieur: Überwachung von Modellen, Tools und Agentenaufrufen.
- Bewertungsteam: Einführung von offline-, kontinuierlichen und produktionsreifen Qualitätsprüfungen.
- RAG-Team: Überprüfung von Faktengrundlagen, Illusionen und Suchproblemen.
- Team für Sprachintelligenz: Simulation von Personen, Szenarien und Gesprächen.
- Sicherheitsteam: Konfiguration persönlicher Informationen, Injectionsschutz und Inhaltsfilter.
- Plattform-Engineering-Team: Zentrale Steuerung von Routing, Schlüsseln, Caching und Kosten.
- Produkt- und Bereichsexperten: Beteiligung an der Überprüfung unter Verwendung von Datensätzen und annotierten Queues.
- Geregelt Unternehmen: Kontrolle über Standort und Infrastruktur durch Selbstverwaltung.
Typische Anwendungsszenarien
- Simulieren Sie vor dem Go-Live normale und angegriffene Gespräche mit dem intelligenten Kundenservice-Agenten.
- Ständig prüfen, ob die RAG-Antworten begründet sind und ob es zu Halluzinationen kommt.
- Verfolgen von Verzögerungen, Kosten und Fehlern für jedes Werkzeug in mehreren Agenten.
- Fehlerübertragung zwischen mehreren Modellanbietern über ein Gateway.
- Persönliche Informationen sowie Angriffe durch Eingabe von Befehlen werden vor der Erstellung einer Antwort blockiert.
- Aus der Fehlerverfolgung werden ein Annotationsspeicher und ein Regressionssatz erzeugt.
- Vergleichen Sie verschiedene Modelle, Prompts und Agenten-Versionen.
- Innerhalb des Unternehmensnetzwerks wird eine vollständige Bewertungs- und Überwachungsplattform implementiert.
Vorteile des Produkts
- Umfasst Simulation, Bewertung, Tracking, Schutzmaßnahmen, Gateways und die Optimierung der gesamten Verbindungsstrecke.
- Cloud bietet eine hohe kostenlose Kapazität sowie keine Beschränkungen bezüglich der Anzahl der Teammitglieder und Projekte.
- Die Kosten für heuristische Bewertungen, BYOK-Modellbewertungen sowie Regelungsplattformen betragen 0.
- OpenTelemetry und kompatible OpenAI-Schnittstellen verringern die Anschlussbeschränkungen.
- Unterstützt mehr als 100 Modellanbieter und mehr als 50 AI-Frameworks.
- Die Kernplattform basiert auf Apache 2.0 und kann mit Docker selbst gehostet werden.
- Datensätze und Annotationsen werden in allen Cloud-Lösungen dauerhaft gespeichert.
- Es wird getrennt nach Speicher, Creditpunkten, Gateway, Cache und Simulation abgerechnet.
Einsatzbeschränkungen und Hinweise
- Der Open-Source-Repository ist derzeit als Early-Test-Version „Nightly“ gekennzeichnet; eine stabile Version wurde noch nicht veröffentlicht.
- Self-Hosting umfasst mehrere Datenbanken, Warteschlangen und laufende Komponenten, wodurch die Betriebskosten nicht gering sind.
- Offizielle Unterstützung für Kubernetes und Helm ist weiterhin im Roadmap enthalten.
- Der AWS Marketplace ist weiterhin als bald verfügbar markiert.
- Automatische Bewertungen und Modellrichter können Fehler aufweisen und müssen mit manuellen Beispielen kalibriert werden.
- Schutzzäune führen zu Fehlalarmen und zu übersehenen Fällen; bei Entscheidungen mit hohem Risiko darf man sich nicht ausschließlich auf automatische Blockierungen verlassen.
- Dass die Gebühren für die BYOK-Plattform 0 sind, bedeutet nicht, dass der Modellanbieter kostenlos genutzt werden kann.
- Die Tracking-Daten der kostenlosen Cloud-Lösung sowie der pay-as-you-go-Lösung werden nur 30 Tage lang aufbewahrt.
- Die dauerhafte Speicherung von Datensätzen kann die Speicherkosten erhöhen und erfordert außerdem das aktive Löschen sensibler Daten.
- Selbstverwaltete Lösungen beinhalten standardmäßig die Bereitstellung von Telemetriedaten; eine vollständige Abschirmung ohne externe Verbindungen erfordert eine Blockierung an den Netzwerkgrenzen.
Kostenloser Cloud-Plan
| Abrechnungsebenen | Monatliche kostenlose Nutzungsmenge | Über dem Grundpreis liegender Betrag | Erklärung |
|---|---|---|---|
| Verfolgung und Speicherung | 50 GB | 50 bis 500 GB: 2 US-Dollar pro GB | Enthält Spannweite, Bewertung und Session |
| AI Credits | 2,000 | 10 Dollar pro 1.000 Punkte | Bewertung, Protect und Falcon teilen sich |
| Gateway Requests | 100.000 Mal | 5 US-Dollar ab 100.000 Aufrufe | Automatische Preisreduktion je nach Verbraumenge |
| Cache Hits | 100.000 Mal | 1 US-Dollar ab 100.000 Malen | Getrennte Abrechnung von Gateway-Anfragen |
| Text Simulation | 1 Million Token | Ab 2 US-Dollar pro 1 Million Token | Unter 10 Millionen und mehr |
| Voice Simulation | 60 Minuten | 0,08 US-Dollar/Minute | Getrennt von der Textsimulation |
Tracking und Schwellenpreise für Gateways
| Produkte | Dosierungsintervall | Preis |
|---|---|---|
| Storage | Erste 50 GB | Kostenlos |
| Storage | 50 bis 500 GB | 2 Dollar/GB |
| Storage | 500 GB bis 2 TB | 1,50 US-Dollar/GB |
| Storage | 2 TB oder mehr | 1 Dollar/GB |
| Gateway | Die ersten 100.000 Mal | Kostenlos |
| Gateway | 100.000 bis 1.000.000 Mal | 5 US-Dollar/100.000 Mal |
| Gateway | 1.000.000 bis 10.000.000 Mal | 4 Dollar/100.000 Mal |
| Gateway | Mehr als 10.000.000 Mal | 2,50 US-Dollar/100.000 Mal |
Plattform-Zusatzpakete
| Plan | Preis | Datenhaltung | Konformität und Identität | Warteschlangen und Überwachung | Unterstützung |
|---|---|---|---|---|---|
| Kostenlos oder PAYG | Ab 0 US-Dollar, zuzüglich Gebühr nach Verbrauch | 30 Tage | Basiskonto | 3 Queues, 3 Überwachungen | Gemeinschaft oder E-Mail |
| Boost | 250 US-Dollar/Monat | 90 Tage | SOC 2 Typ II, OAuth SSO, Audit-Logs | 10 Queues, 15 Überwachungen, 5 Wissensdatenbanken | E-Mails innerhalb von 48 Stunden |
| Scale | 750 US-Dollar/Monat | 1 Jahr | HIPAA BAA, SAML SSO, SCIM | Keine Warteschlangen und keine Überwachung | E-Mails und Slack 24/7 |
| Enterprise | 2.000 US-Dollar/Monat | Maßanfertigung | Alle Funktionen von ABAC, Datenmaskierung und Scale | Anpassbare Beschränkungen | Exklusive Ingenieure und CSMs |
Das Datum der Preisüberprüfung ist der 22. August 2026. Bei dem Pay-as-you-go-Modell können Benachrichtigungen bei Rechnungsausstellung sowie feste Obergrenzen festgelegt werden. Im kostenlosen Modell wird die Leistung nach Erreichen der Obergrenze eingestellt, es entstehen keine zusätzlichen Rechnungen.
Kosten für selbstverwaltete Lösungen
Bei Open-Source-Hosting fallen keine Cloud-Abonnementkosten an, doch es sind Kosten für Rechenserver, Datenbanken, Objektspeicher, Backups, Updates, Überwachung, Sicherheit sowie Personal erforderlich. Der Einsatz externer Modelle und Sicherheitsdienstleister verursacht weiterhin zusätzliche Kosten.
| Selbstverwaltete Komponenten | Hauptverwendungszweck | Wartungshinweise |
|---|---|---|
| Python und Django | Backend der Plattform | Versionen, Prozesse und Sicherheitsaktualisierungen |
| Go Gateway | Modellbasierte Routing- und Anfragenverwaltung | Hohe Verfügbarkeit, Limitierung des Datenverkehrs und Schlüssel |
| React-Frontend | Web-Konsole | Aufbau und Zugriffskontrolle |
| PostgreSQL | Metadaten | Backups und Migration |
| ClickHouse | Breiten- und Zeitreihendaten | Kapazität und Retentionsstrategien |
| Redis | Status und Cache | Persistenz und Speicher |
| RabbitMQ und Temporal | Aufgaben und Workflows | Backlog, Wiederholungsversuche und Wiederherstellung |
Unterstützte Sprachen, SDKs und Integration
| Kategorie | Unterstützte Inhalte | Verwendung |
|---|---|---|
| Kunden-Sprache | Python, TypeScript, Java, C# | Tracking und Plattformanschluss |
| SDK-Bewertung | Python und TypeScript | Mehr als 50 Indikatoren sowie Schutzzäune |
| Plattform-SDK | Python | Datensätze, Prompts, Wissensdatenbanken und Experimente |
| Gateway SDK | Python und TypeScript | Modell-Routing und Caching |
| Modellanbieter | Mehr als 100 Anbieter wie OpenAI, Anthropic, Gemini, Bedrock, Azure usw. | Einheitlicher Aufruf |
| Agent-Framework | LangChain, LlamaIndex, CrewAI, AutoGen, DSPy usw. | Automatische Pfahlsetzung |
| Sprachplattform | VAPI, Retell, LiveKit, Pipecat | Stimmensimulation |
| Vektor-Datenbank | Pinecone, Weaviate, Chroma, Milvus, Qdrant, pgvector | RAG und Wissensdatenbanken |
| MCP | Serverseitige Dienste anbieten | Auf der Plattform sowie in den Dokumenten über Cursor oder Claude Code zugreifen |
Open Source, Self-Hosting und Lizenzen
Die vollständige Kernplattform von Future AGI wird unter der Apache License 2.0 bereitgestellt. Es sind Prüfwerkzeuge, Prompts, Tracking-Funktionen sowie Gateway-Code verfügbar, und die Plattform kann über Docker Compose selbst gehostet werden. In dem Repository ist außerdem LICENSE-EE enthalten; vor der Nutzung der Unternehmensfunktionen sollten die Verzeichniss Grenzen überprüft werden.
Offizielle Repositorien wie futureagi-sdk und Agent Command Center SDK verwenden ebenfalls Apache 2.0; einige Zusatzpakete könnten Apache oder MIT verwenden. Jedes einzelne Softwarepaket muss jedoch seine eigene Lizenzdatei überprüfen.
| Projekt | Offener Zustand | Lizenz oder Phase |
|---|---|---|
| Kernplattform für zukünftige AGI | Offene Quellcode, selbst gehostet | Apache 2.0-Kern; aktuelle Nightly-Tests |
| futureagi SDK | Öffentlich | Apache 2.0 |
| traceAI | Öffentlich | Nach Lizenzbedingungen des Lagers verwenden |
| ai-evaluation | Öffentlich | Python und TypeScript |
| Command Center SDK | Öffentlich | Apache 2.0 |
| Cloud-Hosting-Dienste | Wirtschaftsdienstleistungen | Abrechnung nach Kostenlos, nach Verbrauch und in Zusatzpaketen |
| Unternehmensfunktionen | Teilweise Geschäftsfähigkeit | Überprüfen Sie LICENSE-EE und Vertrag. |
Einsatzoptionen
| Einrichtungsmethode | Aktueller Zustand | Erklärung |
|---|---|---|
| Future AGI Cloud | Offizielle Bereitstellung | Keine Wartung und Abrechnung nach Verbrauch |
| Docker Compose | Anbieten | Abrufen von Images aus dem Repository für Self-Hosting |
| Production Compose Overlay | Anbieten | Schlüssel erzeugen und Image festlegen |
| AWS, GCP, Azure VM | verfügbar | Compose in einer virtuellen Maschine ausführen |
| Air-gapped und lokale Implementierung | Unternehmensweg anbieten | Bei keinem Rückmeldebedarf wenden Sie sich bitte an den Verkauf. |
| Kubernetes und Helm | Bald verfügbar | Es kann nicht als aktive offizielle Unterstützung dargestellt werden. |
| AWS Marketplace | Bald verfügbar | Noch nicht offiziell verfügbar |
Telemetrie und Privatsphäre
Bei selbstverwalteter Konfiguration werden standardmäßig einmal eine Registrierung sowie periodische Heartbeat-Telemetriedaten gesendet. Dazu können der Instanz-ID, die Version, der Bereitstellungsart, die E-Mail-Adresse des Administrators sowie der Domainname gehören. Zudem werden anonymisierte Zusammenfassungen der Nutzungsmenge übermittelt. Tracking-Daten, Prompts oder API-Schlüssel werden hingegen nicht gesendet.
Der periodische Heartbeat kann über die Umgebungskonfiguration deaktiviert werden, doch selbst nach Deaktivierung wird eine minimale Statistik ohne E-Mail-Adresse gesendet. Für Umgebungen, in denen keinerlei Aufrufe nach außen möglich sein sollen, muss dies an den Netzwerkgrenzen blockiert werden.
Cloud-Privatsphäre und Löschung
Die Datenschutzerklärung listet Namen, E-Mail-Adressen, Organisationen, Telefonnummern sowie IP-Adressen, Browser, besuchte Seiten und Diagnosedaten auf. Die Informationen werden für Dienstleistungen, Support, Analyse, Sicherheit und Benachrichtigungen verwendet; personenbezogene Daten werden nicht verkauft.
Benutzer können den Zugriff, die Korrektur, Löschung, Einschränkung, Widerspruch sowie die Mitnahme von Daten beantragen. Anfragen zur Löschung werden innerhalb von 30 Tagen bearbeitet. Rechtliche Gründe, Streitigkeiten und anonyme Statistiken können Ausnahmen darstellen.
Grundlegende Informationen
| Projekt | Inhalt |
|---|---|
| Name des Tools | Future AGI |
| Betreibungsunternehmen | Future AGI Inc. |
| Arten von Werkzeugen | Bewertung von KI-Agenten, Überwachbarkeit, Schutzmechanismen, Simulation und Gateway |
| Preismuster | Kostenlos, nach Verbrauch, Zusatzpakete und Unternehmensdienste |
| Kostenlose Anfrage | Kreditkarte nicht erforderlich |
| Team und Projekt | Alle Cloud-Lösungen haben keine Beschränkungen hinsichtlich der Anzahl der Mitglieder und Projekte. |
| Hauptplattformen | Web Cloud, API, SDK und selbst gehosteter Docker |
| Offene API | Anbieten |
| Offizielles SDK | Python, TypeScript, Java und C# usw. |
| Ist das Produkt open source? | Offene Quellcode-Plattform |
| Kernlizenz | Apache 2.0 |
| Selbstverwaltung | Unterstützung für Docker Compose |
| Derzeitige Open-Source-Phase | Frühe Nachttests, stabile Version wird bald veröffentlicht |
| Datum der Preisüberprüfung | 22. August 2026 |
Empfehlungswert
Empfehlungswert: 4,7 / 5. Future AGI bringt Bewertung, Überwachbarkeit, Schutzmechanismen, Gateways, Simulation und Optimierung in eine offene Plattform zusammen. Die kostenlosen Zugriffsrechte sowie die unbegrenzte Anzahl an Nutzern sind für Entwicklerteams sehr attraktiv.
Das Hauptrisiko besteht darin, dass der vollständige Open-Source-Repository noch in der Nightly-Phase ist, die self-hosted-Architektur komplex ist und automatische Bewertungen sowie Schutzmechanismen ständig angepasst werden müssen. In der Produktion müssen feste Versionen verwendet werden, und es müssen Wiederherstellungs-, Sicherheits- sowie Kapazitätsprüfungen durchgeführt werden.
Häufige Fragen
Ist Future AGI kostenlos?
Es gibt kostenlose Cloud-Lösungen ohne Kreditkarte, die monatlich 50 GB, 2.000 AI-Credits, 100.000 Gateway-Anfragen, 1 Million Text-Simulationstoken sowie 60 Minuten Sprachsimulation bieten.
Wird eine Gebühr berechnet, wenn der kostenlose Betrag aufgebraucht ist?
Der kostenlose Plan wird vorübergehend deaktiviert, es werden keine Rechnungen erstellt. Erst nach Hinzufügen einer Kreditkarte und Aktivierung des Pay-as-you-go-Modus wird weiterhin zum öffentlichen Übernachtungspreis abgerechnet.
Wird die zukünftige AGI offen zugänglich sein?
Die Kernplattform ist bereits unter der Apache 2.0-Lizenz freigegeben, wird aber derzeit als „Nightly“ für frühe Tests bezeichnet; das Unternehmenskatalog kann weiterhin durch die LICENSE-EE-Beschränkungen eingeschränkt sein.
Kann man es selbst hosten?
Die gesamte Infrastruktur kann über Docker Compose bereitgestellt werden, oder sie kann auch auf Cloud-VMs laufen. Offizielle Unterstützung für Kubernetes und Helm ist weiterhin im Entwicklungsplan enthalten.
Welche SDKs werden angeboten?
Es werden Funktionen zur Überwachung in Python, TypeScript, Java und C# bereitgestellt, sowie Python- oder TypeScript-Bibliotheken für Bewertungen, Plattformen, Simulationen und Gateways.
Welche Bewertungen werden unterstützt?
Es werden heuristische Ansätze, Code, LLM-as-Judge, maschinelles Lernen, Agenten zur Bewertung von Agenten sowie manuelle Annotationen unterstützt. Die offene Ökosysteme bieten mehr als 50 Indikatoren.
Was bedeutet BYOK?
Der Benutzer stellt seinen eigenen Modell-Schlüssel bereit. Future AGI erhebt keine Gebühren für die Aufrufe der Plattform durch den Modellanbieter, doch der Modellanbieter berechnet weiterhin Gebühren entsprechend dem tatsächlichen Verbrauch.
Gibt es eine Gebühr für die Regelungsschutzzäune?
15 eingebaute Regelbasierte Schutzmechanismen sind dauerhaft kostenlos. Für Machine Learning Protect und gehostete Bewertungen werden gemeinsame AI-Credits verwendet.
Wird Sprach-Intelligenz unterstützt?
Unterstützung für Text- und Sprachsimulation – das kostenlose Paket beinhaltet 60 Minuten Sprachnutzung pro Monat; für die darüber hinausgehenden Minuten wird 0,08 US-Dollar pro Minute berechnet.
Wie lange werden die Daten gespeichert?
Die Verfolgung im Modus Free und PAYG wird 30 Tage lang aufbewahrt, bei Boost sind es 90 Tage, bei Scale ein Jahr – bei Enterprise ist dies anpassbar; Datensätze und Anmerkungen werden dauerhaft gespeichert.
Wird HIPAA und SSO angeboten?
Scale bietet HIPAA BAA, SAML SSO und SCIM an, Boost bietet SOC 2 Type II und OAuth SSO, während Enterprise Funktionen wie ABAC hinzufügt.
Gibt es MCP-Server?
Ja, die Future AGI-Plattform kann mit Dokumenten über kompatible Clients wie Cursor oder Claude Code verbunden werden.
Sendet self-hosted überhaupt keine Telemetriedaten?
Es ist nicht standardmäßig vorgesehen, dass keine Telemetriedaten übertragen werden. Der periodische Herzschlag kann deaktiviert werden – doch es erfolgt dennoch eine Mindestanzahl an Statistiken. Eine vollständige Stille ist nur möglich, wenn auf Netzwerkebene die Übertragung blockiert wird.
Passt es für chinesische Teams?
Technische Schnittstellen und Self-Hosting eignen sich für globale Entwicklerteams, doch die Dokumentation ist hauptsächlich auf Englisch. Bei der Einhaltung chinesischer Datenschutzvorschriften muss ein geeigneter Standort ausgewählt und eine rechtliche Prüfung durchgeführt werden.
Zusammenfassung
Future AGI eignet sich für Teams, die die Qualität von KI-Agenten durch einen einheitlichen Datenkreislauf verbessern möchten – es gibt entsprechende Module für Simulationsprozesse vor dem Einsatz, Offline-Bewertungen sowie für die Überwachung in der Produktion und die Optimierung von Schutzmechanismen und Anweisungen.
Kleine Teams können zunächst kostenlose Cloud- und BYOK-Tests nutzen, während regulierte oder datensensible Organisationen eine Self-Hosting-Lösung prüfen können. Im Produktivumfeld müssen auf die nightly-Phase, die Grenzen der Unternehmenslizenzen, Telemetrie, Datenerhaltung sowie den Betrieb komplexer Komponenten geachtet werden.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164