OnDemand
OnDemand – eine intelligente Tool-Plattform, die sich auf die Steigerung der Effizienz durch KI konzentriert.
Tags:Steigerung der Effizienz durch KIEinführung in die Tools
OnDemand ist eine von School Hack FZ-LLC betriebene Plattform zur Erstellung, Orchestrierung und Bereitstellung von KI-Agenten. Offiziell wird sie als dezentraler Agentenbetriebssystem bezeichnet. Sie dient sowohl für kodenlose Experimente, die Automatisierung in Unternehmen als auch für die Integration durch Entwickler und umfasst Agenten, Wissen, Workflows, Modellableitungen sowie verschiedene Arten von APIs.
Hauptfunktionen
Agenten und Echtzeit-Playground
Benutzer können in der Playground-Plattform Modelle, Dateien und benutzerdefinierte Agenten testen, Parameter wie die Temperatur anpassen und die Ausführungslogs einsehen. Die Plattform ermöglicht es außerdem, Tools, Agenten sowie mehragentige Prozesse zu erstellen, und bietet wiederverwendbare Komponenten, Planungsmodi, dauerhafte Speicherung sowie Knotpunkte für manuelle Freigabe.
- Man kann mit vorgefertigten Agenten oder Tools beginnen, oder man kann auch eigene Anweisungen, Modelle und Verhaltensweisen konfigurieren.
- Verwenden Sie die Echtzeit-Debugging-Funktionen, um Anfragen, Codebeispiele, Schritte sowie Toolaufrufe anzusehen.
- Der Kontext zwischen den Sitzungen wird durch das Gedächtnis gespeichert, und der Zugang des Teams wird über Rollenrechte gesteuert.
- Man fügt für Aktionen wie das Senden von E-Mails und die Änderung von Daten eine manuelle Bestätigung hinzu, um das Risiko einer eigenmächtigen Ausführung zu verringern.
Wissensverbindungen, Plugins und MCP
Die Plattform ermöglicht das Hochladen von Dateien und Verzeichnissen sowie die Anbindung an Cloud-Speicher, SharePoint, OneDrive und Amazon S3 sowie andere Datenquellen. Zudem können Agenten über Standard-Plugins, benutzerdefinierte Endpunkte, OAuth-Verbindungen und MCP-Tools auf externe Funktionen zugreifen.
- Lassen Sie den Agenten in den Unternehmensdaten suchen und kontextbehaftete Antworten erzeugen.
- Nach der Verbindung mit Drittsystemen werden Daten gelesen, Aktionen ausgelöst oder Prozesse kombiniert.
- Unterstützung von PDFs sowie der Abbildung von Bildern innerhalb von Dokumenten, um die Verarbeitung komplexer Dokumente zu erleichtern.
- Die Verfügbarkeit der Anschlüsse sowie die Berechtigungen hängen vom Konto, der Implementierungsart und den Einstellungen des Administrators ab.
Modelle, Schlussfolgerungen und Bereitstellung von Anwendungen
OnDemand ermöglicht es, zwischen Plattformmodellen, eigenen Modellen oder der Verbindung zu privaten Inferenzendpunkten zu wählen. Zudem können Hugging Face-Modelle auf dedizierten GPUs bereitgestellt und über vLLM ausgeführt werden. Entwickler können außerdem serverlose Anwendungen bereitstellen und interaktive Produkte mit strömungsbasierten Antworten erstellen.
- Wählen Sie mehrere große Sprachmodelle einheitlich aus und richten Sie für die fortgeschrittenen Modelle eine Pro-Zugriffssteuerung ein.
- Durch BYOM und BYOI bleibt die Wahl der Modell- und Inferenzinfrastruktur erhalten.
- Die Agentenprozesse in Webseiten, interne Systeme oder Kundenanwendungen einbinden.
- Der unterstützte Modellumfang, die Verfügbarkeit von GPUs sowie die Leistung variieren je nach Region und Konfiguration.
Entwicklung von Schnittstellen
| Schnittstelle oder Fähigkeit | Hauptverwendungszweck | Passende Szenarien | Hinweise |
|---|---|---|---|
| Chat API | Erstellen von Zustandsbesitzenden Sitzungen, Verbinden mit Agenten und Stream-basierte Rückgabe von Ergebnissen | Kundenservice, FAQ und In-App-Assistent | Es ist notwendig, Sessions, Schlüssel, Rate Limiting sowie Wiederholungsversuche bei Fehlern zu verwalten. |
| Media API | Medien hochladen oder zitieren, Audio-, Video- und Dokumenteninformationen extrahieren | Dokumentenanalyse, Transkription und Inhaltssuche | Es muss der Dateiformat, die Größe sowie der Umfang der sensiblen Daten überprüft werden. |
| Cloud Services API | Sprachzu-Text- und Text-zu-Sprachkonvertierung | Sprachassistenten, Meetings und Barrierefreiheit | Sprache, Klangfarbe und Abrechnung richten sich nach dem Konto. |
| Agent Tools API | Sitzung erstellen, dem Agenten Anweisungen geben und Tools aufrufen | Automatisierte Aufgaben und mehrstufige Prozesse | Schreibwerkzeuge sollten mit minimalem Zugriffsrecht und Genehmigungsfunktionen ausgestattet sein. |
| BYOM und BYOI | Einsatz eigener Modelle oder Anbindung an eigene Inferenz-Endpunkte | Private Modelle, dedizierte Rechenleistung und kontrollierte Umgebungen | Wartung, Sicherheit und Lizenzierung der Modelle liegen in der Verantwortung des Nutzers. |
Anleitung zur Verwendung
- Registrieren Sie ein Konto, wählen Sie in Playground ein Modell aus und testen Sie die Ausgabe mit Aufgaben ohne sensible Informationen.
- Erstellen Sie einen Wissensraum, laden Sie einige repräsentative Dokumente hoch und überprüfen Sie die Analyse-, Segmentierungs- sowie Suchergebnisse.
- Neuen Agenten erstellen, Systemanweisungen, Modelle, Wissen, Gedächtnis sowie zugelassene Werkzeuge festlegen.
- Wenn mehrstufige Automatisierung erforderlich ist, werden im Prozessbuilder Trigger, Modelle, Tools, Freigabepunkte und Ausgabepunkte miteinander verbunden.
- Erstellen Sie eine API-Schlüssel und kopieren Sie die von der Plattform bereitgestellten Beispiele für Python, JavaScript oder die Kommandozeile in die Testumgebung.
- Vor dem Go-Live werden Schlüsselisolation, Budgets, Bandbreitenbeschränkungen, Protokollierung, Rollenrechte, manuelle Überprüfung sowie Rollback bei Fehlern konfiguriert.
Für welche Benutzer geeignet
- Produkt- und Innovationsteams, die eine schnelle Überprüfung von RAG-Frage-Antwort-Systemen sowie toolbasierten Intelligenzagenten benötigen.
- Entwickler, die über eine API Gespräche, Medien oder Sprach-KI in ihre Anwendungen einbinden möchten.
- Operative Teams, die in einem visualisierten Prozess mehrere Modelle, Tools und Freigabeschritte miteinander verbinden müssen.
- Unternehmen, die die Optionen eigenständiger Modelle, privater Inferenz oder lokaler Bereitstellung nutzen möchten.
- Benutzer, die nur einfache persönliche Chats benötigen, brauchen möglicherweise keine vollständigen Deployment- und Verwaltungsfunktionen.
Preise und Pakete
| Ebene | Derzeitige offizielle Summe | Bereich wurde bestätigt | Für Nutzer geeignet |
|---|---|---|---|
| Kostenlos starten | Ab 0 US-Dollar | Die strukturierten Produktinformationen auf der offiziellen Website bieten einen kostenlosen Zugang – man kann sich registrieren und die Plattform nutzen. | Testen und Prototyp-Validierung |
| Pro | Offiziell noch nicht veröffentlicht | Einige fortgeschrittene Modelle und professionelle Funktionen werden durch die Pro-Lizenz gesteuert. | Erforderlich sind fortgeschrittene Modelle sowie Personen oder Teams, die sie kontinuierlich nutzen. |
| Unternehmens- oder lokale Bereitstellung | Kontaktieren Sie das Team | Rollenrechte, White-Label-Lösungen, eigene Modelle, private Inferenz, lokale Modus sowie Anpassungssupport werden je nach Angebot festgelegt. | Organisationen mit Anforderungen in Bezug auf Sicherheit, Konformität und Implementierung |
| API und Rechenleistungsverbrauch | Im Konto werden die einzelnen Posten angezeigt. | Modelle, Agenten, Medien, Sprache, Speicherung, GPU sowie serverloser Betrieb können jeweils separat abgerechnet werden. | Produktionsanwendungen und Projekte mit hohem Verbrauch |
Laut den offiziellen Updates vom Mai 2026 wurde das Preissystem angepasst, und im Juli wurden für die hochwertigeren Modelle zusätzliche Pro-Einschränkungen eingeführt. Auf der offiziellen Website werden die aktuellen Paketpreise sowie die genauen Gebühren nicht stets angezeigt. Nach der Registrierung sollten die Preise gemäß der Anzeige auf der Abrechnungsseite gelten – es sollten keine alten Preise von Drittanbietern verwendet werden.
Die Nutzungsbedingungen der Plattform verlangen, dass die Nutzer die Kosten für ihr Konto tragen. Es wird außerdem angegeben, dass der Rechnungsbetrag steuerfrei ist und in der Regel innerhalb von fünf Tagen nach Ausstellung der Rechnung bezahlt werden muss. Informationen zu Stornierungen, Rückerstattungen, Gültigkeitsdauer des kostenlosen Kontingents sowie zu den Preisen für die Übernutzung sind auf der offiziellen Seite nicht vollständig angegeben. Vor dem Kauf sollte daher eine schriftliche Bestätigung eingeholt werden.
Vorteile des Produkts
- Gleichzeitig werden codefreie Experimente, visuelle Orchestrierung sowie Entwicklungs-APIs bereitgestellt, um den Übergang vom Prototypen zur Integration zu erleichtern.
- Wissen, Erweiterungen, MCP, Modelle und Bereitstellungsfähigkeiten sind auf derselben Plattform konzentriert.
- Man kann eigene Modelle oder Inferenzendpunkte verwenden, um die Abhängigkeit von einem einzigen Modellanbieter zu verringern.
- Unterstützung für Funktionen zur Produktionsverwaltung wie manuelle Genehmigungen, Benutzerrollen, Ausführungshistorien und Protokolle.
- Die Entwickler veröffentlichen kontinuierlich Funktionsupdates und stellen API-Dokumentation sowie Code-Exporte zur Verfügung.
Einsatzbeschränkungen und Hinweise
- Es gibt viele Ebenen der Plattform, und die Kombination aus Modellen, Tools, Plugins, Wissen und Bereitstellung erhöht die Komplexität bei der Fehlersuche.
- Der Aufruf externer Systeme durch intelligente Agenten kann echte Nebenwirkungen haben; daher sollten Berechtigungen eingeschränkt und Rollback-Mechanismen entwickelt werden.
- Die Kosten können aus verschiedenen Bereichen wie Modellen, Medien, Sprache, GPU, Speicher und Ausführung stammen.
- Ein eigenes Modell löst nicht automatisch Probleme im Zusammenhang mit Lizenzen, Datenlecks, Prompt-Injection sowie Sicherheitsaspekten der Ausgabe.
- Offizielle Leistungsdaten, Sicherheitsaspekte sowie die Anzahl der Modelle gehören zu den Beschreibungen der Plattform; Unternehmen sollten dennoch eigene Last- und Risikotests durchführen.
Sicherheit, Privatsphäre und Bereitstellung
Auf der offiziellen Website werden die SOC 2 Type 1-Audits aufgeführt, wobei erklärt wird, dass Unternehmensrollen, Azure-Anmeldungen, private Inferenzfunktionen sowie lokale Wissensmodelle genutzt werden können. Der Umfang der Zertifizierung, die neuesten Berichte sowie die Datenspeicherung und die Verarbeitung durch Dritte müssen über Verkaufs- oder Sicherheitsunterlagen bestätigt werden.
Die Plattformbedingungen besagen, dass die Kundendaten nur dann abgerufen werden, wenn Dienstleistungen erbracht werden, Gebühren berechnet werden oder dies gesetzlich erforderlich ist. Zudem werden angemessene technische und organisatorische Maßnahmen ergriffen. Vor der Verarbeitung sensibler Daten muss ein entsprechender Datenschutzvertrag unterzeichnet werden, in dem die Regeln für die Speicherung, Löschung, Sicherung sowie für das Training von Modellen und die Benachrichtigung bei Ereignissen festgelegt sind.
APIs, SDKs und Open Source
OnDemand bietet tatsächlich eine API-Dokumentationsseite an, die Schnittstellen für Chat- und Agentenwerkzeuge, Medien sowie Sprachfunktionen umfasst. Zudem ist es möglich, Code in Python, JavaScript sowie für die Kommandozeile zu exportieren. Es handelt sich dabei um offizielle Entwicklungs-APIs – die Schlüssel sollten ausschließlich auf der Serverseite gespeichert werden und je nach Umgebung getrennt gehalten werden.
Offizielle Quellen bestätigen weder die Existenz eines offiziellen SDKs, das unabhängig veröffentlicht und unter Open-Source-Bedingungen gewartet wird, noch gibt es eine Open-Source-Lizenz für das Produkt selbst. Die Möglichkeit, den Code der Agenten anzusehen, Open-Source-Modelle zu deployen oder Open-Source-vLLM zu verwenden, bedeutet nicht, dass die OnDemand-Plattform selbst open source ist.
Häufige Fragen
Kann OnDemand kostenlos genutzt werden?
Die offizielle Website bietet einen Einstieg ohne Kosten, doch die derzeitige kostenlose Nutzungsmenge, das Angebot an Modellen sowie die Gültigkeitsdauer sind auf der öffentlichen Seite nicht vollständig aufgeführt. Nach dem Einloggen sollte man zunächst die Nutzungskonditionen und Abrechnungsregeln prüfen.
Muss man unbedingt die vom Portal bereitgestellten Modelle verwenden?
Das ist nicht notwendig. Die Plattform unterstützt BYOM und BYOI – es ist möglich, eigene Modelle zu verwenden oder eigene Inferenzendpunkte anzuschließen. Allerdings hängen die genauen Funktionen sowie die Kosten vom jeweiligen Angebot ab.
Hat es eine öffentliche API?
Ja. Offiziell werden API-Dokumentationen sowie Code-Exporte bereitgestellt, die Funktionen wie Chat, KI-Agenten, Medien und Sprachfunktionen abdecken. Allerdings müssen die Anzahl der Aufrufe sowie die Preise im Account überprüft werden.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164