Ducky
Ducky – macht die Suche mit KI effizienter und einfacher.
Tags:KI-SuchmaschineWas ist Ducky?
Ducky ist eine vollständig verwaltete Suchinfrastruktur von Lyco.AI, Inc., die Entwicklern dabei hilft, für RAG-Anwendungen und KI-Agenten Indizes zu erstellen, Dokumente zu suchen und einen Kontext bereitzustellen, den die Modelle nutzen können. Das Team muss keine Vektordatenbanken selbst bereitstellen, keine separaten Pipelines einrichten oder Services für gemischte Suche und Neuanordnung betreiben.
Dieser Eintrag beschreibt die für Entwickler bestimmte Suchplattform Ducky AI – nicht den Kundenservice-Assistenten Duckie, das gleichnamige Kommandozeilen-Tool oder andere Suchprojekte. Ducky bietet eine Webkonsole, Netzwerk-APIs sowie SDKs für Python und TypeScript.
Überblick über die Hauptfunktionen
| Funktionen | Eingabe | Ausgabe | Für Aufgaben geeignet |
|---|---|---|---|
| Textindex | Kerntext, Überschriften, Dokumentnummern und Metadaten | Suchbare Dokumente und Inhaltsteile | Suche in Wissensdatenbanken, Produkten, Bewertungen und internen Unterlagen |
| Dokument-Index | Textdateien wie PDF, TXT, Markdown usw. | Automatisch extrahierter und indizierter Text | Handbücher, Berichte, Verträge und lange Dokumente |
| Multimodaler Index | Text und JPEG-, PNG-, GIF- sowie WebP-Bilder | Einheitliche Darstellung für die Suche in natürlicher Sprache | Visuelle Materialien, Produktbilder und Dokumente mit Bildern und Texten |
| Mischsuche | Natural Language-Abfragen und Suchparameter | Das Ergebnis der Kombination von Schlüsselwörtern und Semantik | Anwendungen, bei denen eine präzise Übereinstimmung von Wörtern und Konzepten erforderlich ist |
| Metadaten-Filterung | Kategorie, Datum, Tags, Bewertung und Berechtigungsfelder | Ergebnisse, die den strukturierten Anforderungen entsprechen | Mehrfachnutzer, Berechtigungen, Status und Geschäftsfilterung |
| Umordnung | Erste Suche nach Kandidaten | Ergebnisse der Neuanordnung der Korrelationen | Verbesserung der Qualität der oberen Ergebnisse |
| Ask-Schnittstelle | Indexnamen und Fragen in natürlicher Sprache | Zusammenfassende Antwort, Zuverlässigkeit und verknüpfte Dokumente | Frage-Antwort-Hilfe und Aufruf von Wissensressourcen durch KI-Agenten |
| Dokumentenverwaltung | Anfragen zur Erstellung, Aktualisierung, Auflistung und Löschung von Dokumenten | Inhalt des ständig gepflegten Indexes | Synchronisierung mit der Produktdatenbank und dem Inhaltssystem |
Project, Index und Dokument
Ein Projekt stellt die höchste Ebene der Ressourcen und Berechtigungen dar. Ein Projekt kann mehrere Indizes enthalten, und auch API-Schlüssel sind mit dem Projekt verknüpft. Ein Index ist eine Sammlung von zusammenhängenden Dokumenten; bei der Suche muss der jeweilige Index angegeben werden.
- Isolieren Sie Umgebungen, Kunden oder Anwendungen mit verschiedenen Projekten.
- Produkte, Hilfedokumente, Tickets oder regulatorische Unterlagen mit verschiedenen Indizes trennen.
- Jedes Dokument gehört zu einem Index und kann eine benannte Dokumentennummer haben.
- Der Hauptinhalt ist der eigentliche Suchinhalt, während Titel und ursprüngliche Adresse als Hilfsfelder dienen können.
- Metadaten speichern strukturierte Eigenschaften wie Kategorie, Version, Berechtigungen, Autor, Bewertung und Zeit.
- API-Schlüssel sollten nur an Dienste vergeben werden, die Zugang zu dem jeweiligen Projekt benötigen.
Die Konfiguration des Index ist einfacher als bei herkömmlichen Suchmaschinen – es ist nicht notwendig, dass die Benutzer vorab komplexe Abhängigkeiten definieren. Die vereinfachte Konfiguration bedeutet jedoch auch, dass das Team weiterhin selbst die Datengrenzen, Berechtigungsfelder, Dokumentversionen sowie Synchronisierungsstrategien festlegen muss.
Text- und Dateinachweise
Entwickler können Texte direkt einreichen oder PDF- sowie UTF-8-Textdateien hochladen. Laut den aktuellen Dokumentationsanweisungen darf eine Datei maximal 60 MB groß sein. Die Plattform extrahiert den Inhalt und führt anschließend die Aufteilung, Vektorisierung sowie Indexierung durch.
- Der Inhalt (content) ist ein erforderliches Feld für den Textindex.
- Title, ursprüngliche Adresse, Source-Document-ID und Metadaten sind optionale Felder.
- Metadatenwerte unterstützen Zeichenketten, Zahlen und boolesche Werte.
- Bei der Massenindexierung können maximal 100 Dokumente pro Mal eingereicht werden.
- Asynchrone SDK-Methode eignet sich für paralleles Hochladen, doch die Konkurrenz zwischen den Clients sollte dennoch kontrolliert werden.
- Upsert erstellt oder aktualisiert Inhalte unter Verwendung derselben Dokumentennummer.
- Beim Löschen von Inhalten aus der oberen Ebene sollte gleichzeitig die Lösch-API aufgerufen und das Ergebnis des Indexierens überprüft werden.
Bevor ein PDF hochgeladen wird, sollte überprüft werden, ob die gescannte Datei Text enthält, der extrahiert werden kann. Zudem sollten Tabellen, Überschriften sowie Absätze über mehrere Seiten hinweg geprüft werden. Selbst bei einer erfolgreichen Indizierung können komplexe Layouts zu Fehlern in der Reihenfolge oder zu Abschnitten ohne Kontext führen.
Multimodaler Bildindex
Duckys multimodaler Index kann Bilder und Text zusammen zu suchbaren Dokumenten verbinden und visuelle Informationen automatisch extrahieren. Derzeit werden JPEG, PNG, GIF und WebP unterstützt; Bilder können über eine zugängliche Adresse oder als Base64-Inhalt eingereicht werden.
- Eignet sich zur Suche nach Produktbildern, Diagrammen, Screenshoten, Designmaterialien und einer Datenbank mit Text- und Bildinformationen.
- Natursprachliche Abfragen können den visuellen Inhalt von Bildern sowie die dazugehörigen Texte abgleichen.
- Für das Abrufen der Bild-URL gibt es derzeit eine Zeitbeschränkung von 10 Sekunden.
- Die Verwendung von Base64 erhöht die Größe des Anfragekörpers und die Übertragungskosten.
- Kleine Schriftzeichen, komplexe Diagramme und Inhalte mit geringer Auflösung in den Bildern können unvollständig erkannt werden.
- Vor dem Hochladen sollten unerwünschte, sensible Informationen wie Gesichter, Ausweisdokumente, Schlüssel und Kundendaten entfernt werden.
Die alten Dokumente zur Datenladung geben weiterhin an, dass derzeit nur Text unterstützt wird, während die neueren multimodalen Dokumente sowie Produktseiten ausdrücklich die Unterstützung von Bildern bieten. Dies spiegelt eine asynchrone Aktualisierung der Dokumente wider; vor der tatsächlichen Verwendung sollte man sich an die aktuellen API-Dokumentationen sowie die Funktionen des Kontos halten.
Suchverfahren und Suchtypen
Ducky teilt die Dokumente in kleinere Abschnitte auf und erzeugt semantische Repräsentationen. Anschließend werden diese Abschnitte sowie Metadaten im Index gespeichert. Bei der Suche können Schlüsselwörter, semantische Informationen oder eine Kombination davon verwendet werden; zudem kann am Ende eine Neuanordnung der Ergebnisse vorgenommen werden.
| Suchmethode | Schwerpunkte der Übereinstimmung | Passende Szenarien | Hauptgrenzen |
|---|---|---|---|
| Schlüsselwortsuche | Genaue Wörter und annähernde Wörter | Nummern, Begriffe, Modellbezeichnungen und Vorschriften | Synonyme Ausdrücke könnten übersehen werden. |
| semantische Suche | Abfrage und Bedeutung des Inhalts | Frage-Antwort-Systeme in natürlicher Sprache und Konzeptabgleich | Es kann Inhalte zurückgegeben werden, deren Bedeutung ähnlich ist, aber die nicht der Wahrheit entsprechen. |
| Mischsuche | Gemeinsames Gewichtung von Schlüsselwörtern und Semantik | Produktsuche und Unternehmenswissensabruf | Die Gewichte müssen je nach Datensatz angepasst werden. |
| Metadaten-Filterung | Strukturierte Feldbedingungen | Rechte, Datum, Kategorie und Workflow-Status | Metadatenfehler können zu Übergriffen oder zu Ausfällen bei der Überprüfung führen. |
| Umordnung | Zweite Sortierung der Ergebnisse | Erhöhung der Relevanz der ersten Ergebnisse | Erhöhung der Verarbeitungszeit und der Suchkosten |
Der Parameter alpha dient dazu, zwischen den Schlüsselwörtern und den semantischen Signalen ein Gleichgewicht herzustellen. top_k steuert die Anzahl der zurückgegebenen Ergebnisse; der mögliche Wert liegt dabei zwischen 1 und 100. Das Team sollte zur Bewertung der Recall-Rate, der Top-Accuracy, der Verzögerungen sowie der Kosten pro Abfrage eine echte Datensammlung verwenden.
Wie werden die Suchergebnisse verwendet?
„Retrieve“ kann gleichzeitig Ergebnisse, die nach Dokumenten aggregiert sind, sowie einzelne Inhaltsteile zurückgeben. Die Ergebnisse umfassen den Textinhalt, Metadaten sowie Relevanzbewertungen. Die Anwendung kann die am relevantesten erscheinenden Teile zur Erstellung von Prompten für das große Modell verwenden oder dem Benutzer das entsprechende Dokument anzeigen.
- Die Dokumentenergebnisse ermöglichen eine übersichtliche Darstellung der vollständigen Aufzeichnungen und der ursprünglichen Unterlagen.
- Die Aufteilung in Blöcke erleichtert die Kontrolle der Länge des Kontexts, der an das große Modell gesendet wird.
- Der Korrelationswert eignet sich zur Sortierung und Fehlerbehebung, sollte jedoch nicht als Genauigkeitsgrad angesehen werden.
- Metadaten können zur weiteren Bestimmung von Berechtigungen, Kanälen und Versionen verwendet werden.
- Die ursprüngliche Dokumentennummer erleichtert den Rückgriff auf das Geschäftsystem zur Überprüfung und Aktualisierung.
- Bei der Erstellung der Antwort sollten die Audit-Einträge des verwendeten Dokuments sowie der Blöcke beibehalten werden.
Ask-Schnittstelle
Die Ask-Schnittstelle fasst die Suche und die Antwort in einer einzigen Anfrage zusammen. Nachdem der Benutzer eine Frage eingegeben hat, kann das interne KI-System die Suche erweitern, Schlussfolgerungen über mehrere Dokumente ziehen und eine direkte Antwort erstellen. Die Antwort enthält einen Zuverlässigkeitswert sowie verwandte Dokumente – ideal zur schnellen Erstellung von Fragen-und-Antwort-Funktionen.
Die Zuverlässigkeit stellt keine Garantie für rechtliche, medizinische oder geschäftliche Fakten dar. Die zugehörigen Dokumente können außerdem veraltet, widersprüchlich oder nicht ordnungsgemäß berechtigt sein. Bei Anwendungen mit hohem Risiko sollten Überprüfungen des Originaltextes, Schwellenwerte, Ablehnungen, manuelle Freigaben sowie nachvollziehbare Verweise beibehalten werden.
Vollständiges Anleitungstutorial
- Registrieren Sie ein Konto und erstellen Sie ein Projekt, um die Grenzen der Entwicklungs-, Test- und Produktionsumgebung klar zu definieren.
- Erstellen Sie im Projekt einen Index und planen Sie die Benennung entsprechend dem Verwendungszweck der Daten und den Zugriffsrechten.
- Erstellen Sie eine spezielle API-Schlüssel und speichern Sie ihn im Schlüsselverwaltungssystem auf der Serverseite.
- Installieren Sie das Python- oder TypeScript-SDK, oder wählen Sie die direkte Aufrufung der Netzwerkschnittstelle.
- Erstellen Sie eine kleine Anzahl von repräsentativen Texten, PDFs und Metadaten, um zunächst die Qualität der Extraktion und des Aufteilens zu überprüfen.
- Übermitteln Sie die Indexierungsanfrage und speichern Sie die Dokumentennummern. Überprüfen Sie die Liste sowie die Ergebnisse der Einzel-Dokumenten-Lesung.
- Testen Sie echte Benutzerfragen mithilfe von Schlüsselwörtern, semantischer und gemischter Suchmethoden.
- Anpassen von alpha, top_k, Filterbedingungen und der Neuordnung sowie Erstellung eines Offline-Testsets.
- Die Suchergebnisse oder Ask-Antworten in die Anwendung integrieren und gleichzeitig Berechtigungen sowie Faktenprüfungen durchführen.
- Überwachen von Indizes und Such-Token, fehlgeschlagenen Anfragen, Verzögerungen, leeren Ergebnissen sowie überschrittenen Gebühren.
- Erstellen Sie Synchronisierungsaufgaben für Aktualisierungen und Löschungen, wechseln Sie regelmäßig die Schlüssel und überprüfen Sie die Speicherung der Daten.
Python, TypeScript und direkte APIs
| Anschlussmöglichkeiten | Installieren oder aufrufen | Eigenschaften | Für Nutzer geeignet |
|---|---|---|---|
| Python SDK | DuckyAI installieren | Synchronisierung, Asynchronisierung und Kontextverwaltung Unterstützung | Python-Backend-, Daten- und AI-Team |
| TypeScript SDK | Installieren von duckyai-ts | Typunterstützung, keine Abhängigkeiten und auf Anfrage Paketierung | Node.js und Full-Stack-Anwendungen |
| Direkte API | Standard-Netzwerkanfrage | Unabhängig von der Programmiersprache – volle Kontrolle über die Anfragen möglich. | Andere Sprachen und benutzerdefinierte Integrationen |
| Ask-Schnittstelle | SDK oder Netzwerkanfragen | Geben Sie direkt die zusammenfassende Antwort, das Vertrauensniveau und den Dokumenttext zurück. | Schnelle Fragen und Antworten sowie Prototypen von Intelligenzsystemen |
Die aktuelle Version des Python-Pakets ist 0.12.0, die aktuelle Version des TypeScript-Pakets ist 1.4.1. Die Versionen werden weiterhin aktualisiert. In Produktumgebungen sollten die Abhängigkeiten festgelegt werden, das Changelog überprüft werden und vor dem Upgrade Rückgabetests durchgeführt werden.
Sicherheit der API-Schlüssel
- Schreiben Sie den Schlüssel nicht in die Browser-Frontend, in die Pakete der mobilen Anwendungen oder in öffentliche Repositorien.
- Erstellen Sie Schlüssel getrennt nach Projekt und Umgebung, um eine gemeinsame Nutzung zwischen Kunden zu vermeiden.
- Fügen Sie im eigenen Backend Authentifizierung, Anfragenlimits und Audit-Logs hinzu.
- Verwenden Sie den vom Benutzer eingegebenen Indexnamen nicht direkt für abusive Abfragen.
- Bei einem Schlüssel-Leak wird dieser umgehend zurückgezogen, und Abweichungen bei Indizes, Suchvorgängen und Gebühren werden überprüft.
- Verdecken Sie in den Protokollen Schlüssel, Kundeninhalte und sensible Metadaten.
Preis und Menge
| Paket oder Version | Preis | Abrechnungszeitraum | Kernrechte oder -beträge | Für Nutzer geeignet |
|---|---|---|---|---|
| Trial | 0 US-Dollar | Probephase | 100.000 Index-Token, 100.000 Such-Token | Prototyp- und Kleinstdatensatz-Tests |
| Launch | 290 US-Dollar | Jeden Monat | 3 Millionen Indexing-Token pro Monat, 3 Millionen Such-Token pro Monat, exklusiver Slack-Support | Einsatz von Anwendungen und kontinuierlicher Datenverkehr |
| Launch-Index überschritten | 0,014 US-Dollar pro 1.000 Token | Nach Bedarf | Ab dem überschrittenen Paketindex wird abgerechnet | Hinzufügen oder häufiges Aktualisieren großer Mengen an Dokumenten |
| Launch-Suche überschreitet die Grenze | 0,079 US-Dollar pro 1.000 Token | Nach Bedarf | Ab dem Überschreiten der Suchgrenze des Pakets wird abgerechnet. | Anwendungen mit hohem Abfragenaufkommen |
Für Indexierung und Suchvorgänge gelten unterschiedliche Token-Beträge sowie Preise pro Überlauf – die Kosten können daher nicht allein anhand der Anzahl der Dokumente oder Abfragen geschätzt werden. Die Länge der Dokumente, die Aufteilung in Blöcke, der zurückgegebene Kontext, die Neuordnung sowie wiederholte Aktualisierungen beeinflussen alle die tatsächliche Nutzung.
Auf der öffentlichen Seite werden nicht klar angegeben, ob sich die Testversion monatlich aktualisiert, ob eine automatische Verlängerung der Mitgliedschaft erfolgt, wie mit den ungenutzten Credits umgegangen wird, welche Gebühren anfallen, wie mit fehlgeschlagenen Anfragen umgegangen wird sowie welche Regeln für Rückerstattungen und Stornierungen gelten. Vor der endgültigen Bestellung sollten diese Punkte auf der Zahlelseite oder in einem schriftlichen Vertrag festgelegt werden.
Vorschläge zur Kosteneinschränkung
- Zuerst werden Duplikate im Dokument beseitigt, die Seitenüberschriften der Vorlagen sowie nutzlose, wiederholte Inhalte entfernt.
- Verwenden Sie die Dokumentennummer für Upsert, um zu vermeiden, dass jede kleine Aktualisierung als neues Dokument behandelt wird.
- Setzen Sie einen angemessenen Wert für top_k bei der Abfrage – verwenden Sie nicht standardmäßig die maximale Anzahl von 100 Einträgen.
- Aktivieren Sie die Neuansordnung nur, wenn eine Verbesserung der Sortierqualität erforderlich ist.
- Nutzen Sie Metadaten zur Filterung, um den Suchbereich einzugrenzen und irrelevante Kontexte zu reduzieren.
- Der Cache ermöglicht die Wiederverwendung von Suchergebnissen und stellt gleichzeitig einen Mechanismus zur Ablaufsetzung von Inhalten bereit.
- Überwachen Sie den Index und die Such-Token getrennt voneinander und legen Sie monatliche Budgets sowie Alarme für Überschreitungen fest.
GitHub, SDK und Open-Source-Status
| Projekt | Aktueller Zustand | Lizenzstatus |
|---|---|---|
| Ducky-Hosting-Plattform | Closed-Source-SaaS | Die Bestimmungen legen klar fest, dass Plattformen, Algorithmen und Technologien als Unternehmensgeheimnisse gelten. |
| ducky-cookbook | Öffentlicher Beispiel- und Leitfaden-Repository | Kein Lizenzdokument oder SPDX-Identifikator gefunden. |
| Python SDK | Kann über das Paket-Repository installiert werden | Die Metadaten des aktuellen Pakets geben keine Lizenz an. |
| TypeScript SDK | Kann über das Paket-Repository installiert werden | Die Metadaten des aktuellen Pakets geben keine Lizenz an. |
| OpenAPI und Schnittstellendokumentation | Öffentlich zugänglich machen | Dass ein Dokument lesbar ist, bedeutet nicht, dass der Code frei weitergegeben werden kann. |
Das Kochbuch ist öffentlich verfügbar und wird weiterhin aktualisiert. Es kann zur Lernung von Fragen und Antworten zu rechtlichen Dokumenten sowie für Integrationen in Slack verwendet werden. Ohne Lizenz sind jedoch keine Rechte zum Kopieren, Ändern oder kommerziellen Vertrieb gegeben. Auch wenn das SDK heruntergeladen und installiert werden kann, bedeutet das noch nicht, dass die Plattform oder das Paket unter einer offenen Lizenz stehen.
Privatsphäre, Sicherheit und Datenspeicherung
Die Erklärung zur Datenschutzrichtlinie bezieht sich auf Namen, E-Mail-Adressen, Telefonnummern, Adressen, IP-Adressen, Browser, Geräte sowie Nutzungs- und Diagnosedaten. Zudem werden Cookies, Pixel und ähnliche Technologien eingesetzt. Persönliche Informationen können zur Erstellung von Konten, zur Erfüllung von Verträgen, zur Kommunikation, zur Analyse, zur Verbesserung der Dienste sowie zum Marketing verwendet werden.
- Persönliche Daten können mit Dienstleistern, verbundenen Unternehmen, Geschäftspartnern und Auftragsausführenden geteilt werden.
- Die Daten können in dem Land der Firma bzw. des Verarbeiters verarbeitet werden, wobei die Datenschutzgesetze dort von denen im Land des Nutzers abweichen können.
- Personendaten werden für Geschäftszwecke sowie für die Dauer, die durch Streitigkeiten und rechtliche Verpflichtungen erforderlich ist, aufbewahrt; es gibt keine einheitlich festgelegte Frist für die Offenlegung.
- Benutzer können einige Informationen in ihrem Konto aktualisieren und können außerdem eine Anfrage stellen, um darauf zuzugreifen, sie zu korrigieren oder zu löschen.
- Das Unternehmen verpflichtet sich, kommerziell angemessene Schutzmaßnahmen zu ergreifen, garantiert jedoch keine absolute Sicherheit.
- Der Service ist nicht für Kinder unter 13 Jahren bestimmt.
Laut den Bestimmungen verbindet Ducky sich nur mit Daten, die vom Benutzer freiwillig bereitgestellt werden, und trifft angemessene Maßnahmen, um die Vertraulichkeit zu gewährleisten. Derzeit sind weder der genaue Ort, an dem die Daten gespeichert werden, noch die Fristen für das Löschung von Indizes, die Backup-Strategien, sowie weitere Details bezüglich der Verschlüsselung oder der Nutzung von Kundeninhalten zur Trainierung von Modellen offengelegt.
Empfehlungen zu Unternehmensdaten
- Indizieren Sie keine sensiblen persönlichen Daten oder Kundengeheimnisse, bevor ein Datenverarbeitungsvertrag unterzeichnet wurde.
- Bestätigen Sie bei dem Dienstleister den Datenaufbewahrungsort, die Unterverarbeiter, die Verwendung zum Training sowie den Löschnachweis.
- Nutzen Sie Metadaten zur Implementierung von Tenant- und Berechtigungsfiltern, aber erzwingen Sie eine erneute Authentifizierung am Anwendungsbereich.
- Für die Testumgebung werden maskierte oder synthetische Daten verwendet, anstelle einer vollständigen Produktwissensdatenbank.
- Behalten Sie die ursprünglichen Daten aus der Quelle sowie die Indexliste bei, um zu vermeiden, den gehosteten Index als einzige Sicherungskopie zu verwenden.
- Exportieren Sie vor Ablauf des Vertrags die notwendigen Zuordnungen und überprüfen Sie den Löschprozess für Dokumente, Blöcke und Backups.
Genauigkeit, Urheberrechte und kommerzielle Grenzen
Ducky ist für die Suche sowie für die Erstellung von Antworten auf der Grundlage von Indizes zuständig, doch der Benutzer muss die Ergebnisse dennoch überprüfen. Suchbewertungen, die Neuansortierung der Ergebnisse sowie die Zuverlässigkeitswerte von Ask können nicht beweisen, dass die Antworten korrekt, vollständig oder für Entscheidungen in hochriskanten Situationen geeignet sind.
- Nur das Indexierungsteam hat das Recht, Dokumente zu verarbeiten und an externe Dienste zu übertragen.
- Bestätigen Sie die Vertragsrechte für Kundeninhalte, Mitarbeiterdaten und lizenzierte Datenbanken.
- Die Suchanwendung muss sowohl vor als auch nach der Suche Zugriffskontrollen durchführen.
- Beim Anzeigen der Antworten für die Benutzer werden die ursprüngliche Quelle und das Aktualisierungsdatum angegeben.
- Für konfliktbehaftete Dokumente, Fälle ohne Ergebnis sowie niedrige Zuverlässigkeitswerte werden Ablehnungen und manuelle Überprüfungen eingeführt.
- Die Bedingungen geben keine vollständige Erläuterung zu den Kundendaten sowie zu den Rechten zur Erstellung von Ausgaben; das Unternehmen muss dies schriftlich bestätigen.
- Die Plattform selbst darf ohne schriftliche Genehmigung weder kopiert, verändert noch verbreitet werden.
Passend für Nutzer und Szenarien
- SaaS-Entwicklerteam: Fügen Sie einem Produkt eine Hilfeseite sowie eine Suchfunktion innerhalb der Anwendung hinzu.
- Agentenentwickler: Liefern relevanten Kontext für Toolaufrufe und Antworten.
- E-Commerce-Team: Suche nach Produkten mithilfe von Natursprache, Bildern und Metadaten.
- Unternehmenswissens-Team: Suche nach Handbüchern, Richtlinien, Sitzungsprotokollen und internen Berichten.
- Rechts- und Compliance-Team: Erstellung eines Prototyps für Fragen und Antworten mit Überprüfung des Originaltextes.
- Kundenservice-Produkte: Suche nach Serviceanfragen, Produktdokumentationen und Lösungswissen.
- Datenteam: Schnelle Überprüfung von Schlüsselwörtern, Semantik sowie Strategien zur Kombination und Umordnung.
Vorteile und wesentliche Einschränkungen
Hauptvorteile
- Verwaltung von Indizes, Blöcken, semantischer Suche und Neuansordnung – um die Notwendigkeit einer eigenen Infrastruktur zu verringern.
- Gleichzeitig werden Schlüsselwörter, Semantik, gemischte Suche sowie fortgeschrittene Metadatenfiltering-Funktionen bereitgestellt.
- Unterstützung von Texten, PDFs, Textdateien und multimodalen Bildern.
- Python, TypeScript und direkte APIs decken die gängigen Anbindungsmethoden ab.
- Die Ask-Schnittstelle kann direkt die Antwort, das Vertrauensniveau und die relevanten Dokumente zurückgeben.
- Der kostenlose Datenvolumen ermöglicht es zunächst, die Qualität mit echten kleinen Datensätzen zu überprüfen.
Hauptbeschränkungen
- Für Indexierung und Suchfunktionen werden unterschiedliche Token abgerechnet; die Kosten müssen separat überwacht werden.
- Gemischte Gewichte, Blockierung, Metadaten und Berechtigungen müssen weiterhin von dem Team entworfen und überprüft werden.
- Die von Ask erzeugten Antworten können ungenau sein und ersetzen weder den Originaltext noch eine fachliche Prüfung.
- Der Unterstützungsumfang einiger alter Dokumente stimmt nicht mit dem der neuen multimodalen Seiten überein.
- Es liegen unzureichende öffentliche Informationen über die Speicherung der Daten, die Authentifizierung, die Verwendung zum Training sowie die Löschung.
- Die Plattform ist nicht offen zugänglich; für das offizielle Cookbook sowie das SDK wurden derzeit keine Lizenzangaben festgestellt.
Zusammenfassung
Ducky eignet sich für Entwicklerteams, die schnell einen hosteten Dokumentenindex, gemischte Suchfunktionen, Neuanordnung von Inhalten sowie Fragen-und-Antwort-Schnittstellen für KI-Produkte bereitstellen möchten, ohne selbst ein Suchcluster verwalten zu müssen. Vor der Einführung sollten insbesondere die Qualität der echten Daten, die Trennung der Berechtigungen, die Kosten für die beiden Arten von Token, Verträge zur Datensicherheit, die Löschprozesse sowie die Grenzen der Nutzung von Beispielcode ohne Lizenz überprüft werden.
Häufige Fragen
Was für eine Art von Tool ist Ducky?
Es handelt sich um eine vollständig verwaltete RAG-Auswertungsinfrastruktur, die Dokumentindizes, Schlüsselwort- und semantische Suchfunktionen sowie eine Reorganisierungs- und direkte Fragesystem-Interface bietet und hauptsächlich über API- und SDK-Schnittstellen in Anwendungen integriert werden kann.
Kann Ducky kostenlos verwendet werden?
Es ist möglich, eine Testversion zu nutzen. Die Trial-Version enthält derzeit 100.000 Indexing-Tokens sowie 100.000 Such-Tokens. Auf der offiziellen Seite wird nicht klar angegeben, ob diese Limits regelmäßig aufgefrischt werden.
Wie viel kostet das Launch-Paket?
Derzeit beträgt der Preis 290 US-Dollar pro Monat. Dies beinhaltet 3 Millionen Index-Tokens sowie 3 Millionen Such-Tokens pro Monat, sowie spezielle Unterstützung über Slack.
Wie wird für die Überschreitung der Menge berechnet?
Die Überlaufgebühr für den Index beträgt 0,014 US-Dollar pro 1.000 Token, die Überlaufgebühr für die Suche beträgt 0,079 US-Dollar pro 1.000 Token. Es sollten separate Überwachungsmechanismen sowie Budgets festgelegt werden.
Wird PDF und Bildern unterstützt?
PDF-, Textdateien sowie multimodale Bilder werden unterstützt. Zu den Bildformaten gehören JPEG, PNG, GIF und WebP. Die Einschränkungen für Dateien und Bilder sind an die aktuellen Schnittstellen zu überprüfen.
Welche Suchmethoden werden unterstützt?
Unterstützung von Schlüsselwörtern, semantischer und gemischter Suche, Gewichtsanpassung über Alpha sowie Filterung von Metadaten und optionale Neuanordnung.
Was ist der Unterschied zwischen der Ask-Schnittstelle und einer normalen Suche?
Eine einfache Suche liefert Dokumente und Abschnitte, während Ask weiterhin eine zusammenfassende Antwort erstellt und dabei einen Zuverlässigkeitsgrad sowie verwandte Dokumente angibt. Bei beiden Methoden muss man selbst Prüfungen hinsichtlich Berechtigungen und Fakten durchführen.
Gibt es SDKs für Python und TypeScript?
Ja, für Python ist der Paketname duckyai, für TypeScript der Paketname duckyai-ts. Es ist auch möglich, die API direkt über Standard-Netzwerkanfragen aufzurufen.
Ist das Ducky-Cookbook Open Source?
Der Speicher ist öffentlich einsehbar, doch derzeit wurden weder Lizenzdokumente noch SPDX-Identifikatoren festgestellt. Öffentlichkeit bedeutet nicht, dass eine Genehmigung zur Änderung, zum kommerziellen Einsatz und zur Weiterverbreitung erteilt wird.
Ist die Ducky-Plattform offen source?
Da es sich um geschlossenes Codebasis handelt, gelten die Bedingungen dazu, dass die Plattform, die Algorithmen sowie die damit verbundenen Technologien als das geistige Eigentum des Unternehmens gelten. Auch wenn SDKs und Beispielprojekte veröffentlicht werden, ändert sich dadurch nichts an der Tatsache, dass es sich um eine geschlossene Plattform handelt.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164