Neuwo
Neuwo – ein intelligentes Tool für die Programmierung mit KI
Tags:AI-ProgrammierwerkzeugeWas ist Neuwo?
Neuwo ist eine von der finnischen Firma Neuwo Oy entwickelte Plattform zur Klassifizierung von Inhalten mithilfe von KI sowie zur Anzeigenschaltung im Kontext des jeweiligen Inhalts. Es handelt sich dabei nicht um ein Tool zur Erstellung von Code. Neuwo analysiert die Semantik von Webseiten oder Texten und liefert Informationen zu den Themen, zu den gängigen Werbeklassifizierungen, zu Sicherheitsaspekten bezüglich der Marken sowie zu individuellen Unterteilungen. Diese Informationen können von Medienunternehmen, Unternehmen im Bereich Werbetech sowie für Dokumentenprozesse genutzt werden.
Das Produkt betont eine Werbeanpassung, die auf dem Inhalt und nicht auf der persönlichen Identität beruht. Zudem werden Möglichkeiten zur Monetarisierung für Anbieter sowie verbesserte Auktionssignale und anpassbare Klassifizierungsmodelle bereitgestellt. Unternehmen können zwischen dem Teilen von APIs, einer privaten Cloud oder einer lokalen Installation wählen; die genauen Funktionen hängen vom Vertrag und der Umsetzungsstrategie ab.
Hauptfunktionen
Semantische Klassifizierung und automatische Beschriftung
- Nach Eingabe von Artikeln, Verträgen, Berichten, E-Mails oder anderem Text analysiert das System den vollständigen Kontext – anstatt nur Schlüsselwörter abzuschließen – und gibt relevante Tags aus mehr als zehntausend vorgefertigten Themen zurück.
- Jedes Thema oder jede Kategorie hat eine Relevanzbewertung. Der Aufrufer kann einen Mindestschwellenwert sowie die Anzahl der zurückzugeben Ergebnisse festlegen, um Ergebnisse mit geringer Zuverlässigkeit auszusortieren.
- Die Auto-Tagging-API kann neuen Beiträgen sowie älteren Artikeln automatisch Themen, Kategorien und Metadaten hinzufügen, um dem Redaktionsteam dabei zu helfen, die Tags und Suchstrukturen auf der Website zu standardisieren.
- Die Plattform behauptet, mehr als 100 Sprachen zu unterstützen, und es ist möglich, angepasste Klassifikatoren für den jeweiligen Kundensektor sowie spezifisches Fachvokabular zu trainieren; für offizielle Projekte muss die Genauigkeit in den verschiedenen Sprachen jedoch weiterhin anhand eigener Datensätze bewertet werden.
IAB-Klassifizierung und Markensicherheit
- Die Standardantwort kann die Ebenen 1 bis 3 der IAB-Inhaltsklassifizierung enthalten, die das Thema der Seite beschreiben; sie kann auch die Ebenen 3 bis 5 der IAB-Zielgruppenklassifizierung sowie Google Topics umfassen.
- Der Markensicherheitsmodul gibt jeweils eine Bewertung sowie einen Hinweis darauf, ob die Marke sicher ist – damit kann beurteilt werden, ob eine Anzeige neben dem aktuellen Inhalt geeignet ist.
- Smart Tags können Themen gemäß von Kunden festgelegten Regeln auf Aktionen, Einschränkungen oder benutzerdefinierte Unterkategorien abbilden und erscheinen in den Antworten nur, wenn das Konto aktiviert ist.
- Markensicherheit und Zielgruppenanalyse gehören zur Modellbewertung und sollten nicht allein zur Entscheidung über die kommerzielle Verarbeitung sensibler Nachrichten, politischer, medizinischer oder rechtlicher Inhalte herangezogen werden. Es müssen weiterhin Mechanismen für menschliche Überprüfung und Beschwerden vorhanden sein.
Bid Enrichment – Verbesserung der Gebote
- Neuwo analysiert den Inhalt, wenn Benutzer eine Seite aufrufen, und fügt die IAB-Inhalte sowie die Zielgruppenkategorien in das OpenRTB-Auktionssystem ein, damit Käufer auf der Grundlage der Semantik der Seite bieten können.
- Das Prebid-Echtzeitdatenmodul eignet sich für Anbieter, die bereits Header Bidding nutzen, und ermöglicht es, Wartezeiten für Auktionen, Relevanzschwellwerte, Klassifizierungsstufen sowie die maximale Anzahl pro Stufe einzustellen.
- Der Google Ad Manager ermöglicht die Lokalisierung und Berichterstattung durch Signale der Veröffentlichungsplattformen und kann mit den Monetarisierungsplänen Prebid oder Neuwo kombiniert werden.
- Kontextsignale erfordern weder eine Benutzeridentifizierung noch Drittanbieter-Cookies, doch die Kategoriedaten gelangen in das System des Käufers, der das Gebot abgibt. Der Anbieter muss weiterhin die Werbelinks mit den lokalen Datenschutzvorschriften abgleichen.
Monetarisierung durch Verleger und Kontextpublikum
- Die Neuwo-Monetarisierungsplattform ermöglicht es Neuwo, Werbetags hinzuzufügen, Werbeplätze zu verwalten, Nachfragen zu vermitteln, Inhalte neu zu laden sowie Sichtbarkeit und weitere Funktionen zu steuern – ideal für Medien, die keinen eigenen Auktionsservice betreiben möchten.
- Die Zielgruppen im Kontext werden anhand des Inhalts gebildet, den der Leser konsumiert – anstatt von der Verfolgung der persönlichen Identität über verschiedene Websites. Dies kann bei Aktivitäten im offenen Internet sowie im Netzwerkfernsehen verwendet werden.
- Auto-Tagging kann zudem semantische Signale für die Empfehlung relevanter Artikel liefern, wodurch den Medien geholfen wird, Content-Entdeckung, -Verweildauer und Werbeeinnahmen in einem einheitlichen Klassifikationssystem zu bündeln.
- Einnahmen, Auslastung und Gebotssteigerungen hängen von der Zielregion, dem Inhalt, den Werbeplätzen, der Nachfrage der Käufer sowie den Umsetzungsweisen ab; aus der Genauigkeit der Klassifizierung lässt sich kein direkter Ertrag ableiten.
Klassifizierung von Unternehmensdokumenten
- Regierungen und öffentliche Behörden können Rückmeldungen, Planungsunterlagen oder Entscheidungen automatisch an die zuständigen Abteilungen weiterleiten und einheitliche Kennzeichnungen für die Akten erstellen.
- Rechtliche, finanzielle und medizinische Organisationen können Vertragsbedingungen, Risikofaktoren, Anträge, Schadensersatzansprüche oder klinische Dokumente nach einer benutzerdefinierten Klassifikation identifizieren.
- Forschungseinrichtungen können für Artikel, Anträge auf Finanzierung und Berichte interdisziplinäre Themenindizes erstellen; benutzerdefinierte Modelle können mit etwa 100 Dokumenten als Ausgangspunkt optimiert werden.
- Für die Kategorie „hohes Risiko“ müssen Genauigkeit, Trefferquote und der Fehlerkosten durch repräsentative Testmengen gemessen werden, und es muss eine manuelle Überprüfung erfolgen – es reicht nicht aus, sich allein auf die Demonstration des Anbieters zu verlassen.
Wie wählt man zwischen den beiden Arten von APIs aus?
| Schnittstelle | Eingabe | Ausführungsort | Typische Anwendungen | Wichtige Hinweise |
|---|---|---|---|---|
| EDGE API | Veröffentlichte Seite-Adresse | Browser, Prebid und Auktionsschleifen | Webseitenkategorisierung, Bid Enrichment, Echtzeit-Anzeichen für Werbung | Es müssen die zulässigen Domainnamen konfiguriert werden; für neue Adressen wird in der Regel eine Wartezeit von 10 bis 60 Sekunden benötigt, bevor ein Ergebnis bereitgestellt wird. |
| Auto-Tagging API | Haupttext und optionale Dokumentmetadaten | Kunden-Server | Klassifizierung vor der Veröffentlichung, Dokumenteneinlagern, Massenlabeln und benutzerdefinierte Workflows | Durch die Verwendung unabhängiger Token und Endpunkte sollten Server-Schlüssel nicht auf Webseiten offengelegt werden. |
Die Tokens sowie die Basis-Endpunkte der beiden API-Typen sind voneinander unabhängig und dürfen nicht miteinander vermischt werden. Neuwo bietet keine Selbstregistrierung an; die Kunden müssen den zu analysierenden Website oder das jeweilige Geschäftszenario angeben, damit das Team die Endpunkte sowie Tokens aktiviert.
API-Ausgabe und Verarbeitungslogik
| Antwortteil | Inhalt | Verwendungsmöglichkeiten | Grenzen |
|---|---|---|---|
| Thementags | Labelname, eindeutige Identifikation und Relevanzwert | Interne Tags, Suchfunktionen, Empfehlungen und Routing | Schwellenwerte sollten nach dem Geschäftsbereich festgelegt werden, und leere Ergebnisse müssen verarbeitet werden. |
| Marketing-Kategorisierung | IAB-Inhalte, IAB-Publikum, Google Topics sowie benutzerdefinierte Kategorien | Auktionen, Berichte, Werbeplatzierung und Inhaltsverwaltung | Die Version der Klassifizierung sowie die Vertragskonfiguration können unterschiedlich sein. |
| Markensicherheit | Sicherheitswert und Anzeigen | Werbebeschränkungen und Priorität der manuellen Überprüfung | Der Kontext und die Markenstandards unterscheiden sich – man kann nicht nur nach einem binären Urteil vorgehen. |
| Smart Tags | Vordefinierte Aktivitäten oder Regellabels der Kunden | Unterteilung der Aktivierungs- und Automatisierungsprozesse | Wird nur zurückgegeben, wenn das Konto aktiviert und Regeln konfiguriert sind. |
| Fehler | Zertifizierung, Berechtigungen, keine Daten, Inhalt nicht verfügbar oder Dienstfehler | Wiederholen, Alarme und Downgrade-Verarbeitung | Die Werte können in der ursprünglichen Antwort als Zeichenketten vorliegen; vor dem Vergleich muss die Typumwandlung erfolgen. |
API-Anbindungstutorial
- Definieren Sie den genauen Anwendungsfall, die Domain des Sites, die erwartete Anzahl an Dokumenten, die ZielSprache, die Klassifizierungsmethode, die Sicherheitsregeln für die Marke sowie den Standort der Bereitstellung.
- Kontaktieren Sie Neuwo, um einen Pilotversuch zu beantragen oder ein Angebot anzufordern, erhalten Sie so die erforderlichen API-Endpunkte und Tokens sowie die erlaubten Browser-Domains.
- Wählen Sie entweder den ursprünglichen REST-Aufruf oder die JavaScript-, Python- oder .NET-SDKs, und speichern Sie das Token in Umgebungsvariablen oder in einem Schlüsselverwaltungssystem.
- Verwenden Sie eine Gruppe von manuell annotierten, repräsentativen Texten, um Themen, IAB-Kategorien, Markensicherheit und benutzerdefinierte Tags zu testen, und dokumentieren Sie die Arten der Fehlentscheidungen.
- Basierend auf den Validierungsergebnissen werden Schwellenwerte für die Korrelation, die Anzahl der zurückgegebenen Ergebnisse, Smart Tags sowie die Version der Klassifizierungsmethode festgelegt. Zudem werden Prozesse zur Handhabung von leeren Ergebnissen, Bandbreitenbeschränkungen und Servicefehlern entworfen.
- Die EDGE-API wartet, bis die Analyse der neuen Seite abgeschlossen ist, und versucht es anschließend erneut; die Text-Schnittstelle auf der Serverseite protokolliert hingegen die Dokumentidentifikation, um Doppelverarbeitungen und Dateninkonsistenzen zu vermeiden.
- Nach dem Go-Live werden kontinuierlich Stichproben aus verschiedenen Sprachen, Kategorien und sensiblen Themen überprüft, um Verzögerungen, Fehlerraten, Klassifizierungsverschiebungen sowie die tatsächlichen Auswirkungen auf die Werbeeinnahmen oder den Geschäftsablauf zu überwachen.
SDK, GitHub und Open-Source-Status
| Entwicklungstools | Installation oder Betriebsumgebung | Hauptverwendungszweck | Lizenzen und Einschränkungen |
|---|---|---|---|
| JavaScript- und TypeScript-SDK | Node.js 18 und neuer sowie moderne Browser | Aufruf der REST-Schnittstelle für Texte oder der EDGE-Schnittstelle für Webseiten, inklusive Typverarbeitung und Fehlerbehandlung | Die offiziellen Repositorien nutzen die MIT-Lizenz; für die Nutzung der API ist weiterhin ein kommerzielles Token erforderlich. |
| Python SDK | Python 3.8 und höher | Serverseitige Textklassifizierung, Webanalyse und Batchverarbeitung | Der SDK-Code ist öffentlich verfügbar und enthält weder das Neuwo-Modell noch den Server. |
| .NET SDK | .NET 8 oder 9, Windows, Linux, macOS | Unternehmensanwendungen, Dependency Injection, asynchrone Aufrufe und Logging | Die Lizenzen für SDKs und gehostete Klassifizierungsdienste sollten getrennt voneinander betrachtet werden. |
| Prebid-Modul | Prebid.js-Veröffentlichungsplattform für Auktionen | Klassifizieren Sie den Kontext und fügen Sie ihn in die OpenRTB-Anfrage ein. | Eine Neuwo-Konfiguration, ein API-Token sowie eine Lizenz für die Domain des Sites sind erforderlich. |
Die offiziellen Quellen stellen den SDK-Code sowie Beispiele zur Verfügung, wobei die JavaScript- und TypeScript-SDKs ausdrücklich unter der MIT-Lizenz bereitgestellt werden. Open Source sind nur die Tools zur Clientverbindung – nicht die proprietären Klassifizierungsmodelle von Neuwo, die Trainingsdaten, die Hosting-Dienste oder die Monetarisierungsplattformen.
Preise, Testversionen und Kauf
| Paket oder Version | Preis | Abrechnungszeitraum | Kernrechte oder -beträge | Für Nutzer geeignet |
|---|---|---|---|---|
| Nach Dokument-API | Individuelle Kostenschätzung | Nach der Anzahl bearbeiteter Dokumente | Klassifizierung von Texten oder Webseiten, die Kosten nehmen linear mit der Anzahl der Dokumente zu. | Teams mit schwankenden Bedarfen oder deren Kosten müssen nach dem Umfang der geleisteten Arbeit berechnet werden. |
| Fixe monatliche API-Gebühr | Individuelle Kostenschätzung | Jeden Monat | Die im Vertrag festgelegten Nutzungsgrenzen, Endpunkte, Sprachen und Support. | Unternehmen mit konstanter Monatsverarbeitungsmenge |
| Private Cloud oder lokale Implementierung | Kontaktieren Sie den Verkauf | Vertrag festgelegt | EU-Datenverbleib, isolierte Umgebungen und Optionen für benutzerdefinierte Modelle | Regierungs-, Finanz-, Gesundheits- und Szenarien mit sensiblen Daten |
| Bid Enrichment und Plattformen zur Umsetzung in Bargeld | Kontaktieren Sie den Verkauf | Vertrag festgelegt | Prebid, Werbeserver-Signale oder die Monetarisierung von Werbung durch Neuwo | Digitale Medien und Verleger |
| Pilotprojekt oder Demonstration | Kontaktieren Sie den Verkauf | Projekt festgelegt | Für Online-Demonstrationen oder die Überprüfung von Geschäftsdaten gibt es auf der öffentlichen Seite keine festgelegte kostenlose Nutzungsmenge. | Prüfung der Genauigkeit sowie Integration des Teams vor dem Einkauf |
Die Beschreibung der öffentlichen Seite gibt an, dass man entweder nach Dokumenten oder bei einer festen monatlichen Gebühr mit Nutzungslimit wählen kann – doch es werden weder der Preis pro Einheit, noch die Mindestbestellmenge, noch Gebühren für Überschreitungen oder ein kostenloses Kontingent angegeben. Bei der Kostenschätzung sollten außerdem Zusagen bezüglich der Reaktionszeit, der Anzahl der gleichzeitig laufenden Aufgaben, der Datenspeicherung, des Supports, der anpassbaren Kategorisierung sowie der Implementierungskosten berücksichtigt werden.
Rückerstattungen, Stornierungen von Verträgen sowie Entschädigungen bei Dienstunterbrechungen werden auf den öffentlichen Seiten nicht klar dargelegt. Das Unternehmen sollte in der Bestellbestätigung, im Hauptdienstleistungsvertrag sowie in den SLA-Bedingungen klare Regelungen bezüglich der Abnahme des Pilotprojekts, der Mindestgenauigkeit, der Verlängerung des Vertrags, des Austritts, der Löschung von Daten sowie des Umgangs mit Fällen, in denen die Anforderungen nicht erfüllt werden, festlegen.
Geeignet für Nutzer und typische Szenarien
- Nachrichten, Zeitschriften und spezialisierte Medien taggen historische Inhalte in großen Mengen und verbessern durch semantische Klassifizierung die Suche sowie die Empfehlung relevanter Artikel.
- Der Anbieter fügt IAB-Themen sowie Signale zur Markensicherheit zu den Auktionsanfragen hinzu, um die Abhängigkeit von Drittparteien bezüglich der Identifizierung von Personen zu verringern.
- Werbekunden und Agenturen legen Regeln für ungeeignete Inhalte oder Zielgruppen im Kontext fest, die in offenen Netzwerken sowie beim Internetfernsehen aktiviert werden.
- Regierungen, Gesetze, Finanzinstitute, medizinische Einrichtungen und Forschungseinrichtungen führen eine konsistente Klassifizierung, Routenbestimmung, Prüfung sowie strukturierte Suche von großen Mengen an Texten durch.
- Unternehmen mit einer eigenen Klassifizierungsmethode beauftragen Neuwo damit, maßgeschneiderte Modelle zu trainieren und zu warten, anstatt selbst ein vollständiges Machine-Learning-Team aufzubauen.
Vorteile und Grenzen der Fähigkeiten
Vorteile
- D dieselbe Klassifizierung kann zur Bearbeitung von Tags, zur Empfehlung von Inhalten, zum Wettbewerb bei Werbeanzeigen, zur Sicherheit der Marke sowie zu Unternehmensdokumentenprozessen genutzt werden.
- Es werden sowohl Web-Adressen als auch der ursprüngliche Text als Eingabemöglichkeiten unterstützt, und es stehen Anschlussmöglichkeiten für Prebid, Werbeserver sowie mehrsprachige SDKs zur Verfügung.
- Optionaler EU-Datenstandort, Private Cloud und lokale Implementierung – geeignet für Branchen mit strengen Anforderungen an die Grenzüberschreitung und Isolation.
- Die Gebühren werden nach Dokument oder fester monatlicher Menge berechnet, nicht nach der Länge des Textes. Dadurch lässt sich die Kosten für lange Dokumente leichter im Vertrag vorhersagen.
Grenzen
- „Jede Sprache“ sowie die Angaben zu den Geschwindigkeiten gehören zur Beschreibung der Gesamtkapazitäten der Plattform. Sie bedeuten nicht, dass für jede Sprache, jeden Stil und jede Einsatzsituation dieselben Ergebnisse oder Verzögerungen erreicht werden.
- Klassifizierungsmodelle sind konsistenter als Generierungsmodelle, werden aber dennoch von Ironie, Metaphern, mehrthematischen Artikeln, unzureichendem Kontext und neuen Konzepten beeinflusst.
- Die IAB-Publikumsklassifizierung basiert auf Kontextsignalen, die aus dem Gelesenen abgeleitet werden, und stellt keine Bestätigung der konkreten Identität, des Alters, der Interessen oder der Kaufabsicht des Lesers dar.
- Die Eintragung der Kategorien in die Auktionsanfragen wird an die Werbetechnologie-Partner weitergegeben; vor der Umsetzung müssen die OpenRTB-Felder, der Käuferkreis sowie die Compliance-Hinweise überprüft werden.
- Es gibt weder Selbstbedienungskonten noch offene Preise; individuelle Entwickler oder kleine Projekte müssen sich über Verkaufsgespräche bemühen.
Datenschutz, Sicherheit und Datenschutzrichtlinien
- Die Seite der Classification-API verspricht eine Speicherung der Daten in der EU und erklärt, dass die Kundendaten nicht zur Erstellung öffentlicher Modelle verwendet werden. Private Clouds sowie lokale Implementierungen ermöglichen zudem eine weitere Trennung sensibler Inhalte.
- Die Datenschutzerklärung der Website beschreibt hauptsächlich Kontaktdaten und Informationen im Zusammenhang mit der Rekrutierung, einschließlich Namen, Telefonnummern, E-Mail-Adressen und Anhänge. Es wird angegeben, dass diese Daten nur während des Kundenkontakts oder der Rekrutierungsphase gespeichert werden und auf Anfrage gelöscht werden können.
- Diese Datenschutzrichtlinie wurde früh veröffentlicht und erläutert nicht ausreichend den Inhalt der API, Protokolle, die Optimierung von Modellen, Drittanbieter für die Verarbeitung von Daten, Backups sowie die Aufbewahrungsfristen je nach Datentyp. Sie kann daher kein Ersatz für Vereinbarungen zur Verarbeitung von Unternehmensdaten sein.
- Webanalyse-Cookies werden nur mit Zustimmung des Benutzers an Google Analytics gesendet; bei Ablehnung wird die Zustimmungspräferenz lediglich im Browser gespeichert.
- Das Prebid-Modul ermöglicht es, vor dem Senden der Analyse-Adresse alle oder bestimmte Abfragemethoden sowie -teile zu entfernen, wodurch das Risiko eines Lecks von Tracking-Parametern oder sensiblen Informationen in der Adresse verringert wird.
- Gesundheits-, Rechts-, Finanz- oder nicht veröffentlichte Forschungsdaten sollten vorzugsweise in einer privaten Umgebung gespeichert werden. In den Verträgen müssen Verschlüsselung, Zugriffskontrollen, Benachrichtigungen bei Ereignissen, Überprüfung der Löschung sowie Rechte zur Prüfung festgelegt werden.
Plattformen und Anwendungen
Die wichtigsten Lieferformen von Neuwo sind APIs, Skripte für die Website der Anbieter, das Prebid-Modul, Konfigurationen für Google Ad Manager sowie Server-SIDE SDKs. Es gibt bisher keine offiziellen Apps für Endverbraucher im App Store oder auf Google Play – mobile App-Stores stellen somit nicht die Hauptvertriebskanäle für die Produkte dieses Unternehmens dar.
Auf den Historie-Seiten wurden bereits WordPress-Plugins vorgestellt, doch die aktuellen Entwicklungsdokumentationen konzentrieren sich auf die Integration von APIs und Werbetechnologien. Falls WordPress benötigt wird, sollte man zunächst bei Neuwo nachfragen, ob die Plugins weiterhin gewartet werden, welche Kompatibilitätsversionen verfügbar sind und welcher Support angeboten wird – anstatt direkt auf alte Informationen zu setzen.
Zusammenfassung
Neuwo eignet sich für Medienunternehmen, Werbetech-Unternehmen sowie regulierte Unternehmen, die eine großangelegte, wiederholbare Textklassifizierung benötigen. Es kann Themen, IAB-Klassifikationen, Markensicherheit sowie benutzerdefinierte Regeln in strukturierte Signale umwandeln und bietet verschiedene Implementierungsvarianten – von gemeinsam genutzten APIs bis hin zu privater Bereitstellung.
Vor dem Einkauf ist es am wichtigsten, die Genauigkeit mithilfe eigener Daten zu überprüfen und dabei die Klassifizierungsmethoden, Verzögerungen, die Speicherung der Daten, die Preise, die SLA-Bedingungen sowie die Prozesse zur manuellen Überprüfung klar zu definieren. Die Offenlegung des SDK senkt die Hürden für den Zugang, doch die Kernmodelle und Plattformen bleiben proprietäre Dienste, für die ein kommerzieller Vertrag erforderlich ist.
Guigong-Netzwerk-Sicherheitsnummer: 45132202000164