Über SenseChat beraten
Kostenloser Mehrwert
Komplette Liste an KI-Tools KI-Dialog-Chat

Über SenseChat beraten

Der von SenseTime entwickelte Assistent für Wissensfragen und Kreativarbeit

Tags:

Besprechen wir, was SenseChat ist?

SenseChat ist ein mehrmodales AI-Chat- und Lebensassistent, der von SenseTime entwickelt wurde. Als Grundlage dienen das große Modellsystem „Ririxin“ SenseNova sowie die AI-Infrastruktur SenseCore. SenseChat kann Texte, Bilder und Dokumente verarbeiten und erledigt Aufgaben wie Fragen beantworten, Texte schreiben, Zusammenfassungen erstellen, übersetzen, bei dem Lernen unterstützen, im Internet suchen sowie Bilder verstehen.

Shanglun ist ein Produkt für Einzelpользоватel; wenn das Modell in eine Website, eine App oder ein Unternehmenssystem integriert werden muss, sollte die Rijixin-Öffentlichkeitsplattform verwendet werden.

Die Kontodaten, Limits, Servicevereinbarungen und Preise beider können nicht miteinander verwechselt werden.

Hauptfunktionen

1. Mehrfach-Dialoge und Inhaltscreation

Die Diskussionen können sich um ein einziges Thema drehen, wodurch Erklärungen zu bestimmten Themen, das Verfassen von Artikeln, E-Mails, Werbetexten, Brainstorming-Sitzungen sowie das Lernen von Code und Sprachen möglich sind. Die aktuelle Webseite zeigt Modelle wie SenseNova V6.5 Pro an; außerdem können je nach Aufgabe Schlussfolgerungen gezogen oder Tools verwendet werden.

Das Modell erzeugt Inhalt, der flüssig erscheint, aber ungenau ist. Fachwissen, Statistiken, Code und Quellen müssen erneut überprüft werden; die Natürlichkeit der Sprache darf nicht als Zuverlässigkeit der Fakten angesehen werden.

2. Suchen im Internet

Der Benutzer kann die Vernetzungsfunktion aktivieren, damit das Modell aktuelle Webseiten abruft und daraus Antworten erstellt. Dies eignet sich zur Erfassung von Nachrichtenhintergründen, Produktänderungen und aktuellen Informationen, doch die Abdeckung der Suchergebnisse, die Sortierung der Quellen sowie das Datum der Webseiten können unvollständig sein.

Bei Themen zu Politik, Preisen, Gesundheitswesen, Recht und Finanzen sollte die ursprüngliche Seite geöffnet werden, um dies zu überprüfen.

3. Fragen und Antworten zu Dokumenten

Man kann besprechen, wie Beispiele für PDF-Dateien auf der Startseite dargestellt werden können. Es ist möglich, Berichte, Arbeiten und Lernmaterialien zu zusammenfassen, Fragen dazu zu stellen sowie Informationen daraus zu extrahieren. Die Funktion zur Beantwortung von Fragen zu den Dateien spart Zeit beim Lesen – doch Scans, komplexe Tabellen, Fußnoten sowie Verbindungen zwischen Seiten können falsch interpretiert werden.

Vor dem Hochladen von vertraulichen Dokumenten sollten die Genehmigung der Organisation sowie die Datenschutzbestimmungen überprüft werden.

4. Bildverständnis

Multimodale Modelle ermöglichen das Hochladen von Bildern zur Erkennung, Beschreibung, grafischen Analyse, OCR-Unterstützung sowie visuellen Fragen und Antworten. Sie können für Lernmaterialien, Produktinformationen und alltägliche Fotos verwendet werden, ersetzen aber keine Diagnosen aufgrund von medizinischen Bildern, die Identifizierung oder Sicherheitskontrollen.

5. Gespräch auf Englisch und Kantonesisch

Es werden Möglichkeiten zur Verfügung gestellt, Übungssituationen wie englische Gesprächspartner zu finden. Die Hongkong-Version von SenseChat unterstützt insbesondere die Umgangssprache und Umschreibungen im Kantonesischen sowie den mehrmodalen Austausch und bietet zudem eine mobile Anwendung für Hongkong.

Regionale Versionen, Anmeldeverfahren und die Verfügbarkeit in den App-Stores können unterschiedlich sein.

6. Tiefgründiges Nachdenken

SenseNova Reasoner sowie die V6.5-Serie können für Mathematik, Logik, Programmierung und komplexe Analysen eingesetzt werden. Eine längere Denkzeit bedeutet nicht unbedingt, dass die Antwort richtig ist.

Komplexe Schlussfolgerungen sollten Annahmen, Berechnungen und die endgültigen Schlussfolgerungen überprüfen, um zu verhindern, dass das Modell auf falschen Prämissen weiterentwickelt wird.

Unterstützungsplattformen

Kunden auf dem chinesischen Festland können die Webversion nutzen, es wird auch eine Version für Mobilgeräte bereitgestellt. Auf dem Hongkong-Markt sind Versionen für iOS und Android verfügbar, wobei der Fokus auf der Nutzung in Kantonesisch liegt.

Die Version für Mobilgeräte, die Systemanforderungen sowie der Veröffentlichungszustand in bestimmten Regionen richten sich nach den aktuellen Angaben auf der Seite des App-Stores.

Für das Anmelden, das Verfolgen der Historie sowie das Hochladen von Dateien ist in der Regel ein Konto erforderlich. Bevor Gespräche öffentlich geteilt werden, sollten Name, Kontaktdaten, Kundendaten sowie interne Dokumente entfernt werden.

Preis- und Versionsvergleich

Paket oder VersionPreise, Limits und Kernvorteile
Preis für die Einzelpersonen-VersionAuf der offiziellen Website wird zwar ermöglicht, dass Privatnutzer sich registrieren und die wichtigsten Funktionen ausprobieren können, doch es werden weder feste Preise für eine Mitgliedschaft noch eine Tabelle mit Angaben zu den kostenlosen Nutzungsrechten bereitgestellt. Die Auswahl der Modelle, die Anzahl der Verbindungen, die maximale Dateigröße sowie die Beschränkungen in Zeiten hoher Belastung können je nach Betriebsbedingungen angepasst werden. Daher sollte der Tool-Katalog als „kostenlose Testversion“ bezeichnet werden – es sollte nicht als dauerhaft kostenlos oder für unbegrenzte Nutzung angegeben werden. Falls auf der Seite Informationen zu Mitgliedschaften, Punkten oder Aktionspaketen angezeigt werden, gelten die Angaben auf der tatsächlichen Kaufseite nach dem Anmelden.
API-PreiseIm Folgenden sind die derzeit auf der offiziellen Preisseite angezeigten Preise in Yuan pro Menge aufgeführt: SenseNova V6 Pro: Eingabe von Bildern und Texten sowie Ausgabe von Texten – Eingabe: 3 Yuan pro Million Tokens, Ausgabe: 9 Yuan pro Million Tokens; SenseNova V6 Turbo: Leichtgewichtige, multimodale Funktionalitäten – Eingabe: 1,5 Yuan pro Million Tokens, Ausgabe: 4,5 Yuan pro Million Tokens; SenseNova V6 Reasoner: Komplexe, langsame Denkprozesse sowie Inferenz von Bildern und Texten – Eingabe: 8 Yuan pro Million Tokens, Ausgabe: 32 Yuan pro Million Tokens; SenseNova V6.5 Omni: Echtzeit-Interaktion mit Audio- und Videodaten oder reinem Audio – 0,08 Yuan pro Minute; Für eine Lizenz über die gesamte Lebensdauer des Geräts ist ein persönliches Gespräch erforderlich. Basische Version für die Erstellung von Bildern aus Text: 0,03 Yuan pro Bild; Jahresabo für 100.000 Bilder: 2700 Yuan; Fortgeschrittene Version für die Erstellung von Bildern aus Text: Löschung, Erweiterung der Bilder, Stilisierung sowie lokale Übermalungen – 0,1 Yuan pro Bild; Jahresabo für 100.000 Bilder: 9000 Yuan. Die Standard-Konkurrenzzahl beträgt in der Regel 1; um mehr QPS zu erhalten, müssen zusätzliche Ressourcen erworben werden. Für jede zusätzliche QPS in der Basissversion wird ein entsprechender Preis berechnet.

Preis für die Einzelpersonen-Version

Laut der Website können Privatnutzer sich registrieren und die wichtigsten Funktionen ausprobieren. Allerdings werden weder feste Preise für eine Mitgliedschaft noch eine Tabelle mit kostenlosen Nutzungsstunden öffentlich angegeben. Die Auswahl der Modelle, die Anzahl der Verbindungen, die maximale Dateigröße sowie die Beschränkungen in Stoßzeiten können je nach Betriebsbedingungen angepasst werden.

Daher sollte der Verzeichnis der Tools als „Kostenlose Testversion“ gekennzeichnet werden und nicht als dauerhaft kostenlos oder für unbegrenzte Nutzung. Falls auf der Seite Mitgliedschaften, Punkte oder Aktionspakete angezeigt werden, gilt die tatsächliche Kaufseite nach dem Anmelden.

Jeden Tag neue Plattformen verfügbar

Die SenseNova-Offenplattform bietet Unternehmen und Entwicklern APIs für Dialoge, multimodale Kommunikation, Inferenz, Echtzeit-Audio- und Videokommunikation, anthropomorphe Charaktere sowie Bildgenerierung. Die grundlegenden Dialog-APIs unterstützen HTTP-Anfragen sowie SSE-Stream-Datenrückgaben und können für Kundenservice, Inhaltsgenerierung, Datenanalyse, Charakterdialoge sowie branchenspezifische Anwendungen eingesetzt werden.

API-Schlüssel sollten nur auf der Serverseite oder in einem Schlüsselverwaltungssystem gespeichert werden und dürfen weder in die Frontend-Codebasis, die App-Installationsdateien noch in öffentlichen Code aufgenommen werden. Bei Produktivdiensten müssen zudem Limitierungen, Zeitüberschreitungsregeln, Wiederholungsvorgänge, Budgets, Maskierung von Logdaten sowie Sicherheitsmaßnahmen für den Inhalt eingestellt werden.

API-Preise

Im Folgenden sind die derzeit auf der offiziellen Preisseite angezeigten Preise in Renminbi pro Einheit aufgeführt:

  • SenseNova V6 Pro:Eingabe von Bildern und Texten, Ausgabe von Texten: 3 Yuan pro Million Tokens für die Eingabe, 9 Yuan pro Million Tokens für die Ausgabe;
  • SenseNova V6 Turbo:Leichtgewichtig und multimodal, Eingabe: 1,5 Yuan pro Million Tokens, Ausgabe: 4,5 Yuan pro Million Tokens;
  • SenseNova V6 Reasoner:Komplexe, langsame Denkprozesse sowie Schlussfolgerungen auf der Grundlage von Bildern und Texten: Eingabekosten von 8 Yuan pro Million Tokens, Ausgabekosten von 32 Yuan pro Million Tokens.
  • SenseNova V6.5 Omni:Echtzeit-Video- oder Audiodatenkommunikation, 0,08 Yuan pro Minute; eine Lizenz für die gesamte Lebensdauer des Geräts erfordert ein persönliches Gespräch.
  • Base-Version der Bildgenerierung:0,03 Yuan pro Stück, Jahresabo für 100.000 Stück zu 2.700 Yuan;
  • Stable Diffusion Premium-Version:Löschen, Vergrößern, Stilisieren und teilweises Neuzeichnen: 0,1 Yuan pro Bild. Für ein Jahresabo mit 100.000 Bildern beträgt der Preis 9.000 Yuan.

Die Standard-Parallelität bei der Bildgenerierung beträgt in der Regel 1. Um die Anzahl der QPS zu erhöhen, müssen zusätzliche Ressourcen erworben werden; für jede zusätzliche QPS im Basisplan kostet das 24.000 Yuan pro Monat, im Premiumplan 200.000 Yuan pro Monat.

Unternehmensverträge, Paketlösungen, Regionen und neue Modelle können angepasst werden; offizielle Bestellungen richten sich nach dem Angebot und der Konsole.

Echtzeit-Interaktion von Audio und Video

V6.5 Omni ermöglicht durch das RTC-Netzwerk eine interaktive Audio- und Videokommunikation mit geringer Verzögerung. Es kann die Stimme des Nutzers, die Bilder sowie den Kontext verstehen und in Echtzeit antworten – ideal für digitale Assistenten, Kundenservice, Bildung, Fahrzeuge sowie intelligente Geräte.

Echtzeit-Systeme verarbeiten kontinuierlich Daten von Mikrofonen und Kameras. Es ist notwendig, die Nutzer klar zu informieren, ihre Zustimmung einzuholen und eine Frist für die Speicherung der aufgenommenen Audiodaten sowie Videomaterial festzulegen. Netzwerkstörungen, Akzente, mehrere Sprecher gleichzeitig sowie laute Umgebungen können die Erkennungsfähigkeit sowie die Verzögerungen beeinträchtigen.

Dialoge mit personifizierten Charakteren

Die offene Plattform bietet Schnittstellen für den Dialog zwischen Charakteren. Es ist möglich, den Hintergrund der Charaktere sowie ihren Tonfall festzulegen – außerdem kann die Erinnerung an mehrere Gesprächsrunden gespeichert werden. Dies wird bei SpielnPCs, virtuellen Begleitern sowie Markencharakteren genutzt. Die Personifizierung kann dazu führen, dass die Nutzer die Verständnisfähigkeit der Modelle überschätzen. In Situationen mit Kindern, psychischen Problemen oder emotionaler Abhängigkeit sind strengere Sicherheitsmaßnahmen, Ausstiegsmechanismen sowie menschliche Unterstützung erforderlich.

GitHub und die Open-Source-Ökologie

Die offizielle GitHub-Organisation OpenSenseNova von SenseTime ist mit der Plattform Nisshin Open Platform verbunden; dort werden mehrere Modelle, Datensätze sowie Agentenwerkzeuge bereitgestellt. Zu den aktuellen Projekten gehören unter anderem:

  • SenseNova-U1:Einheitliches multimodales Verständnis- und Generierungsmodell, Code sowie Trainingsprozess unterliegen der Apache 2.0-Lizenz;
  • SenseNova-Vision:Durch die Zusammenfassung von Detektion, Segmentierung, OCR, geometrischer Vorhersage und Bildgenerierung zu einer multimodalen Generierungsaufgabe verwendet das Projekt Apache 2.0;
  • SenseNova-SI:Raumintelligenzmodelle, Trainingsdaten und Bewertung unter Verwendung von Apache 2.0;
  • SenseNova-MARS:Forschung zu multimodalem Agenten-Reasoning und -Suche;
  • SenseNova-Skills:Kann für PPT, Excel, tiefgehende Forschung und Bildverarbeitungsfähigkeiten bei der Ausführung von Agenten wie OpenClaw verwendet werden, unterliegt der MIT-Lizenz;
  • MemSense:Projekt für langfristiges Gedächtnis für Agenten, unterliegt der MIT-Lizenz.

Der Code, die Gewichte, die Daten sowie Drittanbieterkomponenten verschiedener Projekte können unterschiedliche Lizenzen haben. Vor einer kommerziellen Nutzung müssen die LICENSE- und NOTICE-Dokumente des Repositoriums gelesen werden. Die SenseChat-Webseite, das Benutzersystem, das V6.5-Unternehmensmodell sowie der Backend der offenen Plattform sind daher nicht vollständig open source.

Daten und Privatsphäre

Die Beratungsstelle bearbeitet den von den Nutzern eingegebenen Text, Bilder, Dateien und Feedback, um Dienste zur Erstellung und Suche anzubieten. Vor dem Hochladen von Unternehmensdokumenten, unveröffentlichten Werken, persönlichen Identitätsinformationen sowie Inhalten, die durch Vertraulichkeitsabkommen geschützt sind, müssen die Mechanismen für die Datenspeicherung, den Trainingsgebrauch, Drittanbieter und die Löschung überprüft werden.

Beim Einsatz der Hongkong-Version oder von grenzüberschreitenden Diensten muss man außerdem die Datenregion sowie die lokalen Datenschutzvorschriften berücksichtigen. Echtzeit-Video- und Audiodaten sowie Gesichter gelten als hochsensible Informationen und sollten nicht standardmäßig dauerhaft gespeichert werden.

Besprechen Sie den Anleitungsführer für die Verwendung von SenseChat.

Eine grundlegende Aufgabe erledigen

  1. Definieren Sie das Problem, den Zeitraum, den Bereich, die Priorität der Quellen sowie das Ausgabeformat;
  2. Über die Hochladen von Materialien, für deren Nutzung Berechtigung besteht, oder das Eingeben von Suchfragen in SenseChat zu beraten;
  3. Zuerst wird durch mehrere Dialogrunden und die Erstellung von Inhalten ein Rahmen geschaffen, anschließend werden durch Online-Suchen weitere Belege ergänzt.
  4. Es ist erforderlich, Quellenfakten, die Ansichten des Autors und KI-Erkenntnisse voneinander zu unterscheiden.
  5. Jeweils die Daten, Zahlen, den ursprünglichen Textort sowie widersprüchliche Beweise überprüfen;
  6. Die Ergebnisse werden manuell überarbeitet, das Überprüfungsdatum wird aufgezeichnet, und anschließend veröffentlicht.

Erstellung wiederverwendbarer professioneller Workflows

  1. Komplexe Themen in vier Kategorien von Fragen aufteilen: Hintergrund, Daten, Vergleiche und Schlussfolgerungen;
  2. Die Kombination aus mehrfachen Dialogrunden mit der Erstellung von Inhalten, der Durchführung von Suchanfragen im Internet sowie dem Beantworten von Fragen zu Dateien bildet feste Forschungsschritte.
  3. Zuerst sollten die offiziellen Webseiten, wissenschaftliche Arbeiten, regulatorische Dokumente und Rohdaten verwendet werden;
  4. Für Schlussfolgerungen mit hohem Risiko wird eine zweite Überprüfung durchgeführt;
  5. Abfragen, Beweise, Versionen und ungelöste Probleme speichern;
  6. Nach Änderungen der Daten erneut ausführen und die Schlussfolgerungen aktualisieren;

Für welche Nutzer geeignet?

  • Persönliche Nutzer, die mehrfache chinesischsprachige Fragen und Antworten, Schreiben sowie Zusammenfassungen von Materialien benötigen;
  • Lernende, die Englisch oder Kantonesisch üben, um zu kommunizieren;
  • Studenten und Wissensarbeiter, die PDFs, Berichte und Diagramme lesen;
  • Inhalte erstellende Personen, die aktuelle Informationen durch Suchen im Internet sammeln;
  • Entwickler, die auf multimodale, reasoning-basierte sowie Echtzeit-Video- und Audiodienste über API-Zugänge zugreifen;
  • Forschungsteam für Technologien zur Vereinigung von multimodalen Ansätzen, räumlicher Intelligenz und Agentenfähigkeiten.

Vorteile

  • Chinesisch, Kantonisch und multimodale Interaktion sind Besonderheiten des Produkts;
  • Persönliche Chats und Unternehmens-APIs werden vom selben Nisshin-System unterstützt;
  • Abdeckung von Texten, Bildern, Dateien, Echtzeit-Audio- und Videoinhalten sowie Text-zu-Bild-Generierung;
  • V6 Pro, Turbo und Reasoner können je nach Leistung und Kosten ausgewählt werden;
  • Die Behörden erweitern derzeit die Ökosysteme für offene Modelle, Daten und Agentenfähigkeiten.

Einschränkungen und Hinweise

  • Weder Vernetzung noch Dateien und visuelle Fähigkeiten können Halluzinationen beseitigen.
  • Wenn kurze Fragen keinen Kontext liefern, kann das Modell fehlende Informationen hinzufügen;
  • Die Dokumentanalyse könnte Tabellen und Fußnoten übersehen.
  • Die Bilderkennung kann Details falsch interpretieren;
  • Faziten mit hohem Risiko sollten von einem Menschen überprüft werden;
  • Offizielle Referenzwerte, Produktbeispiele sowie die Rechenleistung dienen unter bestimmten Bedingungen der Werbung oder Statistik und stellen nicht dar, dass jeder Benutzer dieselbe Geschwindigkeit und Genauigkeit erhält.
  • Testen Sie vor dem Kauf der API unter Verwendung Ihrer eigenen Sprache, Dokumentation, Bilder sowie Anforderungen an Konkurrenzfähigkeit und Verzögerung.

Häufige Fragen

Kann man über SenseChat kostenlos sprechen?

Eine persönliche Website kann derzeit zur Testnutzung registriert werden; auf der offiziellen Website werden keine festen Preise für Mitgliedschaften sowie keine Angaben zu den dauerhaften Nutzungsrechten bereitgestellt. Die Beschränkungen in Zeiten hoher Belastung sowie die Nutzungsmöglichkeiten richten sich nach den Angaben auf der Seite nach dem Einloggen.

Was ist der Zusammenhang zwischen Beratung und ständiger Weiterentwicklung?

Consulting ist ein persönlicher AI-Assistent, SenseNova ist das zugrundeliegende Modell sowie die Entwicklerplattform. Unternehmen sollten zur Anbindung die offenen API-Plattformen nutzen.

Wird Kantonesisch unterstützt?

Unterstützung. Die Hongkong-Version von SenseChat konzentriert sich auf die Beherrschung des Umgangssprachlichen und Jargons im Kantonesischen sowie auf lokale Mobile-Apps.

Kann man PDFs hochladen?

Es ist möglich, Dokumente zu lesen und Fragen zu stellen, doch komplexe Tabellen, gescannte Seiten sowie Fußnoten müssen weiterhin manuell überprüft werden. Sensible Dokumente sollten vorsichtig hochgeladen werden.

Wie viel kostet die API?

V6 Turbo: Eingang 1,5 Yuan, Ausgang 4,5 Yuan pro Million Tokens; V6 Pro: 3 Yuan und 9 Yuan.

Reasoner kostet 8 Yuan und 32 Yuan. Echtzeit-Interaktion und Bildgenerierung werden separat berechnet.

Soll SenseChat open source gemacht werden?

Die vollständige Anwendung ist nicht open source. Die offizielle Organisation OpenSenseNova hat einige Projekte wie U1, Vision, SI, MARS und Skills öffentlich zugänglich gemacht; die Lizenzen müssen für jede einzelne Bibliothek überprüft werden.

©️ Urheberrechtshinweis: Sofern nicht anders angegeben, liegen die Urheberrechte an allen Artikeln auf dieser Website beiTeilen von AI-ToolsAlle Urheberrechte liegen bei uns. Ohne Genehmigung darf keine Person, kein Medienunternehmen, keine Website oder irgendeine Gruppe den Inhalt dieser Website kopieren, nachahmen oder auf andere Weise verbreiten. Ebenso ist es nicht gestattet, Spiegelseiten auf Servern zu erstellen, die nicht uns gehören. Andernfalls behalten wir uns das Recht vor, rechtliche Schritte gegen die Verantwortlichen einzuleiten.

Ähnliche Werkzeuge zur Anpassung von SenseChat