Discuter de SenseChat
Valeur ajoutée gratuite
Guide complet des outils d’IA Dialogue IA

Discuter de SenseChat

L’assistant de questions-réponses et de création lancé par SenseTime

Étiquettes :

Discuter de ce qu’est SenseChat ?

SenseChat est un assistant de conversation et d’assistance au quotidien basé sur l’IA multimodale, lancé par SenseTime. Il s’appuie sur le système de grand modèle « Riri Xin » SenseNova ainsi que sur l’infrastructure AI SenseCore. Il peut traiter du texte, des images et des documents, et effectuer des questions-réponses, de la rédaction, de la synthèse, de la traduction, un soutien à l’apprentissage, des recherches en ligne et une compréhension d’images.

Shangliao est un produit destiné aux utilisateurs individuels ; lorsque l’on souhaite intégrer le modèle sur un site web, une application ou un système d’entreprise, il convient d’utiliser la plateforme Ouverte Jijixin.

Les comptes, les limites, les accords de service et les prix des deux ne doivent pas être confondus.

Fonction principale

1. Dialogues multiples et création de contenu

Les discussions peuvent se dérouler de manière continue autour d’un même thème, permettant d’expliquer des connaissances, d’écrire des articles, des e-mails, des textes de marketing, de faire des idées en groupe, ainsi que d’apprendre du code et des langues. La page actuelle présente des modèles tels que SenseNova V6.5 Pro et permet de raisonner en fonction des tâches ou d’utiliser des outils.

Le modèle générera du contenu qui semble fluide mais n’est pas précis. Les connaissances spécialisées, les chiffres statistiques, le code et les références doivent être vérifiés à nouveau ; on ne peut pas confondre la fluidité linguistique avec la fiabilité des faits.

2. Recherche en ligne

L’utilisateur peut activer la fonction de connexion à Internet, permettant au modèle de rechercher des pages web récentes pour organiser les réponses. Cela convient pour comprendre le contexte des actualités, les changements de produits et les informations en temps réel, mais la couverture des recherches, le classement des sources et la date des pages web peuvent être incomplets.

Lorsque des sujets relatifs à la politique, aux prix, aux soins de santé, au droit et aux finances sont concernés, il convient d’ouvrir la page originale pour vérifier.

3. Questions-réponses sur les documents

Discuter des exemples de documents tels que des PDF à afficher en première page, permettant de résumer des rapports, des thèses et des matériaux pédagogiques, de poser des questions et d’extraire des informations. Les Q&R sur les fichiers permettent d’économiser du temps de lecture, mais les scans, les tableaux complexes, les notes de bas de page et les relations entre pages peuvent être interprétés incorrectement.

Avant de télécharger des documents confidentiels, il convient de vérifier l’autorisation de l’organisation et les conditions de confidentialité.

4. Compréhension d’images

Les modèles multimodaux permettent de télécharger des images afin de les reconnaître, de les décrire, d’analyser des graphiques, d’aider au OCR et de répondre à des questions visuelles. Ils peuvent être utilisés pour des exercices d’apprentissage, des informations sur des produits et des photos quotidiennes, mais ils ne peuvent pas remplacer le diagnostic par imagerie médicale, l’identification ou les contrôles de sécurité.

5. Dialogue en anglais et en cantonais

Discuter de scénarios d’apprentissage tels que la mise à disposition d’un partenaire de conversation en anglais. La version hongkongaise de SenseChat prend en charge principalement le cantonais parlé, le jargon et la communication multimodale, et propose une application mobile pour la région de Hong Kong.

Les versions régionales, les méthodes de connexion et la disponibilité dans les stores d’applications peuvent varier.

6. Réflexion approfondie

SenseNova Reasoner et la série V6.5 peuvent être utilisés pour les mathématiques, la logique, le codage et l’analyse complexe. Un processus de réflexion plus long ne garantit pas nécessairement une réponse correcte ;

Le raisonnement complexe doit examiner les hypothèses, les calculs et les conclusions finales, afin d’éviter que le modèle ne se développe sur des prémisses erronées.

Plateforme de support

Les utilisateurs de Chine continentale peuvent utiliser l’interface web, et une version mobile est également disponible officiellement. Sur le marché de Hong Kong, des versions iOS et Android sont proposées, mettant l’accent sur une expérience en cantonais.

La version pour appareils mobiles, les exigences système et l’état de disponibilité par région sont à vérifier sur la page en temps réel de la boutique d’applications.

Le connexion, l’historique et le téléchargement de fichiers nécessitent généralement un compte. Avant de partager publiquement une conversation, il convient de supprimer les noms, les coordonnées, les informations clients et les documents internes.

Comparaison des prix et des versions

Forfait ou versionPrix, plafonds et avantages clés
Prix de la version individuelleSelon les informations disponibles sur le site officiel, seuls les utilisateurs individuels peuvent s’inscrire et tester les principales fonctionnalités, mais aucun prix fixe pour un abonnement personnel ni tableau de quota gratuit permanent n’est affiché publiquement. Le choix des modèles, le nombre de connexions, la limite de taille des fichiers ainsi que les restrictions en période de pointe peuvent être ajustés en fonction des besoins opérationnels. Par conséquent, la section des outils convient d’être qualifiée de « version d’essai gratuite », et non de gratuite à vie ou permettant une utilisation illimitée. Si des informations concernant des abonnements, des points ou des forfaits promotionnels apparaissent sur la page, celles-ci doivent correspondre à la page de paiement réelle après connexion.
Prix APIVoici les prix en yuans par volume affichés actuellement sur la page des prix officiels : SenseNova V6 Pro : saisie textuelle et graphique, sortie de texte, 3 yuans/million de tokens pour la saisie, 9 yuans/million de tokens pour la sortie ; SenseNova V6 Turbo : multimodal léger, 1,5 yuans/million de tokens pour la saisie, 4,5 yuans/million de tokens pour la sortie ; SenseNova V6 Reasoner : réflexion complexe et lente ainsi que raisonnement textuel et graphique, 8 yuans/million de tokens pour la saisie, 32 yuans/million de tokens pour la sortie ; SenseNova V6.5 Omni : interaction audiovisuelle en temps réel ou audio pur, 0,08 yuans/minute ; l’autorisation pour la durée de vie du dispositif nécessite un entretien en personne ; version de base de génération d’images à partir de texte : 0,03 yuans/image, forfait annuel de 100 000 images à 2700 yuans ; version avancée de génération d’images à partir de texte : suppression, agrandissement, stylisation et redessin local, 0,1 yuans/image, forfait annuel de 100 000 images à 9000 yuans. La concurrence par défaut pour la génération d’images est généralement de 1 ; pour augmenter le QPS, il faut acheter des ressources de concurrence ; le prix de la version de base augmente à chaque QPS supplémentaire.

Prix de la version individuelle

Selon les informations disponibles sur le site officiel, les utilisateurs individuels peuvent s’inscrire et tester les principales fonctionnalités, mais aucun prix fixe pour un abonnement personnel ni de tableau des quotas gratuits permanents n’est affiché publiquement. Le choix des modèles, le nombre d’appels en réseau, la limite de taille des fichiers ainsi que les restrictions en période de pointe peuvent être modifiés en fonction des besoins opérationnels.

Par conséquent, le catalogue d’outils convient d’être marqué comme « essai gratuit », et ne doit pas être présenté comme gratuit à vie ou permettant une utilisation illimitée. Si des informations sur des abonnements, des points ou des forfaits promotionnels apparaissent sur la page, il faut se référer à la page de paiement réelle après connexion.

Plateforme de nouvelle ouverture quotidienne

La plateforme ouverte SenseNova propose aux entreprises et aux développeurs des API pour la conversation, le multimodal, le raisonnement, la vidéo et l’audio en temps réel, les personnages anthropomorphiques et la génération d’images à partir de texte. L’interface de conversation de base prend en charge les requêtes HTTP et les retours en flux SSE, et peut être utilisée pour le service client, la génération de contenu, l’analyse de données, les dialogues avec des personnages et les applications sectorielles.

La clé API doit être stockée uniquement du côté serveur ou dans un système de gestion des clés, et ne doit pas être inscrite dans l’interface utilisateur, les paquets d’installation d’applications ou le code public. Les services en production doivent également disposer de mécanismes de limitation du débit, de délais d’attente, de tentatives de réessai, de budgets, de masquage des journaux et de sécurité du contenu.

Prix API

Voici le prix par unité en yuans indiqué actuellement sur la page des prix officiels :

  • SenseNova V6 Pro:Entrée d’images et de texte, sortie de texte : 3 yuans par million de tokens pour l’entrée, 9 yuans par million de tokens pour la sortie ;
  • SenseNova V6 Turbo:Léger et multimodal, coût d’entrée de 1,5 yuan par million de tokens, coût de sortie de 4,5 yuan par million de tokens ;
  • SenseNova V6 Reasoner:Réflexion lente complexe et raisonnement visuel, coût d’entrée de 8 yuans par million de tokens, coût de sortie de 32 yuans par million de tokens ;
  • SenseNova V6.5 Omni:Interaction audiovisuelle en temps réel ou audio uniquement, 0,08 yuan/minute ; l’autorisation pour la durée de vie du dispositif nécessite un entretien en personne ;
  • Version de base de génération d’images par texte :0,03 yuan par feuille, forfait annuel de 100 000 feuilles à 2 700 yuan ;
  • Version avancée de génération d’images par texte :Suppression, agrandissement, stylisation et redessin local : 0,1 yuan par image ; forfait annuel de 100 000 images à 9 000 yuans.

La concurrence par défaut pour la génération d’images par texte est généralement de 1 ; pour augmenter le QPS, il est nécessaire d’acheter des ressources de concurrence. Pour l’édition de base, chaque QPS supplémentaire coûte 24 000 yuans par mois, tandis que pour l’édition avancée, le coût est de 200 000 yuans par mois.

Les contrats d’entreprise, les lots groupés, les régions et les nouveaux modèles peuvent être ajustés ; les achats officiels doivent se baser sur les devis et la console de contrôle.

Interaction audiovisuelle en temps réel

V6.5 Omni permet une interaction en flux audio et vidéo à faible latence via le réseau RTC, capable de comprendre la voix de l’utilisateur, l’image ainsi que le contexte pour répondre en temps réel, idéal pour les avatars numériques, le service client, l’éducation, les véhicules et les appareils intelligents.

Les systèmes en temps réel traitent en continu les données provenant du micro et de la caméra ; il est nécessaire d’informer clairement l’utilisateur, d’obtenir son consentement et de définir une durée de conservation pour l’enregistrement audio et vidéo. Les fluctuations réseau, les accents, plusieurs personnes qui parlent en même temps ainsi que des environnements bruyants peuvent affecter la reconnaissance et provoquer des retards.

Dialogue de personnages anthropomorphes

La plateforme ouverte propose une interface de dialogue pour les personnages, permettant de définir leur background, leur ton et une mémoire multi-échanges, destinée aux PNJ de jeux, aux compagnons virtuels et aux personnages de marque. L’anthropomorphisation peut amener les utilisateurs à surestimer la capacité de compréhension du modèle ; les scénarios impliquant des enfants, la santé mentale ou la dépendance émotionnelle nécessitent une conception de sécurité plus stricte, des mécanismes d’arrêt et un soutien humain.

GitHub et l’écosystème open source

L’organisation officielle OpenSenseNova de SenseTime sur GitHub est liée à la plateforme ouverte Nichinan, et met en ligne de nombreux modèles, ensembles de données et outils d’Agent. Les projets représentatifs actuels incluent :

  • SenseNova-U1:Modèle unifié d’interprétation et de génération multimodale, le code et le processus d’entraînement sont sous licence Apache 2.0 ;
  • SenseNova-Vision:Unifier la détection, le segmentage, l’OCR, la prédiction géométrique et la génération d’images en une tâche de génération multimodale ; le projet est sous licence Apache 2.0.
  • SenseNova-SI:Modèles d’intelligence spatiale, données d’entraînement et évaluation, sous licence Apache 2.0 ;
  • SenseNova-MARS:Recherche sur l’inférence et la recherche par agents multimodaux ;
  • SenseNova-Skills:Des compétences en PPT, Excel, recherche approfondie et images pouvant être utilisées pour le fonctionnement d’agents tels que OpenClaw, sous licence MIT ;
  • MemSense:Projet de mémoire à long terme orienté vers les agents, sous licence MIT.

Le code, les poids, les données et les composants tiers de différents projets peuvent être soumis à des licences différentes ; il est impératif de lire le fichier LICENSE et le NOTICE du répertoire avant toute utilisation commerciale. Après en avoir discuté, la page web SenseChat, le système d’accounts, le modèle commercial V6.5 et le backend de la plateforme ouverte n’ont pas tous été rendus open source.

Données et vie privée

La plateforme traite le texte, les images, les fichiers et les retours fournis par les utilisateurs afin de fournir des services de génération et de recherche. Avant de télécharger des documents d’entreprise, des œuvres non publiées, des informations personnelles et du contenu soumis à des accords de confidentialité, il convient de vérifier les mécanismes de conservation des données, d’utilisation pour l’entraînement, de sous-traitance et de suppression.

Lors de l’utilisation de la version de Hong Kong ou des services transrégionaux, il convient également de vérifier la région des données et les exigences locales en matière de confidentialité. La vidéo et l’audio en temps réel, ainsi que la voix et le visage, constituent des informations hautement sensibles et ne devraient pas être conservées de manière permanente par défaut.

Discuter du guide d’utilisation de SenseChat

Terminer une tâche de base

  1. Définir le problème, la période, la région, la priorité des sources et le format de sortie ;
  2. Discuter des documents autorisés à être téléchargés sur SenseChat ou des questions de recherche à entrer ;
  3. D’abord, établir un cadre à travers plusieurs rounds de dialogue et de création de contenu, puis compléter les preuves par des recherches en ligne ;
  4. Il est nécessaire de distinguer les faits de source, les opinions de l’auteur et les inférences de l’IA ;
  5. Vérifier une par une les dates, les chiffres, l’emplacement dans le texte original et les preuves contradictoires ;
  6. Modifier manuellement les conclusions et enregistrer l’heure de vérification avant de les publier ;

Créer des flux de travail professionnels réutilisables

  1. Découper les sujets complexes en quatre catégories de questions : contexte, données, comparaisons et conclusions ;
  2. Combiner plusieurs tours de dialogue avec la création de contenu, la recherche en ligne et les questions-réponses sur des documents constitue une étape de recherche fixe.
  3. Privilégier les sites officiels, les articles scientifiques, les documents réglementaires et les données brutes ;
  4. Mettre en place une vérification par une deuxième personne pour les conclusions à haut risque ;
  5. Conserver les requêtes, les preuves, les versions et les problèmes non résolus ;
  6. Redémarrer après modification des données et mettre à jour les conclusions ;

À qui s’adresse-t-il ?

  • Utilisateurs individuels ayant besoin de questions-réponses en chinois en plusieurs tours, d’écriture et de résumé de documents ;
  • Apprenants qui s’entraînent à communiquer en anglais ou en cantonais ;
  • Étudiants et professionnels du savoir qui lisent des PDF, des rapports et des graphiques ;
  • Créateurs de contenu qui organisent des informations récentes grâce à des recherches en ligne ;
  • Développeurs qui accèdent à des API multimodales, de raisonnement et de vidéo/audio en temps réel ;
  • Équipe technique chargée de la recherche sur l’intégration multimodale, l’intelligence spatiale et les compétences des agents.

Avantage

  • Le chinois, le cantonais et l’interaction multimodale sont des caractéristiques du produit ;
  • Les chats personnels et les API d’entreprise sont pris en charge par le même système Nisshin.
  • Couvre le texte, les images, les fichiers, l’audio et la vidéo en temps réel, ainsi que la génération d’images à partir de texte ;
  • Le V6 Pro, Turbo et Reasoner peuvent être choisis en fonction de l’efficacité et du coût ;
  • Les autorités sont en train d’élargir l’écosystème des modèles ouverts, des données et des compétences d’agent.

Restrictions et précautions

  • Ni le réseau, ni les fichiers, ni les capacités visuelles ne peuvent éliminer les hallucinations.
  • Lorsque les questions courtes manquent de contexte, le modèle peut ajouter des informations inexistantes ;
  • L’analyse des documents peut omettre les tableaux et les notes de bas de page ;
  • La reconnaissance d’images peut interpréter à tort les détails ;
  • Les conclusions à haut risque doivent être réexaminées par une personne.
  • Les références officielles, les exemples de produits et l’ampleur de la puissance de calcul relèvent de publicités ou de statistiques dans des conditions spécifiques ; ils ne représentent pas que chaque utilisateur obtiendra la même vitesse et précision.
  • Testez avec vos propres exigences en matière de langue, de documentation, d’images, de concurrence et de délais avant d’acheter une API ;

Questions fréquentes

Discuter de SenseChat, c’est gratuit ?

Il est actuellement possible de s’inscrire pour essayer la version web personnelle ; le site officiel ne divulgue pas de prix fixes pour les abonnés ni de tableau des quotas permanents. Les restrictions de connexion en période de pointe ainsi que les quotas fonctionnels sont indiqués sur la page après connexion.

Quel est le rapport entre la consultation et le renouvellement quotidien ?

Shangliao est un assistant IA destiné aux particuliers, tandis que SenseNova est le modèle de base et la plateforme pour les développeurs. Les entreprises doivent utiliser l’API de la plateforme ouverte pour s’y connecter.

Prend-il en charge le cantonais ?

Soutien. La version de SenseChat pour Hong Kong met l’accent sur les compétences en langue cantonaise parlée et en argot, ainsi que sur des applications mobiles locales.

Est-il possible de télécharger un PDF ?

Il est possible de lire des documents et de poser des questions, mais les tableaux complexes, les pages scannées et les notes de bas de page doivent encore être vérifiés manuellement ; les documents sensibles doivent être téléchargés avec prudence.

Combien coûte l’API ?

V6 Turbo : 1,5 yuan d’entrée, 4,5 yuan par million de tokens de sortie ; V6 Pro : 3 yuan et 9 yuan.

Reasoner coûte 8 yuans et 32 yuans. L’interaction en temps réel et la génération d’images sont facturées séparément.

Discuter de la mise en open source de SenseChat ?

L’application complète n’est pas open source. L’organisation officielle OpenSenseNova a rendu accessibles certains projets tels que U1, Vision, SI, MARS et Skills ; il est nécessaire de vérifier la licence pour chaque répertoire.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outil similaire à celui utilisé pour discuter avec SenseChat