Connected Papers
Outil permettant d’explorer les liens entre articles et les pistes de recherche à l’aide de graphiques visuels
Étiquettes :Site d’apprentissage de l’IAQu’est-ce que les Connected Papers ?
Connected Papers est un outil de découverte de littérature visuel destiné aux chercheurs, aux étudiants et aux scientifiques appliqués. Lorsque l’utilisateur saisit un article connu, la plateforme génère un diagramme de relations composé d’études similaires, afin d’aider à comprendre rapidement les articles clés d’un domaine, ses branches de recherche et son évolution.
Ce n’est ni un arbre de citations ordinaire, ni une liste des résultats de recherche par mots-clés. La distance et la force de connexion entre les articles dans le graphique reflètent principalement leur similarité, souvent calculée à partir de relations de citation mutuelle et d’être cité ensemble ; ainsi, même si deux articles ne se citent pas directement l’un l’autre, ils peuvent être très proches l’un de l’autre.
À partir d’Origin Paper
Les utilisateurs peuvent rechercher des articles par titre, DOI, auteur ou autre identifiant, en choisissant l’article original comme point de départ du graphe. Le système construit ensuite un ensemble d’articles les plus pertinents et met en évidence l’article original en position centrale.
Le papier d’origine peut affecter l’ensemble du graphe. Si le point de départ est obsolète, le thème est trop large ou ne correspond pas entièrement à la question de recherche, les résultats seront également déviants.
Les problèmes complexes peuvent faire appel à plusieurs points de départ ou à la validation croisée à l’aide de plusieurs diagrammes.
Carte de similarité
Chaque nœud représente un article ; plus la connexion entre les nœuds est forte, plus cela indique généralement que la relation entre les deux articles dans le graphe académique est similaire. Les articles similaires forment des clusters, permettant aux utilisateurs de voir différentes méthodes, sous-domaines ou écoles de pensée.
La position dans le diagramme n’est ni une direction de citation, ni un classement de la qualité de l’article. Le regroupement dépend de la couverture de la base de données et de l’algorithme ; il n’est donc pas possible d’établir directement une distance visuelle en conclusion académique.
Taille et couleur des nœuds
Dans le graphique, les nœuds peuvent généralement être affichés en combinant le nombre de citations et l’année de publication, permettant aux chercheurs d’observer à la fois l’influence et l’évolution dans le temps. Les utilisateurs peuvent ainsi identifier rapidement les travaux classiques anciens et les recherches plus récentes.
Le nombre de citations dépend de la discipline, de l’année et de la couverture de la base de données. Un article récent ayant peu de citations ne signifie pas pour autant qu’il a une faible valeur ; il convient d’éviter de ne choisir que les articles très cités lors de la révision systématique.
Prior Works
Prior Works, en se basant sur les travaux antérieurs fréquemment cités ensemble dans les articles présentés, aide à identifier les articles fondateurs d’un domaine de recherche, les sources des méthodes et le contexte théorique. Il convient pour compléter le contexte historique dans une revue.
Le fait que des articles anciens soient fréquemment cités ensemble ne signifie pas que leurs conclusions restent valables. Il est nécessaire de consulter les reprises ultérieures, les corrections et les controverses.
Derivative Works
Les œuvres dérivées permettent de trouver les recherches qui ont par la suite cité de nombreux articles du tableau, ce qui aide à comprendre comment ce domaine a continué de se développer et quels articles ultérieurs ont intégré plusieurs branches.
Les citations ultérieures peuvent être utilisées, comparées ou critiquées ; on ne peut pas juger du degré de soutien uniquement en se basant sur le nombre de relations.
Multi-origin Graphs
Multi-origin permet d’utiliser plusieurs articles comme points de départ communs, ce qui est adapté pour trouver des travaux connexes à partir d’un ensemble de documents de référence déjà existant. Par rapport à un Origin unique, il permet de réduire l’influence d’un article donné.
Lorsque les différences dans le sujet de la thèse sont trop importantes, le réseau de similarités communes peut être faible. Il est recommandé de choisir un point de départ en fonction d’une question de recherche claire.
List View
En plus du mode diagramme, l’utilisateur peut passer en vue liste pour parcourir les articles par titre, auteur, année, citations et similarité. La vue liste convient mieux pour filtrer un à un, tandis que le mode diagramme est plus adapté pour comprendre la structure globale.
Filtres de sélection
La plateforme propose des critères de filtrage tels que l’année, permettant aux utilisateurs de se concentrer sur les recherches récentes ou de consulter des articles historiques. Le filtrage s’applique uniquement aux échantillons du graphique actuel et ne revient pas à rechercher dans toutes les bases de données.
Enregistrer le mémoire
Les utilisateurs connectés peuvent enregistrer les articles qui les intéressent pour créer une liste de lecture personnelle, et accéder depuis le tableau de bord à Semantic Scholar, Google Scholar ou aux pages des éditeurs.
La fonction de sauvegarde constitue une collection légère, qui ne remplace pas les fonctionnalités d’annexes, d’insertion de citations et de suppression des doublons des gestionnaires de références complets tels que Zotero ou EndNote.
Graph History
La plateforme conserve l’historique des cartes, permettant aux utilisateurs de revenir aux sujets de recherche qu’ils ont précédemment développés. Pour les chercheurs qui doivent explorer plusieurs directions possibles, c’est plus pratique que de rechercher à nouveau depuis zéro à chaque fois.
Partager le graphique
La page du graphe peut être partagée avec des mentors, des collaborateurs ou des étudiants afin de discuter de la structure du domaine et de recommander des lectures. Avant de la partager, il convient de préciser que le graphe est une vue exploratoire générée par un algorithme, et non le résultat d’une revue complète.
Base de données
Connected Papers utilise les identifiants et les données des articles du réseau académique Semantic Scholar pour générer ses résultats. Semantic Scholar couvre une vaste quantité de littérature interdisciplinaire, mais les métadonnées, les citations et la disponibilité des textes intégraux varient selon les domaines.
Si le papier n’est pas trouvé, vous pouvez vérifier le titre, le DOI et l’état d’inclusion sur Semantic Scholar. Les articles récemment publiés peuvent nécessiter un temps d’attente pour que les données soient mises à jour.
Le diagramme n’est pas un arbre de référence
Les responsables de Connected Papers indiquent clairement sur la page des graphes que les articles sont classés en fonction de leur similarité, et non en formant un arbre basé sur des relations de citation directe. Des liens forts indiquent généralement une structure de citation similaire.
Si l’on souhaite savoir avec précision qui cite qui, il convient d’ouvrir la liste des citations et des références du mémoire, plutôt que de se fier uniquement aux liens visuels.
Comment l’utiliser pour une revue de la littérature
La procédure habituelle consiste d’abord à trouver, à l’aide de bases de données spécialisées, un article fortement pertinent, puis à générer un graphique de similarité, à examiner les œuvres préexistantes et les œuvres dérivées, à enregistrer les articles candidats, et enfin à retourner dans la base de données pour effectuer le filtrage complet sur le texte intégral.
Il convient d’en faire un outil d’accumulation et de découverte complémentaire, mais il ne peut pas remplacer les requêtes booléennes, la couverture de plusieurs bases de données, la suppression des doublons ni l’inclusion/exclusion des enregistrements.
Comment trouver des articles de revue
Les grands nœuds dans le diagramme, les articles qui synthétisent plusieurs branches ultérieures et la liste des travaux antérieurs peuvent contenir des revues ou des aperçus clés. L’utilisateur doit confirmer en fonction du type de publication et du résumé, et ne pas se fier uniquement à la position dans le diagramme.
Comment comprendre le contexte de la recherche
En observant les nœuds et les clusters dans le temps, on peut voir comment les premiers articles fondamentaux se sont différenciés en différents thèmes, ainsi que là où les recherches ultérieures se sont à nouveau rassemblées. Cela convient pour des explications en classe et pour une introduction aux nouveaux domaines.
Comparaison des prix et des versions
| Forfait ou version | Prix, plafonds et avantages clés |
|---|---|
| Version gratuite | La version gratuite de Connected Papers coûte 0 €, permet de créer 5 graphes par mois et inclut toutes les fonctionnalités essentielles telles que les diagrammes de similarité, les travaux antérieurs, les œuvres dérivées, les origines multiples, le sauvegarde des articles et l’historique des graphes. Il n’y a pas de fonctionnalités supprimées dans la version gratuite ; la principale limitation est le nombre de graphes nouveaux que l’on peut créer par mois. Pour les utilisateurs qui explorent occasionnellement la littérature, 5 graphes suffisent généralement. |
| Prix Premium | Le site officiel permet de passer d’un paiement annuel à un paiement trimestriel, mais le montant exact affiché sur la page publique est déterminé dynamiquement par l’outil de paiement ; les données récupérées en temps réel ne fournissent pas encore de chiffre uniforme. Lors de l’achat, il convient de choisir « Academic » ou « Business » sur la page des prix officiels, et de se fier à la monnaie, aux taxes et au montant affichés sur la page de paiement. Il ne faut pas prendre pour prix officiel actuel les prix indiqués dans d’anciennes critiques de tiers. De même, il ne faut pas choisir la mauvaise licence selon que l’utilisation est personnelle à des fins académiques ou commerciale. |
Version gratuite
La version gratuite de Connected Papers coûte 0, permet de créer 5 graphiques par mois et inclut toutes les fonctionnalités essentielles telles que les graphes de similarité, les travaux antérieurs, les œuvres dérivées, les multiples origines, le sauvegarde des articles et l’historique des graphes.
La version gratuite n’est pas dépourvue de fonctionnalités ; la principale limitation est le nombre de cartes que l’on peut créer chaque mois. Pour les utilisateurs qui explorent occasionnellement la littérature, 5 cartes suffisent généralement.
Academic Premium
Le programme Academic est destiné aux institutions académiques, aux organisations à but non lucratif et à un usage personnel, il offre un nombre illimité de cartes tout en conservant toutes les fonctionnalités. Il convient aux étudiants et chercheurs qui doivent créer fréquemment de nombreuses cartes de recherche chaque mois.
Business Premium
Business s’adresse aux utilisateurs commerciaux et industriels liés à des activités à but lucratif, et offre également un nombre illimité de graphes ainsi que toutes les fonctionnalités. Academic possède la même valeur fonctionnelle que Business ; la différence réside principalement dans les scénarios d’utilisation et les catégories de licence.
Prix Premium
Le site officiel permet de passer d’un paiement annuel à un paiement trimestriel, mais le montant exact affiché sur la page publique est déterminé dynamiquement par l’outil de paiement ; la capture en temps réel ne fournit pas encore de chiffre uniforme. Lors de l’achat, il convient de choisir entre Academic ou Business sur la page des prix officiels, et de se fier à la monnaie, aux taxes et au montant affichés sur la page de paiement.
Ne prenez pas les prix d’évaluations anciennes de tiers pour les prix officiels actuels. Il ne faut pas non plus choisir la mauvaise licence pour des utilisations académiques personnelles ou commerciales.
Solution d’équipe Group
Les Groupes académiques et les Groupes d’entreprise permettent aux institutions d’offrir un accès Premium par poste. L’administrateur achète et attribue des postes ; par défaut, le compte de l’administrateur n’obtient pas automatiquement le statut Premium, sauf s’il est également ajouté à un poste utilisateur.
Les achats en groupe conviennent aux laboratoires, aux écoles et aux départements de recherche et développement des entreprises ; il convient de vérifier les ajouts ou suppressions de postes, les renouvellements, les départs de membres et la propriété des cartes.
Paiement et renouvellement automatique
Le support officiel prend en charge divers moyens de paiement tels que les cartes de crédit, les cartes de débit, PayPal, Alipay et les virements bancaires, avec un traitement des paiements via PayPro Global. L’abonnement est renouvelé automatiquement par défaut, mais peut être résilié à tout moment.
La facture peut indiquer PayPro Global plutôt que Connected Papers. Il convient de vérifier le cycle de renouvellement, les taxes et les conditions de remboursement avant l’achat.
Programme de bourses
Les chercheurs qui ne peuvent vraiment pas se permettre les frais Premium peuvent contacter les autorités pour demander une remise ou un accès gratuit à Premium. L’approbation et la durée dépendent d’une décision individuelle par les autorités et ne constituent pas un droit automatique.
API officielle
Connected Papers a mis en ligne une API d’accès précoce et fournit des clients officiels en Python et JavaScript. Les développeurs peuvent demander des graphes via le ShaID de Semantic Scholar, consulter la quantité restante et accéder gratuitement aux graphes créés au cours des 30 derniers jours.
Une clé API doit être demandée auprès des autorités officielles. Le fait que le client soit open source ne signifie pas que les services API soient illimités et gratuits ; les quotas réels et l’utilisation commerciale doivent être confirmés selon l’autorisation accordée.
Cache du schéma API
Si le graphique d’un article a déjà été consulté au cours des 30 derniers jours, une nouvelle requête n’est généralement pas comptée comme une création nouvelle. Les développeurs peuvent consulter les Free Access Papers pour éviter de le recompiler inutilement.
Guide d’utilisation de Connected Papers
Terminer une tâche de base
- Définir le problème, la période, la région, la priorité des sources et le format de sortie ;
- Dans Connected Papers, téléchargez des documents dont vous avez les droits d’utilisation ou saisissez une question de recherche ;
- Commencez par établir un cadre à partir d’Origin Paper, puis complétez les preuves à l’aide de cartes de similarité ;
- Il est nécessaire de distinguer les faits de source, les opinions de l’auteur et les inférences de l’IA ;
- Vérifier une par une les dates, les chiffres, l’emplacement dans le texte original et les preuves contradictoires ;
- Modifier manuellement les conclusions et enregistrer l’heure de vérification avant de les publier ;
Créer des flux de travail professionnels réutilisables
- Découper les sujets complexes en quatre catégories de questions : contexte, données, comparaisons et conclusions ;
- La combinaison commence par Origin Paper, avec des graphes de similarité et des tailles et couleurs de nœuds constituant des étapes de recherche fixes ;
- Privilégier les sites officiels, les articles scientifiques, les documents réglementaires et les données brutes ;
- Mettre en place une vérification par une deuxième personne pour les conclusions à haut risque ;
- Conserver les requêtes, les preuves, les versions et les problèmes non résolus ;
- Redémarrer après modification des données et mettre à jour les conclusions ;
Limitation de vitesse API
- La documentation officielle du client indique actuellement que, par défaut, chaque APIKey peut générer un maximum de 5 images par minute.
- Lorsque le système est surchargé ou dépasse ses limites, il renvoie OVERLOADED et utilise un retard exponentiel de 5, 10, 20 et 40 secondes pour réessayer ;
- Pour des débits plus élevés, veuillez contacter les autorités officielles ; ne contournez pas les restrictions en parallèle.
- L’application doit également gérer les états BADID, NOTINDB, OUTOFREQUESTS, etc. ;
Statut officiel GitHub et open source
GitHub officiel a rendu publics les clients connectedpapers-py et connectedpapers-js sous licence MIT, ainsi que certains projets auxiliaires ou branches. Les développeurs peuvent consulter les appels des clients et les définitions de types.
Le site complet Connected Papers, les algorithmes de similarité, le backend de construction de graphes et les bases de données académiques ne sont pas open source. Par conséquent, il convient de les qualifier comme « plateforme principale fermée, client API open source ».
Fournir le texte intégral ?
Connected Papers fournit principalement des outils de découverte d’articles et des accès externes, sans être responsable du contournement des barrières payantes. La disponibilité des PDF et des textes complets dépend de Semantic Scholar, du modèle d’accès ouvert, de l’éditeur ou d’une abonnement institutionnel.
À qui s’adresse-t-il ?
- Étudiants et chercheurs qui viennent de s’engager dans un nouveau domaine de recherche ;
- Ceux qui ont besoin d’identifier rapidement les articles clés et les groupes de recherche ;
- Équipe de revue effectuant le suivi des citations avant-arrière ;
- Enseignant qui prépare une liste de lectures pour le cours ;
- Les chercheurs qui doivent rechercher des documents communs à partir de plusieurs articles de référence ;
- Développeurs qui génèrent des graphes de similarité de thèses via une API.
Avantages du produit
- L’interface du diagramme est intuitive et convient pour établir rapidement une vue d’ensemble du domaine ;
- Les réseaux de similarité permettent de découvrir des articles pertinents qui ne sont pas cités directement ;
- Prior et les œuvres dérivées distinguent la recherche historique de la recherche ultérieure ;
- La version gratuite comprend toutes les fonctionnalités ;
- Les cartes à plusieurs points de départ peuvent réduire les écarts dus à une seule graine ;
- Des clients open source en Python et JavaScript sont fournis officiellement.
Restrictions et précautions
- La version gratuite ne propose que 5 images par mois, le prix Premium doit être confirmé sur la page de facturation dynamique ;
- Le schéma dépend des données SemanticScholar et peut omettre de nouveaux articles, des documents en langue autre que l’anglais et des enregistrements de citations ;
- La similarité n’est pas une relation de qualité, de causalité ou de citation directe ;
- Une revue systématique doit s’appuyer sur des bases de données spécialisées et un processus de filtrage complet ;
Questions fréquentes
Les Connected Papers sont-ils gratuits ?
La version gratuite permet de créer 5 images par mois et inclut toutes les fonctionnalités de base.
Qu’est-ce que les lignes dans le graphique des articles connectés ?
Il représente principalement la similarité des articles et la structure des citations communes, et non simplement un arbre de citations directes.
Quelle est la différence entre Academic et Business ?
Les deux offrent un nombre illimité de plans et les mêmes fonctionnalités ; Academic est destiné à des fins académiques, caritatives et personnelles, tandis que Business est destiné aux activités commerciales.
Peut-on utiliser une API ?
Oui, une API d’accès anticipé ainsi que des clients en Python et JavaScript sont fournis officiellement ; il est nécessaire de contacter les responsables pour obtenir une clé API.
Peut-il remplacer Google Scholar ?
Non. Il est plus adapté à l’exploration de réseaux de similarité à partir d’articles connus ; une recherche complète par mots-clés nécessite encore Google Scholar et des bases de données spécialisées.
Les Connected Papers sont-ils open source ?
La plateforme complète n’est pas open source, mais les clients API officiels en Python et JavaScript sont publiés sous la licence MIT.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164