
Semantic Scholar est un moteur de recherche académique gratuit conçu par l'institut à but non lucratif Allen Institute for AI, qui indexe plus de 237 millions d'articles dans toutes les disciplines scientifiques. Il y ajoute des résumés par IA, des graphes de citations et des recommandations, et ouvre l'ensemble du graphe académique via une API publique gratuite.
Vous avez utilisé cet outil ? Notez-le
Vous avez utilisé cet outil ? Notez-le
Semantic Scholar se décrit en une ligne qui se trouve être remarquablement exacte : un outil de recherche gratuit, propulsé par l'IA, dédié à la littérature scientifique. Chaque mot compte. C'est gratuit, non pas au sens du modèle freemium ni d'un palier d'appel destiné à mener vers un achat. L'apprentissage automatique s'applique au contenu des articles et non à leurs seules métadonnées. Et l'outil vise spécifiquement la littérature scientifique, ce qui détermine à la fois ce qu'il réussit et ce qu'il écarte délibérément.
Le champ de recherche annonce l'échelle sans détour : plus de 237 millions d'articles couvrant toutes les disciplines scientifiques. Ce corpus provient de trois flux — le site précise que ses articles viennent de partenariats avec des éditeurs, de fournisseurs de données et d'explorations du web — ce qui explique une couverture large mais, comme on le verra, incomplète.
L'opérateur est le fait décisif au sujet de ce produit. Semantic Scholar est construit par une équipe de recherche et de développement produit au sein d'Ai2, l'Allen Institute for AI. Ai2 est un institut de recherche à but non lucratif, et l'organisation l'écrit explicitement plutôt que de le laisser entendre : dans une section de valeurs consacrée à l'accès équitable à la science, elle indique qu'en tant qu'organisation à but non lucratif, elle évalue l'incidence de ses choix et privilégie les directions qui contribuent à rééquilibrer la balance.
Cela importe pour des raisons pratiques et non sentimentales. Un produit de recherche académique commercial subit une pression structurelle pour ériger un mur payant, verrouiller son interface de programmation ou monétiser l'attention. Semantic Scholar échappe à ces pressions, ce qui explique une API ouverte et l'absence de tout palier supérieur auquel se comparer. La littérature évaluée par les pairs confirme la filiation : l'outil a démarré en 2015 comme moteur de recherche pour l'informatique, les géosciences et les neurosciences sous l'égide de l'institut à but non lucratif Allen Institute for Artificial Intelligence, avant de s'étendre à toutes les disciplines.
Deux précisions font gagner du temps. Ce n'est pas un éditeur et il ne porte aucun jugement de qualité sur ce qu'il indexe, point développé dans la section des limites. Et ce n'est pas un agent conversationnel qui rédige votre revue de littérature : c'est une couche de recherche et de compréhension posée sur un corpus d'articles. Saisir cette frontière permet d'attendre des fonctions d'IA ce qu'elles font réellement.
L'affirmation technique distinctive est que le système lit à l'intérieur des articles au lieu de confronter des mots-clés aux titres et aux résumés. Les modèles développés en interne par Ai2 traitent et classent chaque article de la chaîne, et le système extrait le sens et repère les liens à l'intérieur des articles, puis met ces liens en avant pour aider à comprendre rapidement un travail.
La conséquence pratique se voit dans les listes de résultats. Une évaluation indépendante a observé que des recherches renvoyant des dizaines de milliers de résultats sur Google Scholar et des milliers sur PubMed n'en renvoient ici que quelques centaines. Est-ce une force ou une faiblesse ? Cela dépend de la tâche : excellent pour trouver vite les travaux les plus pertinents, handicapant s'il vous faut un rappel exhaustif pour une revue systématique.
Au-delà de la découverte, la plateforme cartographie les relations entre articles. Elle entretient des milliards de liens de citation et présente sur chaque page les références et les citations reçues. L'évaluation indépendante a relevé qu'elle fournit des indicateurs de vitesse de citation et d'influence des auteurs aidant les chercheurs à préjuger de la qualité — des signaux qui permettent de savoir, avant lecture, si un article gagne en audience.
C'est réellement utile face au problème quotidien du choix de lecture. Un article de 2019 dont la courbe de citations progresse lentement et un article de 2024 en nette accélération ne méritent pas la même attention, et cette différence n'apparaît pas dans un titre.
Deux fonctions de compréhension par IA se greffent sur la recherche. TLDR produit un résumé d'une ligne, ce qui permet de trier une liste de résultats sans ouvrir chaque résumé. Semantic Reader, en version bêta, est une interface de lecture augmentée qui ajoute des aides intégrées comme des cartes de citation, afin de voir ce que dit un travail cité sans quitter la page en cours.
Créer un compte reste facultatif mais débloque quatre choses : des alertes par courriel pour les nouveaux articles, des flux de recherche proposant des recommandations, une bibliothèque pour conserver des articles, et la possibilité de revendiquer une page auteur. Alertes et flux transforment l'outil : d'un site que l'on consulte, il devient un dispositif qui surveille un domaine pour vous. C'est toute la différence entre chercher et rester à jour.
Revendiquer une page auteur donne en outre au chercheur la maîtrise de son propre dossier, ce qui compte puisque la désambiguïsation automatique des auteurs reste imparfaite.
Pour qui dispose déjà d'un flux de gestion bibliographique, l'extension de navigateur Zotero fait le pont. Depuis une page d'article ou une page de résultats, les informations de l'article, l'URL, le PDF s'il est disponible et le résumé TLDR s'il existe sont classés et enregistrés dans votre bibliothèque Zotero, et les articles ainsi conservés peuvent être rouverts dans Semantic Reader.
La dernière fonction est peut-être la plus lourde de conséquences pour l'écosystème : l'ensemble du corpus est accessible en données structurées via une API gratuite, couvrant les auteurs, les articles, les citations, les lieux de publication et les vecteurs SPECTER2. Ai2 diffuse par ailleurs du code et des jeux de données ouverts en plus de publier ses propres travaux. C'est pourquoi Semantic Scholar fonctionne comme une infrastructure sur laquelle d'autres outils se construisent, et pas seulement comme un site web.
L'usage le plus fréquent est l'orientation : vous abordez un sujet et devez trouver rapidement les travaux importants. La recherche sémantique associée aux signaux d'influence convient bien, car la tâche consiste à trouver les bons articles et non tous les articles.
Flux de recherche et alertes par courriel répondent au problème du suivi continu. Vous définissez vos centres d'intérêt une fois et recevez les nouveautés à mesure, ce qui convient aux domaines où une recherche manuelle trimestrielle arrive trop tard.
Le graphe de citations se parcourt dans les deux sens : vous pouvez remonter aux fondements d'un article ou avancer vers ceux qui ont bâti dessus. C'est la voie naturelle pour comprendre l'évolution d'une méthode, bien plus rapide que de reconstituer le fil à la main depuis les bibliographies.
Les résumés TLDR et les indicateurs de citation soutiennent une passe de sélection. Devant vingt articles candidats, vous déterminez vite lesquels méritent une lecture complète — un usage sans éclat mais qui fait gagner un temps réel.
Pour les développeurs, cette API gratuite transforme le corpus en brique de construction. Les applications comprennent les systèmes de recommandation, l'analyse bibliométrique, les tableaux de bord de recherche et la recherche documentée pour des systèmes d'IA. La présence des vecteurs SPECTER2 est notable : elle signifie que la similarité sémantique est disponible sans calculer soi-même de représentations documentaires.
Les chercheurs utilisent la revendication de page auteur pour corriger leur dossier, en s'assurant que leur liste de publications est exacte et non confondue avec celle d'un homonyme.
Comme il n'y a ni coût ni obligation de compte pour l'usage de base, orienter une classe entière vers cet outil est simple. Les universités l'ont reconnu : il figure dans les guides de recherche des bibliothèques académiques comme point d'entrée recommandé pour la recherche documentaire.
N'en faites pas votre unique outil de recherche. Pour une revue systématique ou une recherche exhaustive, associez-le à PubMed, Web of Science ou Scopus. L'évaluation indépendante est explicite : une recherche ici ne peut être considérée comme une recherche complète de la littérature de fond. Utilisez-le pour la vitesse de découverte, non pour une garantie de rappel.
Vérifiez la couverture de votre domaine avant de vous engager. La densité de couverture varie selon les disciplines. Faites d'abord des recherches sur des références connues dans votre spécialité plutôt que de supposer une profondeur uniforme.
Traitez les signaux d'influence comme un filtre, non comme une vérité. Vitesse de citation et influence des auteurs traduisent l'attention et non l'exactitude. Un excellent travail récent est par définition peu cité, et un travail très cité l'est parfois parce qu'il est erroné.
Lisez les TLDR pour trier, jamais comme substituts. Un résumé automatique d'une ligne est un dispositif de sélection. Toute affirmation sur laquelle vous comptez vous appuyer doit venir de l'article lui-même.
Configurez des flux étroits. Des flux trop larges génèrent du bruit et vous entraînent à les ignorer. Des centres d'intérêt étroits et précis produisent des alertes que vous lirez vraiment.
Revendiquez votre page auteur tôt dans votre carrière. Les erreurs de désambiguïsation s'accumulent à mesure que la liste de publications s'allonge, et corriger tôt est plus simple que de démêler plus tard.
Demandez une clé d'API en connaissance de cause. La limite initiale avec clé étant d'une requête par seconde alors que l'accès non authentifié partage un réservoir bien plus large, le bon choix dépend de votre schéma d'accès. Lisez la politique en vigueur avant de supposer qu'une clé améliore votre débit.
Rappelez-vous ce qu'il ne juge pas. La plateforme indexe des prépublications aux côtés de travaux évalués par les pairs et ne se prononce pas sur la qualité. Vérifiez le lieu de publication et le statut de relecture de tout ce que vous citez.
Les chercheuses et chercheurs universitaires ainsi que les doctorants constituent le public principal : toute personne qui explore la littérature, retrace des filiations de citation ou surveille un domaine.
Les chercheurs d'institutions aux ressources limitées en tirent un bénéfice disproportionné, puisque le modèle gratuit et non lucratif supprime la barrière d'abonnement des bases commerciales. C'est l'objectif explicite derrière la déclaration de valeur sur l'accès équitable.
Les chercheurs interdisciplinaires gagnent à disposer d'une couverture toutes disciplines dans une seule interface, sans naviguer entre bases spécialisées.
Les développeurs qui construisent des outils de recherche sont servis par l'API gratuite et les jeux de données ouverts, qui rendent les métadonnées académiques accessibles sans licence commerciale.
Les étudiants qui apprennent à faire de la recherche disposent d'un point d'entrée peu contraignant, sans coût ni compte requis, ce qui explique sa présence dans les guides des bibliothèques universitaires.
Les auteurs publiés s'en servent pour gérer leur dossier savant via la revendication de page auteur.
Qui devrait chercher ailleurs ou compléter : toute personne menant une revue systématique exigeant une couverture exhaustive documentée, la complétude n'étant pas garantie. Les chercheurs travaillant surtout sur des ouvrages ou des brevets trouveront la couverture insuffisante par construction. Et quiconque a besoin du texte intégral d'articles sous péage doit retenir qu'il s'agit d'une couche de découverte et non d'une licence de contenu : elle aide à trouver les articles, pas nécessairement à les lire.
Semantic Scholar est une plateforme web, accessible depuis tout navigateur moderne. Il n'existe pas d'application mobile dédiée : l'équipe indique n'avoir actuellement pas d'application pour téléphone, le site étant conçu pour fonctionner aussi bien sur navigateur de bureau que mobile. Pour un outil de découverte menant à la lecture de PDF, l'arbitrage se défend.
La surface la plus importante est programmatique. L'API est gratuite et organisée en trois services : Academic Graph pour les données sur les auteurs, les articles, les citations, les lieux de publication et les vecteurs SPECTER2 ; Recommendations pour trouver des articles proches d'un article donné ; et Datasets pour le téléchargement en masse du graphe académique. L'accès est régi par un contrat de licence d'API distinct couvrant l'attribution et les conditions d'usage.
L'intégration s'étend à la gestion bibliographique via l'extension Zotero, et Ai2 publie du code et des jeux de données ouverts qui permettent de réutiliser ce corpus bien au-delà du site. L'effet pratique est que de nombreux autres outils de recherche se situent en aval de ces données, même lorsque leurs utilisateurs ne visitent jamais le site.
Cette section est brève parce que la réponse est simple, et cette simplicité constitue en soi le fait notable.
Le produit est gratuit. Aucun palier payant, aucun abonnement supérieur, aucun mur fonctionnel. Le site se décrit comme gratuit dans son titre d'accueil, sur sa page de présentation et dans sa foire aux questions, et cette gratuité n'est pas une phase promotionnelle : elle découle de l'identité de l'opérateur. La formule de la section des valeurs, selon laquelle en tant qu'organisation à but non lucratif elle évalue l'incidence de ses choix et privilégie les directions qui rééquilibrent la balance, est la raison structurelle pour laquelle il n'y a rien à acheter.
Aucun compte n'est requis pour l'usage principal. Recherche et consultation fonctionnent sans inscription : vous n'avez pas besoin de créer un compte pour accéder aux articles. L'inscription, gratuite elle aussi, ouvre alertes, flux, bibliothèque et revendication de page auteur, sans constituer une barrière de paiement.
L'API est gratuite également, la plupart des points d'accès fonctionnant sans authentification. Ai2 diffuse en outre du code et des jeux de données ouverts, étendant l'accès gratuit de l'interface jusqu'aux données sous-jacentes.
Ce que la gratuité coûte à la place. Les contraintes pertinentes ne sont pas monétaires mais opérationnelles : limites de cadence partagées sur l'accès non authentifié, limite initiale par seconde sur l'accès avec clé, et frontières de couverture décrites dans la section des limites. Pour un outil de recherche, ce sont là les vrais arbitrages à peser, et non le prix.
Pérennité. Comme un institut à but non lucratif finance l'ensemble plutôt que les utilisateurs ou des annonceurs, la question habituelle du moment où le palier gratuit se restreint se pose ici différemment. Aucune feuille de route de monétisation ne pousse contre l'accès gratuit ; cela dit, comme pour toute infrastructure financée par des subventions, la continuité à long terme dépend de priorités institutionnelles et non de garanties contractuelles.
La plupart des chercheurs les combinent plutôt que de choisir.
Google Scholar — l'option gratuite la plus large, avec la couverture la plus vaste et la recherche en texte intégral. Il renvoie bien davantage de résultats, offre des métadonnées structurées plus faibles, aucune API ouverte et aucune couche de compréhension par IA comparable. Utilisez-le pour le rappel, et Semantic Scholar pour la précision et la structure.
PubMed — référence pour la littérature biomédicale, avec une indexation MeSH curatée et un solide support booléen. Supérieur pour une recherche biomédicale systématique ; plus étroit et sans couverture interdisciplinaire.
Web of Science et Scopus — bases de citations commerciales à couverture sélectionnée et outils bibliométriques mûrs. Elles offrent une indexation de qualité contrôlée et un accompagnement institutionnel, au prix d'abonnements qui excluent de nombreux chercheurs — précisément l'écart que vise le modèle non lucratif.
Dimensions et Lens.org — plateformes de découverte à large couverture ; Lens se distingue en incluant les brevets, que Semantic Scholar exclut explicitement.
Connected Papers, Litmaps et ResearchRabbit — outils d'exploration visuelle des citations. Plusieurs reposent sur des données de graphe académique ouvert : ils complètent cette plateforme plutôt qu'ils ne la remplacent, et vous utilisez peut-être indirectement ses données.
Elicit, Consensus et assistants de recherche par IA — ils vont plus loin vers la synthèse, répondant à des questions à travers plusieurs articles au lieu de seulement les trouver. Généralement freemium ou payants, ils s'appuient souvent sur des corpus ouverts en dessous.
La couverture est délibérément bornée. La foire aux questions est franche : la couverture des ouvrages est très limitée et les brevets ne sont pas inclus. Articles de revues et prépublications constituent le cœur, ce qui explique des décomptes différents d'autres bases et un service médiocre pour les disciplines centrées sur les monographies.
La complétude n'est pas garantie. L'évaluation indépendante conclut que les chercheurs ne peuvent considérer une recherche ici comme une recherche complète de la littérature de fond. Pour tout travail exigeant une couverture exhaustive documentée, un complément s'impose.
Aucun jugement de qualité n'est porté. La plateforme déclare ne pas cautionner ni soutenir les affirmations contenues dans les articles et ne pas intervenir dans les décisions éditoriales du processus de publication. Prépublications, travaux rétractés ou contestés peuvent apparaître aux côtés d'articles évalués par les pairs : la vérification reste votre responsabilité.
La désambiguïsation des auteurs est imparfaite. Des auteurs aux noms proches peuvent voir leurs articles regroupés à tort. Le correctif existe — revendiquer sa page permet d'ajouter et de retirer des articles — mais encore faut-il le remarquer et agir.
Les résumés par IA portent les limites de l'IA. TLDR est généré automatiquement et peut manquer une nuance, une réserve ou une condition de portée. Traitez-le comme un indicateur, jamais comme le résultat.
Pas d'application mobile. L'accès mobile passe uniquement par le navigateur : suffisant pour chercher, moins confortable pour une lecture prolongée.
Les limites de cadence de l'API façonnent ce que vous pouvez construire. L'accès non authentifié partage un réservoir entre tous les utilisateurs anonymes et peut être bridé aux heures de pointe, tandis que la cadence initiale avec clé est d'une requête par seconde. Les applications à fort volume doivent en tenir compte plutôt que d'assimiler gratuit à illimité.
Les évaluations tierces anciennes sont dépassées. Les premières évaluations par les pairs signalaient l'absence d'API et de fonction d'alerte. Les deux existent désormais. En lisant une appréciation externe de cet outil, vérifiez sa date : le produit a substantiellement changé depuis son lancement en 2015.
Découvrir n'est pas accéder. Trouver un article ne signifie pas pouvoir le lire. Les contenus sous péage requièrent toujours un accès institutionnel ou une autre voie vers le texte intégral.
Il est réellement gratuit, sans palier supérieur ni mur fonctionnel. Cela découle de son opérateur : il est construit par une équipe au sein d'Ai2, institut de recherche à but non lucratif dont les valeurs affichées incluent la promotion d'un accès équitable à la science. Il n'y a aucune mise à niveau à acheter.
Non. Recherche et consultation fonctionnent sans inscription. Un compte gratuit ajoute les alertes par courriel, les flux de recherche, une bibliothèque d'articles conservés et la revendication de page auteur, mais rien de tout cela ne conditionne l'usage de base.
L'interface annonce actuellement plus de 237 millions d'articles couvrant toutes les disciplines scientifiques. Le contenu provient de partenariats avec des éditeurs, de fournisseurs de données et d'explorations du web, ce qui explique à la fois l'étendue et le caractère inégal plutôt qu'uniforme de la couverture.
Pas seul. L'évaluation indépendante conclut qu'une recherche ici ne peut être tenue pour une recherche complète de la littérature de fond. Utilisez-le pour la découverte et le suivi des citations, en l'associant à PubMed, Scopus ou Web of Science lorsqu'une couverture exhaustive documentée est requise.
L'API est gratuite et la plupart des points d'accès fonctionnent sans authentification. Les requêtes non authentifiées partagent un réservoir de mille requêtes par seconde entre tous les utilisateurs anonymes et peuvent être bridées en période chargée. Avec une clé, la limite initiale est d'une requête par seconde sur tous les points d'accès. Choisissez selon votre schéma d'accès plutôt qu'en supposant qu'une clé vaut toujours mieux.
Trois services. Academic Graph fournit auteurs, articles, citations, lieux de publication et vecteurs SPECTER2. Recommendations renvoie des articles proches d'un article donné. Datasets fournit des liens de téléchargement pour les données du graphe académique en masse. L'usage relève d'un contrat de licence d'API distinct.
Très peu. La foire aux questions indique clairement que la couverture des ouvrages est très limitée et que les brevets ne sont pas inclus. Le cœur reste les articles de revues et les prépublications, si bien que les disciplines où comptent monographies ou brevets doivent recourir à d'autres sources.
Non. Elle ne cautionne explicitement pas les affirmations des articles indexés et ne prend aucune part aux décisions éditoriales de publication. Les prépublications côtoient les articles évalués par les pairs : vérifier le lieu de publication et le statut de relecture reste le travail du lecteur.
Oui. Comme les auteurs aux noms proches peuvent voir leurs travaux regroupés à tort, vous pouvez déposer une demande de revendication de votre page auteur, après quoi vous pourrez ajouter ou retirer des articles et modifier vos informations d'auteur.
Une procédure existe. Vous pouvez contacter l'équipe avec l'URL de l'article sur Semantic Scholar et le motif de la demande. Notez par ailleurs que les conditions d'utilisation et la politique de confidentialité du produit sont hébergées sur le domaine institutionnel d'Ai2 plutôt que sous forme de documents produit distincts.
Comment utiliser Semantic Scholar
Étape 1 : chercher sans créer de compte
Commencez simplement par une recherche. Vous n'avez pas besoin de créer un compte pour accéder aux articles sur Semantic Scholar, ce qui permet d'évaluer sa pertinence pour votre domaine avant d'investir dans une configuration. Essayez une requête dont vous connaissez déjà la réponse : c'est le moyen le plus rapide de juger si la couverture de votre spécialité suffit.
Étape 2 : lire les signaux des résultats, pas seulement les titres
Chaque résultat porte plus qu'un titre : résumés TLDR, nombre de citations, indicateurs d'influence. Apprenez à les lire comme une couche de tri. C'est précisément là que l'outil fait gagner du temps par rapport à une recherche par mots-clés.
Étape 3 : élargir par le graphe de citations
Une fois un article pertinent trouvé, avancez par ses références et par les travaux qui le citent plutôt que d'enchaîner d'autres requêtes. Suivre le graphe fait généralement remonter les travaux voisins importants de façon plus fiable que de deviner des termes de recherche.
Étape 4 : créer un compte pour la continuité
Si l'outil s'avère utile, inscrivez-vous pour ouvrir alertes, flux et bibliothèque. C'est l'étape qui transforme un usage occasionnel en flux de veille.
Étape 5 : brancher votre gestionnaire de références
Installez l'extension Zotero si vous l'utilisez, afin que les articles conservés arrivent dans votre système existant avec métadonnées, PDF et résumé. Maintenir une seule bibliothèque plutôt que deux évite la fragmentation qui mine la plupart des routines de lecture.
Étape 6 : revendiquer sa page auteur si l'on publie
Si vous avez des publications, revendiquez votre page et corrigez les attributions erronées. La désambiguïsation automatique est imparfaite, et la voie de correction existe pour cela.
Étape 7 : utiliser l'API si vous construisez des outils
Pour un accès programmatique, partez des points d'accès publics, qui ne demandent aucune clé. Demandez une clé lorsque vous avez besoin d'une meilleure fiabilité ou d'accéder à des points d'accès qui l'exigent, en gardant à l'esprit l'arbitrage évoqué dans la section tarifs : la cadence initiale avec clé est plus basse que le réservoir anonyme partagé.