LM Studio
Valeur ajoutée gratuite
Guide complet des outils d’IA Framework de développement d’IA

LM Studio

Découvrir, exécuter et appeler des modèles locaux de grande taille ainsi que des modèles vocaux sur poste de bureau

Étiquettes :

Qu’est-ce que LM Studio ?

LM Studio est un outil graphique pour l’exécution et le développement de grands modèles locaux. Les utilisateurs peuvent rechercher dans la communauté des modèles GGUF ou MLX adaptés à leur appareil, les télécharger, puis utiliser ces modèles sur leur ordinateur pour discuter, traiter des documents, ou démarrer des services locaux que des codes, des éditeurs et des applications d’IA peuvent appeler.

Il intègre le choix du modèle, la version quantifiée, l’estimation de la mémoire, le chargement des paramètres et les interfaces de service dans une interface desktop, ce qui le rend plus accessible aux utilisateurs peu familiers avec la ligne de commande, tout en conservant les fonctionnalités de la ligne de commande, du SDK et de l’API.

LM Studio propose actuellement également des modèles cloud. Lorsque vous choisissez un modèle cloud, les prompts et les inférences sont traités par les services hébergés par LM Studio ;

Lors du choix d’un modèle local, le calcul principal s’effectue sur le dispositif de l’utilisateur.

Les deux modes utilisent des interfaces de chat et de développement similaires, mais les limites de confidentialité, les coûts, la vitesse et les modèles disponibles diffèrent ; il ne faut pas confondre le Cloud avec l’inference hors ligne locale.

Fonctionnalités clés

  • Découverte et téléchargement de modèles :Rechercher le répertoire des modèles, sélectionner les versions en fonction du nombre de paramètres, du niveau de quantification, de l’architecture et de la taille du fichier, et fournir des indications sur la faisabilité en fonction de la mémoire actuelle.
  • Chat local :Créer des dialogues en plusieurs tours, configurer les prompts système et les paramètres d’échantillonnage permet de tester en parallèle la vitesse et la qualité des réponses des différents modèles.
  • Q&R sur le document :Ajoutez des documents tels que des PDF ou du texte à la session, afin que le modèle fasse des résumés et donne des réponses en se basant sur les fichiers locaux ; les résultats dépendent du contexte du modèle, de l’analyse des documents et de la portée de la recherche.
  • Mode développeur :Démarrer un service HTTP local, fournir une interface compatible avec OpenAI, ainsi que des SDK en Python et JavaScript pour faciliter la migration des applications existantes de chat, de sortie structurée et d’appels d’outils.
  • Services multi-modèles :Plusieurs modèles peuvent être chargés et basculés selon les besoins, avec un support en arrière-plan pour des environnements d’exécution tels que llama.cpp et Apple MLX.
  • MCP et outils :Il est possible de connecter un serveur MCP ou des outils au modèle, mais ces outils peuvent accéder à des fichiers, au réseau et aux systèmes métier ; il est donc nécessaire d’examiner les permissions.
  • LM Link:Il est possible d’autoriser d’autres appareils à se connecter au ordinateur qui exécute LM Studio ; la version gratuite permet actuellement de relier jusqu’à 5 appareils.
  • Équipe et entreprise :Le hub d’équipe est utilisé pour le partage d’organisations, de modèles et de produits privés ; la version entreprise ajoute SSO, contrôle d’accès aux modèles, rapports de gestion, déploiement personnalisé et support prioritaire.

Prix

Forfait ou versionPrix, plafonds et avantages clés
FreeL’application de bureau est gratuite, pouvant être utilisée pour des besoins personnels et professionnels ; les fonctionnalités de chat avec modèles locaux, de transcription vocale, d’exécution avec llama.cpp et MLX, ainsi que les services locaux ne nécessitent aucune abonnement et n’exigent pas de connexion.
Cloud payant à l’usageAprès l’achat de Cloud Credits, les frais sont calculés séparément pour les tokens d’entrée du modèle, les tokens d’entrée en mémoire cache et les tokens de sortie. Dans l’exemple actuel, DeepSeek V4 Flash coûte 0,13 dollar par million de tokens d’entrée, 0,028 dollar pour les tokens d’entrée en mémoire cache et 0,26 dollar pour les tokens de sortie ; DeepSeek V4 Pro coûte quant à lui 1,74 dollar, 0,15 dollar et 3,48 dollar respectivement. Les tarifs varient pour les autres modèles ; ils doivent être affichés avant la génération.
Team et EnterpriseLa collaboration d’équipe et la gouvernance d’entreprise ne disposent pas de prix auto-service unifiés sur la page publique ; il est nécessaire de s’inscrire ou de contacter le service des ventes ; le prix du Bionic Pass indique également qu’il sera bientôt annoncé.

Bien que l’utilisation locale ne nécessite pas de frais de traitement auprès de LM Studio, elle implique des coûts pour l’ordinateur, le stockage, l’électricité et la maintenance. Les Cloud Credits et les fonctionnalités gratuites locales correspondent à deux structures de coûts distinctes ; la génération de textes longs est généralement plus chère que l’entrée de données.

Plateforme, vie privée et statut open source

LM Studio prend en charge Windows, macOS et Linux. Les puces Apple peuvent utiliser MLX, tandis que les autres appareils fonctionnent généralement via llama.cpp ainsi que des backends CPU/GPU disponibles.

Plus le modèle est grand, plus les exigences en matière de mémoire vive et de mémoire vidéo sont élevées ; le fait qu’un fichier puisse être téléchargé ne signifie pas que l’appareil peut charger correctement tout le contexte.

Les modèles locaux, les documents et les conversations peuvent rester sur le dispositif, ce qui convient aux utilisateurs qui privilégient le contrôle des données ; une fois la recherche sur le web, la synchronisation de la connexion, les modèles Cloud, la connexion à distance ou le MCP de tiers activés, les données concernées sortent du cadre purement hors ligne, et l’entreprise doit vérifier séparément les règles de transmission et de conservation avant utilisation.

L’application de bureau LM Studio est un logiciel propriétaire, ce n’est pas un projet open source.Les runtimes qu’il intègre, tels que llama.cpp et MLX, peuvent être open source, mais cela ne permet pas d’étiqueter l’ensemble du produit comme open source.

Chaque modèle téléchargé est accompagné d’une licence indépendante, qui peut limiter l’usage commercial, la redistribution, la création de modèles dérivés ou des utilisations spécifiques ; il est nécessaire de vérifier individuellement la fiche du modèle et la licence avant de publier un produit.

Guide d'utilisation de LM Studio

Terminer une tâche de base

  1. Inscrivez-vous à LM Studio et créez une clé API réservée uniquement à l’environnement de test ;
  2. Sélectionner le modèle en fonction du type d’entrée, du contexte, de la qualité, de la vitesse et du prix ;
  3. Appeler d’abord le modèle pour découvrir et télécharger la requête minimale, puis vérifier la structure de réponse ;
  4. Testez ensuite la sortie en flux, les paramètres et les réponses aux exceptions via une conversation locale ;
  5. Enregistrer les tokens, le nombre d’appels, le délai, le taux d’erreurs et le coût par appel ;
  6. Transférez la clé dans le gestionnaire de clés du serveur avant de l’intégrer à l’application officielle ;

Créer des flux de travail professionnels réutilisables

  1. Utiliser des clés et des quotas différents pour les environnements de développement, de test et de production ;
  2. Créer un ensemble d’évaluation représentatif en fonction des découvertes du modèle, des téléchargements, de la messagerie locale et des questions-réponses sur les documents ;
  3. Définir les délais d’attente, la concurrence, les tentatives de réessai, le throttling et les plafonds budgétaires ;
  4. Effectuer des vérifications sur la sortie en ce qui concerne les faits, la sécurité, le format et les informations sensibles ;
  5. Surveiller les changements de version, de prix, de délai et de taux d’échec des modèles de surveillance ;
  6. Préparer des plans de dégradation du modèle, de coupure et de prise en main manuelle ;

À qui s’adresse-t-il

  • Utilisateurs ordinaires souhaitant expérimenter des modèles de poids open source sur un ordinateur personnel hors ligne
  • Développeurs ayant besoin d’une API locale, d’une sortie structurée et d’appels à des outils
  • Équipe chargée de tester les systèmes de questions-réponses sur des documents sans que les données ne quittent le dispositif
  • Des chercheurs qui comparent différents modèles quantitatifs, l’occupation matérielle et la vitesse de déduction

Restrictions d'utilisation

  • Les connaissances, le raisonnement et la qualité en chinois du modèle local dépendent du modèle spécifique ; on ne peut pas considérer que les réponses sont fiables simplement parce qu’elles sont générées localement.
  • Les systèmes de Q&A sur documents peuvent encore manquer des tableaux, des images et des scans ;
  • Les informations importantes doivent être vérifiées dans le texte original.
  • Les services locaux ne doivent pas être exposés directement à Internet sans authentification, et l’accès à distance doit faire appel à un pare-feu, à une authentification et au principe du moindre privilège.

Questions fréquentes

LM Studio est-il gratuit ?

L’inférence sur poste et locale est gratuite ; les modèles Cloud s’achètent via des crédits selon l’utilisation, tandis que les fonctionnalités pour équipes et entreprises sont facturées séparément.

Faut-il être connecté à Internet ?

Il est nécessaire d’être connecté à Internet pour télécharger les applications et les modèles. Une fois le téléchargement des modèles terminé, il est possible de discuter hors ligne et d’utiliser une API locale ; les modèles Cloud, la recherche sur le web et la bibliothèque de modèles en ligne nécessitent un réseau.

Quelle est la différence entre LM Studio et Ollama ?

LM Studio met davantage l’accent sur l’interface graphique, la consultation des modèles et les expériences sur le bureau ; Ollama privilégie plutôt la ligne de commande, les services de modèles et l’intégration au développement.

Les deux peuvent fournir des API locales ; le choix dépend des préférences d’interface, des besoins en automatisation et de l’environnement de fonctionnement.

©️Droit d’auteur : Sauf indication contraire, tous les articles de ce site sont protégés par le droit d’auteur.Partage d’outils d’IATous les droits d’auteur sont réservés. Sans autorisation, aucune personne, média, site web ou groupe ne peut reproduire, copier ou diffuser de quelque manière que ce soit le contenu de ce site, ni créer de mirror sur des serveurs qui ne lui appartiennent pas. Dans le cas contraire, notre site se réserve le droit de poursuivre en justice les responsables conformément à la loi.

Outils similaires à LM Studio