Morph
Morph, outil intelligent axé sur la programmation par IA
Étiquettes :Outils de programmation IAQu’est-ce que Morph ?
Morph est une plateforme d’inférence IA développée par AutoInfra, Inc., conçue principalement pour servir les agents de programmation et les outils de développement automatisé, plutôt que pour des chatbots destinés aux utilisateurs ordinaires.
La plateforme propose divers modèles de chat à poids ouverts via une API unifiée, et utilise Fast Apply, WarpGrep, Compact, Reflex et Router pour gérer les goulets d’étranglement liés à l’édition du code, à la recherche, à la gestion du contexte et au suivi des sessions.
Morph peut être utilisé tant pour développer de nouveaux agents d’encodage que pour s’intégrer aux SDK existants d’OpenAI ou d’Anthropic, à Claude Code, au SDK Vercel AI, à MCP ainsi qu’à divers frameworks d’agents.
Capacité centrale
Inference du modèle à poids ouverts
- Accès unifié : La même clé Morph API permet d’appeler des modèles tels que Kimi, GLM, MiniMax, Qwen, DeepSeek et Gemma, ce qui réduit les efforts nécessaires pour s’adapter à plusieurs interfaces de traitement.
- Compatibilité à double interface : offre des interfaces Chat Completions de style OpenAI et Messages de style Anthropic ; le format des appels aux outils doit correspondre à l’endpoint sélectionné.
- Sortie structurée : le document public décrit que le modèle prend en charge les outils, le format JSON, JSON Schema, logprobs et le contrôle de l’inference, ce qui le rend adapté aux appels d’outils d’agent et à l’analyse des résultats.
- Cache de préfixes automatique : les messages système répétitifs et le contexte peuvent être stockés dans le cache, et les prix sont facturés en fonction des entrées du cache ; les modèles et la durée de vie (TTL) applicables sont déterminés par le document et l’interface actuels.
- Réponse en flux : prend en charge la génération et le retour simultanés, adapté aux interfaces d’encodage interactives ; le nombre de tokens par seconde indiqué n’est pas égal au délai du premier token, et le remplissage préalable de contextes longs peut toujours dominer le temps d’attente.
Fast Apply fusion de code
- Fast Apply reçoit le fichier original, les instructions de modification et un fragment de code ne contenant que les parties modifiées, puis renvoie le fichier complet fusionné.
- L’agent utilise la marque « existing code » pour représenter les zones non modifiées, ce qui réduit les tokens de sortie, les retards et le drift du code liés à la réécriture de tout le fichier.
- morph-v3-fast met l’accent sur la vitesse, morph-v3-large convient mieux aux modifications complexes et à plusieurs scopes ; un choix automatique de routage est également possible.
- Le SDK peut emballer les capacités d’édition sous forme d’outils d’Anthropic, OpenAI ou Vercel AI SDK, ou bien appeler directement des interfaces compatibles.
- Une absence de marquage, un contexte insuffisant ou des erreurs d’indentation peuvent entraîner des suppressions accidentelles et des fusionnements erronés ; il est donc nécessaire de vérifier les différences, d’exécuter des tests et de conserver des points de restauration avant d’enregistrer dans le dépôt.
Recherche de code avec WarpGrep
- WarpGrep est un sous-agent de recherche destiné aux bases de code, qui reçoit des questions en langage naturel et utilise une recherche textuelle parallèle ainsi que la lecture de fichiers pour localiser les implémentations pertinentes.
- La sortie comprend le fichier et la plage de lignes spécifiques, ce qui peut servir de contexte simplifié pour les modèles supérieurs, évitant d’inclure l’ensemble du dépôt dans une longue instruction.
- Peut fonctionner sur des projets locaux, et peut également s’adapter à des sandbox distants tels que E2B, Modal, Daytona, etc., via des commandes personnalisées.
- v2 est facturé via une API dédiée, avec 100 K pour le contexte standard et jusqu’à 1 M pour Pro ; les résultats de recherche peuvent encore omettre du code généré dynamiquement, des services externes ou du contenu non indexé.
Compression du contexte Compact
- Compact est utilisé pour compresser les dialogues de proxy et les contextes de travail à long terme, en conservant les informations nécessaires aux tâches ultérieures et en réduisant les coûts liés aux saisies répétées.
- Il reçoit un contexte long et renvoie une représentation plus courte, adaptée à une compression proactive avant d’atteindre la fenêtre du modèle, plutôt qu’un simple troncement des messages les plus anciens.
- La page du produit publique met en avant une compression rapide, presque mot pour mot, du contexte, mais toute compression peut modifier les détails ; les contraintes clés, les approbations et les preuves originales doivent être conservées séparément.
- Le contenu compressé continue d’être transmis aux modèles suivants, de sorte que le coût total est constitué à la fois des entrées/sorties Compact et des entrées des modèles ultérieurs.
Reflex et routage de modèles
- Reflex prend en entrée des événements uniques pour détecter rapidement des comportements tels que les fuites, les boucles ou les échecs, et peut être utilisé pour une surveillance en ligne ou un traitement par lots hors ligne.
- Les résultats de la classification permettent de déclencher une interruption, une dégradation de niveau, une prise en charge manuelle ou la génération d’un rapport, mais ils ne doivent pas servir de seul critère pour l’examen de la sécurité et l’évaluation de l’intention de l’utilisateur.
- Le routeur sélectionne un modèle en fonction du niveau de difficulté de la demande, permettant d’utiliser des modèles à faible coût pour les tâches simples et de passer à des modèles plus puissants pour les tâches complexes.
- Le routage ajoute un coût de classification et un délai de décision ; l’équipe doit comparer qualité, coût et stabilité en fonction de son propre ensemble de tâches, plutôt que de se contenter de pourcentages d’économie généraux.
Modèle de chat et prix unitaire actuel
| Identifiant du modèle | Prix d’entrée | Lecture du cache | Prix de vente | Contexte |
|---|---|---|---|---|
| morph-kimik3 | 2,50 dollars américains par million de tokens | 0,29 dollar américain | 14,00 dollars | 1M |
| morph-kimik3-fast | 6,00 dollars américains par million de tokens | 0,60 dollar américain | 22,50 dollars américains | 1M |
| morph-glm52-744b | 1,10 dollar américain par million de tokens | 0,22 dollar américain | 4,10 dollars américains | 1M |
| morph-minimax3-428b | 0,30 dollar américain par million de tokens | Pas encore listé | 1,20 dollar américain | 256K |
| morph-qwen35-397b | 0,50 dollar américain par million de tokens | 0,30 dollar américain | 3,50 dollars | 262K |
| morph-dsv4flash | 0,14 dollar américain par million de tokens | 0,07 dollar américain | 0,28 dollar américain | 1M |
| morph-gemma4-31b | 0,14 dollar américain par million de tokens | 0,08 dollar américain | 0,40 dollar américain | 175K |
| morph-qwen36-27b | 0,29 dollar américain par million de tokens | Pas encore listé | 2,40 dollars américains | 131K |
Le catalogue des modèles évolue rapidement ; la page de tarification actuelle et certains documents présentent des différences concernant les versions Qwen et les prix de certains modèles. La configuration de production doit se baser sur la liste des modèles disponibles dans le compte, les données de prix en temps réel et la facture réelle.
Les tokens de raisonnement, les appels d’outils, le cache et le processus de raisonnement peuvent affecter la facturation respectivement ; les tokens de réflexion activés lors du raisonnement sont facturés en fonction de la sortie générée.
Prix des modèles dédiés et des API
| Capacités et modèles | Prix | Contexte ou performance | Adéquat pour la tâche |
|---|---|---|---|
| Fast Apply morph-v3-fast | Entrée : 0,80 dollar américain, sortie : 1,20 dollar américain par million de tokens | 262 K, plus de 10 500 tokens par seconde nominaux | Fusion de code à faible latence |
| Fast Apply morph-v3-large | Entrée : 0,90 dollar américain, sortie : 1,90 dollar américain par million de tokens | 262 K, plus de 5000 tokens par seconde nominaux | Édition complexe et à plusieurs positions |
| WarpGrep v2 | 0,80 dollar américain par 100 K | 100K, Pro : 1M | Recherche de code et recherche dans le contexte |
| Compact | Entrée : 0,20 dollar américain, sortie : 0,50 dollar américain par million de tokens | 1 M, P99 inférieur à 2 secondes | Compression du contexte de proxy long |
| Reflex en temps réel | 0,001 dollar par événement, 0,0005 dollar à partir d’un volume mensuel de plus de 1 million | 64 K, nominal inférieur à 90 millisecondes | Classification et surveillance en ligne à un seul tour |
| Batch Reflex | 0,0005 dollar par événement, 0,00025 dollar à partir d’un volume mensuel de plus de 1 million | 64K | Évaluation hors ligne et analyse des journaux |
| Router | 0,005 dollar américain par requête | Contexte fixe non indiqué | Sélectionner le modèle selon le niveau de difficulté |
Les chiffres de vitesse et de précision proviennent de benchmarks et de conditions d’exécution spécifiques, et ne constituent pas une garantie pour chaque bibliothèque de code, langue, longueur de contexte ou niveau de concurrence.
Forfaits, recharges et déploiement dédié
| Forfait ou version | Prix | Période de facturation | Droits ou crédit principal | Adéquat pour les utilisateurs |
|---|---|---|---|---|
| Demandes gratuites chaque mois | 0 dollar | Chaque mois | 200 demandes gratuites ; les modèles disponibles, les tokens et les limites dépendent du compte. | Tests d’interface et petits prototypes |
| Pay as you go | Recharge minimale de 10 dollars | Tarification selon la consommation réelle | Tous les modèles publics sont disponibles ; une prime de 5 dollars est offerte lors du premier rechargement ; la page publique indique qu’il n’y a pratiquement aucune limite de vitesse. | Fluctuations ou doses faibles à moyennes |
| Scale | 200 dollars | Chaque mois | Points marqués 40M, d’une valeur de 400 dollars ; le taux de conversion spécifique des tokens dépend du modèle appelé. | Utilisateurs individuels avec un encodage haute fréquence continu |
| GPU dédié B200 | 0,1663 dollar américain par minute | Par minute | Exécution de modèles spécifiques avec une GPU à locataire unique | Stabilité d’un haut débit et besoins en isolation |
| GPU dédié GB300 | Contacter le service des ventes | sur mesure | Capacité dédiée et conditions de fonctionnement personnalisées | Raisonnement à grande échelle pour les entreprises |
| Entreprise ou auto-hébergement | Cotation sur mesure | Dispositions contractuelles | SSO, débits personnalisés, support prioritaire, infrastructure dédiée, déploiement sans réserve ou dans un environnement propriétaire | Conformité, souveraineté et scénarios à fort débit |
40 M de points ne permettent pas à tous les modèles de générer 40 millions de tokens. Les prix pour l’entrée, la sortie, le cache et les outils spécialisés diffèrent, et la quantité réellement disponible doit être calculée en fonction de la structure de la demande.
Les conditions indiquent que les paiements ne sont généralement pas remboursables, sauf en cas d’exigences légales ou de non-respect des SLA ; les litiges relatifs aux factures doivent être soulevés dans un délai de 30 jours suivant l’émission de la facture, et les points de service peuvent être utilisés pour déduire des factures ultérieures.
Processus d’intégration API
- Inscrivez-vous à un compte Morph, créez une clé API dans la console, et configurez des alertes pour l’équipe, la facturation et le budget.
- Selon la tâche, choisissez le modèle de chat, Fast Apply, WarpGrep, Compact, Reflex ou Router ; ne laissez pas un modèle gérer l’ensemble du processus pour lequel il n’est pas adapté.
- Lors de la poursuite de l’utilisation du SDK OpenAI, modifiez les endpoints de base et l’identifiant du modèle ; avec Anthropic Messages, utilisez les endpoints correspondants, les en-têtes d’authentification et le format des outils.
- Placer la clé dans le système de gestion des clés du serveur, et ne pas l’inclure dans le code du navigateur, les applications mobiles, les dépôts publics, les journaux ou les messages d’erreur.
- Exécutez d’abord les tests minimaux pour le mode non en flux, le mode en flux, les appels d’outils et la sortie structurée, puis vérifiez les codes d’erreur, les délais d’attente, les tentatives de réessai 429 et le fournisseur de fallback.
- Lors de l’accès à Fast Apply, le modèle supérieur ne produit que les segments de modification et le contexte nécessaire ; après fusion, les différences sont vérifiées, puis des vérifications de type et des tests automatisés sont exécutés.
- Utiliser WarpGrep pour rechercher les fichiers pertinents et contrôler le contexte envoyé au modèle ; définir un point de déclenchement Compact pour les sessions longues et enregistrer les contraintes clés non compressibles.
- Avant le déploiement, évaluer le taux de précision sur des tâches de code réel, le délai du premier token, le temps total de traitement, les hits de cache, le coût par tâche et la stabilité en situation de forte concurrence.
SDK, MCP, GitHub et les frontières du logiciel open source
| Projet | Statut public | Licence ou interface | frontière |
|---|---|---|---|
| Morph API | Services de gestion commerciale | Interfaces compatibles entre OpenAI et Anthropic | Soumis aux conditions de service et au paiement à l’usage |
| Morph TypeScript SDK | Paquet npm public | MIT | Le fait que l’SDK soit open source ne signifie pas que les services et les modèles le soient également. |
| MCP et outils d’installation | Paquets npm publics et outils de configuration | Chaque paquet est soumis à sa licence actuelle. | La clé API Morph et l’accès au service sont toujours nécessaires. |
| Exemples et plugins GitHub | Les organisations officielles disposent de plusieurs entrepôts publics. | Certains exemples et plugins sont sous MIT | Chaque entrepôt doit faire l’objet d’une vérification individuelle de la licence. |
| Modèle de chat à poids ouverts | Publié par les différents développeurs de modèles | Les licences des différents modèles diffèrent. | Le poids ouvert n’est pas équivalent à l’open source de la plateforme de raisonnement Morph |
| Modèles spécialisés tels que Fast Apply | Fourni via une API | EULA de la plateforme et conditions de service | Poids du modèle public non confirmé |
- Le SDK officiel offre WarpGrep, Fast Apply, GitHub PR, l’automatisation du navigateur et des outils de répertoire, et peut générer des définitions d’outils adaptées aux frameworks proxy courants.
- L’intégration GitHub permet de lire les dépôts et le contexte des demandes de pull après autorisation, de créer des vérifications et de publier des commentaires ; lors de l’association, il convient de limiter la portée d’installation de l’application ainsi que ses droits d’écriture.
- Outil d’installation MCP permet d’ajouter des fonctionnalités de recherche, d’édition et Reflex aux clients compatibles, mais lorsque l’outil MCP dispose de capacités de manipulation de fichiers ou de dépôts, il est nécessaire de mettre en place des mécanismes d’approbation et de sandbox.
- Le code source du produit, le noyau de raisonnement et les modèles spécialisés restent la propriété de Morph ; il ne faut pas qualifier l’ensemble de la plateforme de logiciel open source simplement parce que le SDK, les plugins ou les exemples sont libres sous MIT.
Données, vie privée et sécurité
| Niveau de service | Contenu conservé | Formation et amélioration | Engagement d’accessibilité |
|---|---|---|---|
| Gratuit ou par volume | Jusqu’à 90 jours | Par défaut, l’entraînement par code n’est pas utilisé, mais il convient de faire attention si des exceptions doivent être prises en charge ou déboguées ; les insights anonymes peuvent être conservés sur le long terme. | Cible de 99,0 %, sans réduction pour SLA |
| Paid | Suppression sécurisée après un maximum de 30 jours | Par défaut, pas d’entraînement ; le support ou le débogage peuvent être traités dans le respect de la confidentialité. | SLA mensuel de 99,9 %, points de service à demander selon les règles |
| Enterprise | Aucune conservation des données, suppression à la fin de la demande | Pas de formation, sauf si le client accorde explicitement un accès de support temporaire | SLA personnalisé et support 24/7 |
| Self-hosted | Contrôlé par la stratégie du client | Les données sont traitées dans l’environnement du client, sauf en cas de télémesure activée ou de prise en charge. | Sur contrat sur mesure et avec des infrastructures propres |
- Le texte public sur la confidentialité précise que les données statiques sont chiffrées avec AES-256, la transmission s’effectue via TLS 1.3, et des mécanismes tels que l’autorisation basée sur les rôles, l’authentification multifacteur, le segmentation du réseau, des audits trimestriels et des tests d’infiltration annuels sont mis en œuvre.
- La plateforme déclare maintenir une conformité SOC 2 Type II et ISO 27001 ; les clients payants et entreprises peuvent demander un résumé de l’audit ou effectuer une due diligence ; l’acheteur doit vérifier le rapport actuel, la portée et la durée de validité.
- Les informations relatives aux comptes et aux factures peuvent être conservées à des fins juridiques et financières après la clôture du compte ; la durée typique indiquée dans la politique est de 7 ans, ce qui diffère de la durée de conservation des codes.
- La politique de zéro conservation pour les entreprises ne couvre que les contrats et les chemins de données correspondants ; les journaux, les métadonnées de facturation, les tickets d’assistance, les intégrations avec des tiers ainsi que les journaux des agents clients doivent encore être vérifiés un par un.
- La fuite de clés, les applications GitHub ayant des privilèges excessifs et l’exécution automatique des résultats des modèles augmentent les risques ; les environnements de production doivent donc utiliser le renouvellement des clés, les privilèges minimaux, l’exécution isolée et l’audit des opérations.
Droits de propriété intellectuelle et restrictions d’utilisation
- L’utilisateur conserve le droit de soumettre du code, du contenu et des données, et accorde à Morph une licence limitée pour traiter ces éléments aux fins de la prestation de services.
- Selon les conditions de l’EULA, l’utilisateur possède le résultat généré à partir de son contenu, mais Morph ne garantit pas que ce résultat ne viole pas les droits de tiers, et des résultats similaires peuvent être fournis à d’autres utilisateurs.
- La sortie ne doit pas être utilisée pour entraîner des modèles d’IA en concurrence avec Morph ; les équipes chargées de créer des ensembles de données d’entraînement, de distillation ou d’évaluation de produits doivent d’abord vérifier les limites du contrat.
- Morph conserve les droits de propriété intellectuelle sur le logiciel, les modèles, les algorithmes, les poids, les méthodes d’entraînement, l’interface et les améliorations ; la licence ne transfère pas la propriété du produit.
- Le code d’IA peut être imprecis, biaisé, inefficace ou présenter des vulnérabilités ; les conditions exigent que l’utilisateur le vérifie avant utilisation, et le service ne constitue pas de conseil professionnel.
Adapté aux utilisateurs et aux scénarios
- Développeur d’agent de codage : Intégrer des capacités de raisonnement, de recherche, d’édition, de compression et de surveillance aux agents propriétaires.
- IDE et outils de construction d’applications : il est nécessaire d’apporter rapidement des modifications locales et de renvoyer le fichier complet à l’éditeur ou au sandbox.
- Équipe de grands répertoires de code : utilisation de WarpGrep pour réduire le contexte pertinent, suivi de la planification et de la modification par le modèle principal.
- Agent de session longue durée : utilise Compact pour contrôler l’augmentation du contexte, et Reflex pour surveiller les boucles, les fuites et le découragement des utilisateurs.
- Plateforme multi-modèles : équilibre entre vitesse, qualité et coût entre les modèles à poids ouverts grâce à des interfaces compatibles et à un routeur.
- Entreprises à forte conformité : choix de GPU dédiés, zéro retention d’entreprise, hébergement dans le cloud privé ou hébergement entièrement auto-géré, avec confirmation par contrat des audits et des SLA.
Avantages et limites
- Regrouper l’inférence de conversation avec la recherche, l’édition, la compression et le classement du code sur une même plateforme permet de réduire l’intégration multi-fournisseurs des systèmes d’agent.
- Les interfaces compatibles avec OpenAI et Anthropic réduisent les coûts de migration, mais la structure des outils, la sémantique des erreurs et le comportement des modèles ne sont pas entièrement identiques.
- Les tarifs à la consommation couvrent les prototypes légers jusqu’aux GPU dédiés, offrant une flexibilité budgétaire ; de multiples unités de facturation augmentent également la complexité du calcul des coûts.
- Fast Apply et WarpGrep permettent de réduire les contextes inutiles et la réécriture de tout le fichier, mais une recherche ou une fusion erronée affecte encore directement le code.
- Le catalogue des modèles et les prix sont mis à jour rapidement ; il existe parfois des différences de version entre la page des prix actuels, les documents et les articles. Le système de production doit gérer dynamiquement la disponibilité des modèles.
- Les niveaux gratuit et payant standard ne sont pas sans réservation ; avant de traiter du code privé, il faut comprendre les règles relatives au support, au débogage, à l’anonymisation et aux métadonnées des comptes.
- Une partie des SDK, des plugins et des exemples sont open source, tandis que la plateforme complète, les modèles spécialisés et le noyau d’inférence restent des produits commerciaux.
Résumé
Morph convient pour transformer des agents de programmation par IA en équipes de développement de systèmes en production, et sa différenciation réside non seulement dans l’inférence des modèles, mais aussi dans la recherche de code, la fusion rapide, la compression du contexte et la classification des sessions.
Avant une adoption officielle, il convient d’utiliser un entrepôt réel pour valider la qualité et les coûts, tout en vérifiant la version du modèle, le prix, les droits des clés, les niveaux de données, les restrictions de sortie, les SLA ainsi que les plans de secours.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164