Navan AI
Navan AI, outil intelligent spécialisé dans la programmation en IA
Étiquettes :Outils de programmation IAQu’est-ce que Navan AI ?
Navan AI est actuellement une équipe qui propose des produits d’ingénierie en IA par agence ainsi que le développement de applications GenAI sur mesure, s’adressant aux startups et aux entreprises.
Il ne s’agit pas du même produit que la plateforme de gestion des voyages d’affaires et des dépenses du même nom ; l’outil de développement principal du site actuel est SAM, qui propose en plus des services de définition des besoins, d’architecture d’agence, de mise en œuvre, de déploiement et d’optimisation continue.
Produit phare SAM
SAM, pour Smart Agent Manager, est un processus de développement multi-agents qui transforme des idées de produits ou des PRD en projets logiciels testés, examinés et documentés.
Il s’installe dans les projets des utilisateurs via une ligne de commande locale et des paramètres de proxy, et appelle la plateforme de proxy de programmation choisie par l’utilisateur, plutôt qu’un générateur de code en un clic hébergé sur la page web de Navan AI.
Le flux de travail de la demande au code
- quick-prd : Génère rapidement un PRD à partir d’idées succinctes, en utilisant des hypothèses clairement indiquées pour les informations manquantes, idéal pour établir au préalable un projet de discussion.
- Champ d’application : effectuer une découverte complète par le biais des produits, de l’expérience et des problèmes techniques, en laissant les questions non résolues en tant que problèmes ouverts.
- Plan : Vérifier le PRD, concevoir d’abord un contrat typé inter-fichiers, puis le décomposer en épopées, histoires, conditions de validation et dépendances.
- build-tdd : exécute pour une histoire individuelle le test d’abord, la mise en œuvre minimale, l’examen et la refonte, puis ajoute des vérifications d’expérience utilisateur, de style, d’accessibilité ou de sécurité selon le type de projet.
- plan-n-build : planification combinée et mise en œuvre de toutes les histoires, permettant de passer progressivement d’un PRD complet à du code, des tests, de la documentation et des archives de publication.
- Étendre : ajouter des fonctionnalités après la première version, mettre à jour les versions du contrat, les historiques des modifications ainsi que le PRD, adapté aux itérations de projets existants.
TDD strict et seuils de qualité
- Titan commence par écrire des tests d’échec pour chaque condition de validation ; il ne passe à l’étape suivante que lorsque le test échoue parce que la fonction n’a pas encore été mise en œuvre.
- Dyna écrit la mise en œuvre minimale permettant de faire passer les tests, tout en exécutant la compilation et les tests ; en cas d’échec, elle apporte des corrections selon un nombre limité d’essais.
- Argus effectue des revues de code en contraste sur la sécurité, les performances et la maintenabilité, afin de refactorer tout en maintenant le succès des tests.
- Les projets Web peuvent continuer à être vérifiés par Iris, Cosmo et Aria en ce qui concerne l’expérience utilisateur, la cohérence du style et l’accessibilité ; l’audit de sécurité Sentinel doit être activé explicitement.
- Une fois l’histoire intégrée validée, Lens utilise un vrai navigateur pour générer des vidéos, des captures d’écran, des preuves provenant du réseau et de la console, tandis que Sage complète par un journal des modifications et une documentation fonctionnelle.
Produits de projet auditable
- Le PRD, la description de l’architecture, les contrats, les épopées, les histoires et l’état de fonctionnement sont stockés dans le répertoire du projet, permettant à l’équipe de consulter directement les hypothèses adoptées par l’agent ainsi que l’avancement actuel.
- L’interface inter-histoires est d’abord écrite sous forme de contrat typé, les parties productrices et consommatrices déclarent leurs dépendances, ce qui réduit les écarts dans les définitions des champs ou des événements entre le front-end et le back-end.
- Le fichier d’état enregistre l’état de chaque histoire : ready, in-progress, done ou blocked. Après une interruption d’une tâche longue, il est possible d’utiliser un processus de reprise pour la continuer.
- Enregistrer les preuves de manière intégrée au lieu de se contenter d’une déclaration textuelle indiquant que « le test a réussi », mais ces preuves doivent néanmoins être examinées par le responsable de maintenance et ne peuvent pas remplacer l’acceptation manuelle ni le suivi de la production.
Rôle d’agent
| agent | Principales responsabilités | Entrée typique | Sortie principale |
|---|---|---|---|
| SAM | Coordonner le processus complet, les états et les portes de qualité | Idées, PRD ou histoire existante | Planification par phase et état de fonctionnement |
| Quill | Élaborer rapidement un projet de demande de produit | Idées courtes et contraintes | PRD contenant des hypothèses explicites |
| Iris et Atlas | Découverte de l’expérience, faisabilité technique et conception architecturale | Demandes, bibliothèque de code et problèmes ouverts | Améliorer le PRD, les risques et les contrats typés |
| Titan, Dyna et Argus | Exécuter RED, GREEN, REFACTOR | Histoire et conditions d’acceptation | Tests échoués, code de mise en œuvre et corrections de révision |
| Cosmo, Aria et Sentinel | Style, accessibilité et vérification de sécurité optionnelle | Interface web et dépendances | Liste des problèmes et corrections |
| Sage et Lens | Documents, historique des modifications et preuves provenant du navigateur réel | Mise en œuvre terminée | Documents, vidéos, captures d’écran et journaux de fonctionnement |
La page du produit actuel utilise toujours sept agents pour présenter les processus initiaux, tandis que le dernier entrepôt liste treize rôles professionnels et ajoute des capacités telles que Quill, Cosmo, Aria, Sentinel, Upkeep et Lens.
C’est un signe que le site n’est pas synchronisé avec la version du code ; en pratique, il convient de se référer aux instructions relatives à la version installée, au répertoire du proxy et aux archives de publication.
Guide d’installation et d’utilisation
- Préparez Node.js 16 ou une version ultérieure, et installez au moins l’un de ces outils : Claude Code, Cursor, Gemini CLI, GitHub Copilot ou Google Antigravity.
- Exécutez d’abord la démonstration intégrée à SAM pour visualiser les applications de exemple, les contrats, les histoires, les tests et la structure des preuves dans le navigateur, sans faire appel à un grand modèle.
- Exécutez l’installation interactive dans la bibliothèque de code cible, ou sélectionnez explicitement la plateforme correspondante ; l’outil écrira les configurations d’adaptation du proxy, du flux de travail et de la plateforme.
- Lorsqu’un PRD existe déjà, exécutez d’abord le plan ; en l’absence de document de cahier des charges, commencez par quick-prd ou scope, et vérifiez un par un les hypothèses, les questions en suspens et les conditions d’acceptation.
- Avancer par histoires avec build-tdd, ou exécuter en continu avec plan-n-build ; pour les projets à haut risque, activer les vérifications de sécurité et définir des limites d’approbation manuelle.
- Vérifier les contrats générés, le code source, les tests, les dépendances, les licences et les preuves, puis le groupe effectue l’évaluation du code, la configuration des clés, le déploiement et la validation en ligne.
Différences de plateformes et d’installation prises en charge
| Plateforme | Forme d’accès | Caractéristiques d'utilisation |
|---|---|---|
| Claude Code | Commande barre oblique | Appel des workflows via la commande SAM |
| Cursor | Mention de l’agent et configuration des règles | Sélectionnez des agents tels que quick-prd, plan ou build-tdd dans la session de l’éditeur. |
| Gemini CLI | Catalogue des compétences | Installer le flux de travail en tant que compétence locale |
| GitHub Copilot | Instructions d’intégration | Déclencher le flux de travail correspondant via une instruction Copilot |
| Google Antigravity | Compétences en représentation | Commandes de compétences utilisant le préfixe SAM |
SAM ne fournit pas de quota de modèle de base ; les modèles réellement disponibles, la fenêtre de contexte, les permissions des outils ainsi que les frais dépendent de la plateforme et de l’abonnement choisis par l’utilisateur.
Prix, logiciels libres et services commerciaux
| Forfait ou version | Prix | Période de facturation | Droits ou crédit principal | Adéquat pour les utilisateurs |
|---|---|---|---|---|
| Outils open source SAM | Gratuit | Pas de abonnement | Licence MIT, incluant des définitions d’agents, six types de flux de travail, un installateur, des exemples et des modèles de projets | Développeurs disposés à configurer eux-mêmes des agents de programmation et à auditer du code |
| Agents de programmation de bas niveau et modèles | Décidé par le fournisseur sélectionné | Abonnement ou payant | L’inférence de modèle, le contexte, les outils et la quantité d’exécution de code ne sont pas fournis par SAM. | Personnes et équipes qui exécutent le flux de travail SAM |
| Développement sur mesure Navan AI | Contacter l’équipe pour une offre sur mesure | Selon le projet ou les termes du contrat | Découverte et stratégie, architecture d’agent, mise en œuvre, déploiement, surveillance, optimisation et support | Les entreprises ayant besoin de personnaliser des systèmes GenAI |
- La licence MIT autorise l’utilisation, la modification et la distribution du code SAM, mais il est impératif de conserver la licence et la notice de droits d’auteur, et le logiciel est fourni tel quel.
- Le fait que SAM soit open source ne signifie pas que les services sur mesure de Navan AI, le code livré aux clients, niia et d’autres produits ou modèles tiers soient également sous licence MIT.
- Les coûts de fonctionnement comprennent également les outils de programmation IA choisis, les appels aux modèles, l’infrastructure de test, l’automatisation des navigateurs, les ressources cloud et le temps consacré à la révision technique.
- Le site principal actuel ne divulgue pas de prix fixes pour les services sur mesure, d’essai gratuit, de quotas d’utilisation ni de règles uniformes de remboursement ; les entreprises doivent les confirmer dans la proposition de prix et le contrat de service.
Adapté aux utilisateurs et aux scénarios
- Les équipes de logiciels qui disposent déjà de critères d’acceptation clairs souhaitent intégrer le TDD, les revues, la documentation et les preuves d’intégration dans leurs processus.
- Les équipes qui ont besoin de réutiliser des protocoles de développement similaires entre Claude Code, Cursor, Gemini CLI, Copilot et Antigravity.
- On espère d’abord que l’IA analysera le PRD, les contrats et les histoires, puis que les ingénieurs approuveront progressivement les produits et les responsables techniques à mettre en œuvre.
- Clients entreprises qui ont besoin de personnaliser plusieurs agents, une base de connaissances, l’intégration de systèmes métier et le déploiement d’infrastructures privées.
Limites des capacités et risques
- Le site du produit affirme que le processus peut se dérouler sans aucune intervention humaine, mais le système de production nécessite néanmoins une validation humaine pour les besoins, l’architecture, la sécurité, les licences, la migration des données et les résultats de publication.
- Le TDD ne peut valider que le comportement des tests déjà écrits ; des exigences erronées, des conditions d’acceptation omises, des assertions faibles ou un environnement de test non réaliste peuvent encore engendrer une confiance erronée.
- SAM écrira des configurations et des fichiers de génération dans le projet ; avant utilisation, il convient de créer une branche distincte, de vérifier l’état de l’espace de travail et de limiter les clés accessibles par l’agent ainsi que les ressources en production.
- Les différents agents de programmation traitent les commandes, les permissions et le contexte de manière différente, et la même PRD peut donner naissance à des implémentations différentes sur des plateformes variées.
- L’analyse des dépendances et les agents de sécurité ne peuvent pas remplacer les tests d’infiltration professionnels, les évaluations de conformité, les scans de la chaîne d’approvisionnement et les audits manuels du code.
Confidentialité, sécurité et précautions relatives aux données
- SAM s’exécute principalement dans des projets locaux, et son flux de données est déterminé conjointement par les agents de programmation de base, les fournisseurs de modèles, les plateformes de hébergement de code et les paramètres configurés par l’utilisateur.
- Le PRD, le code source, les journaux et les données de test peuvent être envoyés au service d’IA sélectionné ; il convient de vérifier avant l’intégration les conditions relatives à l’entraînement, au stockage, aux données géographiques et aux données d’entreprise du fournisseur correspondant.
- Actuellement, le site principal de Navan AI ne publie pas de politique de confidentialité complète, d’annexes relatives au traitement des données, de certifications de sécurité ni de durée de conservation uniforme applicables à tous les services sur mesure.
- Le sous-produit SODA du site gère séparément les comptes GitHub, les projets, les métadonnées des dépôts ainsi que la consommation de modèles, et supprime les données personnelles dans un délai de 30 jours après une demande de suppression ; cette politique ne peut pas être considérée automatiquement comme les conditions générales de SAM ou de tous les services sur mesure.
- Lors des achats d’entreprise, il convient de convenir par écrit de la propriété des codes, de l’utilisation des indications et des résultats, du fournisseur du modèle, du lieu de stockage des données, des sous-traitants, de la confidentialité, de la suppression, de la réponse aux vulnérabilités et de la fin de la livraison.
Description de la marque et de son état actuel
Les documents anciens décrivaient Navan AI comme une plateforme de vision par ordinateur sans code ou une plateforme d’IA pour le e-commerce de mode, tandis que le site principal actuel est passé à l’ingénierie logicielle agnostique, et présente SAM ainsi que des produits d’accueil basés sur l’IA destinés aux salons comme produits phares.
L’évaluation doit se baser sur la page actuelle et l’entrepôt en activité ; il ne faut pas appliquer directement les fonctionnalités historiques, les plateformes de voyages portant le même nom ou les capacités e-commerce présentes dans des catalogues tiers à Navan AI actuel.
Résumé
La particularité de Navan AI n’est pas un modèle unique de complétion de code, mais plutôt l’organisation des exigences, des contrats, des histoires utilisateurs, des tests, de la mise en œuvre, de l’examen, de la documentation et des preuves provenant du navigateur en un protocole d’ingénierie multi-agents réutilisable.
SAM convient aux équipes de développement souhaitant avoir le contrôle du code local et des modèles de base ; pour les projets sur mesure pour les entreprises, il convient de préciser avant le lancement les conditions relatives aux prix, aux données, à la sécurité, aux droits de propriété intellectuelle et à la validation de la livraison.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164