Feijiang AI Studio
Plateforme d’apprentissage de l’IA offrant des ressources de calcul, des cours, des ensembles de données et des projets pratiques
Étiquettes :Site d’apprentissage de l’IAQu’est-ce que le Paddle AI Studio ?
Le Paddle AI Studio est une plateforme d’apprentissage, de développement et de partage en intelligence artificielle au sein de la communauté Paddle Star River de Baidu, destinée aux étudiants, ingénieurs en algorithmes, enseignants et développeurs industriels. Il regroupe dans un seul navigateur des cours en ligne, des projets publics, des ensembles de données, un espace de modèles, des notebooks, du training GPU, ainsi que le développement et le déploiement d’applications.
AI Studio s’appuie sur l’écosystème PaddlePaddle de Baidu, mais il peut également exécuter du Python standard, Jupyter et certains frameworks tiers. Ce n’est pas le même produit que Google AI Studio ; il convient de vérifier le nom de la plateforme ouverte Baidu AI ou de la communauté PaddlePaddle lors de la recherche et de la connexion.
Développement cloud sur Notebook
Le projet Notebook offre des environnements Linux, Jupyter et WebIDE, permettant aux utilisateurs d’exécuter du code, de traiter des données et d’entraîner des modèles sans avoir à installer CUDA localement. La plateforme met à disposition différentes ressources telles que des CPU, des DCU nationaux, ainsi que des NVIDIA V100, A100, etc. Le matériel réel disponible dépend du compte, des stocks et du type de projet.
Le Notebook est adapté aux tutoriels, à l’analyse de données, au raisonnement sur des modèles, à la fine ajustement et aux expérimentations. Les instances gratuites peuvent présenter des limites en termes de durée par utilisation, de quota hebdomadaire, de file d’attente et de récupération en cas d’inactivité ; les tâches longues doivent faire l’objet de sauvegardes régulières de points de contrôle et de journaux.
Projets, ensembles de données et communautés
Les utilisateurs peuvent créer des projets publics ou privés, publier des notebooks, des scripts, des instructions et les résultats d’exécution, ainsi que forker les projets d’autrui pour les modifier davantage. Le centre de données sert à télécharger, gérer et partager les données d’entraînement, et les projets peuvent directement intégrer des données communautaires.
Les projets et données publiques doivent disposer d’un droit de publication. Avant de les partager, il convient de supprimer les tokens, les mots de passe, les informations personnelles, les données clients et les fichiers protégés par le droit d’auteur, et d’indiquer dans la description du projet les dépendances, les modèles et les licences des données.
Cours et stages pratiques
AI Studio propose des cours d’introduction à PaddlePaddle, d’apprentissage automatique, de vision par ordinateur, de traitement du langage naturel, d’OCR, de grands modèles, de pratiques industrielles et de compétitions. Ces cours sont souvent accompagnés de notebooks pouvant être exécutés directement, ce qui facilite la configuration d’un environnement local.
La plateforme propose des cours gratuits, mais permet également aux institutions ou aux enseignants de publier des cours payants. La qualité des cours, la fréquence des mises à jour et les règles relatives aux certificats sont déterminées par le prestataire concerné ; il convient de consulter le programme, les connaissances préalables et la date de la dernière mise à jour avant d’acheter.
Espace du modèle
L’espace de modèles permet de créer, de télécharger, de descendre et d’exposer des modèles, ainsi que de consigner les versions, les tâches, les indicateurs et les instructions d’utilisation. La communauté couvre les modèles PaddlePaddle, les modèles industriels et les grands modèles, et peut être utilisée pour une expérience en ligne et le réutilisement de projets.
Le fait que la page du modèle existe ne signifie pas que Baidu garantit sa qualité en termes de poids, ses droits d’auteur ou sa licence commerciale. Avant utilisation, il convient de vérifier la carte du modèle, le modèle de base, les données d’entraînement, la licence et le matériel compatible.
Ligne de production de modèles et entraînement sans code
AI Studio propose des solutions sans code et des pipelines de code personnalisé, couvrant des tâches telles que la détection d’objets, le OCR, la reconnaissance de tableaux et l’analyse de documents. Les utilisateurs choisissent le jeu de données, les modèles pré-entraînés, les paramètres d’entraînement et les ressources de calcul, puis peuvent soumettre une tâche et consulter les journaux, les indicateurs et les résultats.
Le zero code abaisse la barrière à l’entrée, mais ne résout pas automatiquement les erreurs de annotation des données, le déséquilibre des catégories, les fuites et le surapprentissage. Une évaluation doit être effectuée avant le déploiement à l’aide d’un ensemble de test indépendant et de vrais échantillons métier.
Développement industriel de PaddleX
PaddleX est un outil de développement low-code intégré de Paddle, qui propose des pipelines de modèles pour l’OCR, la détection d’objets, la classification d’images, l’analyse de documents, les séries temporelles, le traitement du langage parlé, la vidéo et le 3D. AI Studio peut être utilisé en combinaison avec PaddleX pour accomplir le processus allant des données, de l’entraînement à le déploiement in fine.
PaddleX 3.x comprend de nombreux modèles prêts à l’emploi ainsi que des commandes unifiées, mais les poids des modèles spécifiques, leurs dépendances et le support matériel peuvent être mis à jour. Une mise en production doit retenir une version fixe et effectuer des tests de performance et de sécurité.
Développement et déploiement d’applications
La plateforme propose des applications sans code, des applications à fort niveau de codage, une API personnalisée ComfyUI, des ressources statiques et le déploiement de services de projet. Les développeurs peuvent emballer des modèles en démonstrations web ou en API, afin de les connecter au modèle Wenxin Da et à d’autres outils.
Le déploiement au sein de la communauté convient aux prototypes et aux démonstrations, et ne devrait pas disposer par défaut d’SLA d’entreprise. Une API publique nécessite une authentification, un contrôle du débit, une modération du contenu, un masquage des journaux, des alertes de coûts et un rollback de version.
Tâches de script et entraînement de modèles
Les tâches scriptées conviennent pour exécuter l’entraînement et le traitement par lots en dehors d’un Notebook interactif. Après soumission, il est possible de choisir les spécifications GPU, de consulter la file d’attente et les journaux en temps réel, puis de télécharger le modèle et les résultats une fois la tâche terminée.
Fermer le navigateur n’arrête pas nécessairement les tâches à distance, mais les sorties de la console ne pourront plus être affichées. Il est recommandé d’écrire les sorties standard et les journaux d’erreurs dans un répertoire persistant. Une configuration incorrecte ou une arrêt volontaire peuvent néanmoins consommer des ressources de calcul et des cartes gratuites.
Puissance de calcul gratuite
AI Studio offre des ressources de calcul gratuites grâce à des exécutions quotidiennes, des tâches de progression, un programme pour créateurs, des compétitions, des invitations et des événements d’opération. Les règles officielles pour les créateurs indiquaient que les utilisateurs débutants pouvaient obtenir 8 unités de calcul GPU par jour en exécutant des projets, tandis que les créateurs débutants, intermédiaires et avancés pouvaient obtenir respectivement 200, 400 et 800 unités ce mois-là, avec la possibilité de demander un soutien supplémentaire.
Les quotas gratuits, les types de cartes graphiques et les conditions d’obtention peuvent changer ; les offres mentionnées dans les anciennes nouvelles, telles que « GPU gratuit pendant 12 heures », ne constituent pas des avantages permanents actuels. Il convient de se référer au centre personnel, à la page des cartes de calcul et aux informations affichées lors du lancement d’une instance.
Comparaison des prix et des versions
| Forfait ou version | Prix, plafonds et avantages clés |
|---|---|
| Points de puissance de calcul et facturation en monnaie A | La monnaie A est une monnaie virtuelle utilisée par AI Studio pour échanger des ressources payantes telles que des GPU. Les prix de référence actuels pour les modèles sont les suivants : V100 32G, une carte : 3 unités de calcul par heure, soit 30 monnaies A par heure ; V100 32G, quatre cartes : 120 monnaies A par heure ; V100 32G, huit cartes : 240 monnaies A par heure. Certaines nouvelles fonctionnalités offrent gratuitement les trois premières utilisations d’une carte V100 32G par compte, pendant une période limitée ; les crédits ne sont pas remboursés en cas d’échec de l’entraînement ou d’arrêt volontaire. D’autres instances GPU disponibles incluent le V100 16G, l’A100, le DCU, etc. Les prix et les stocks sont indiqués sur la page d’accueil. |
| Règles pour les membres, la monnaie A et les tokens | AI Studio propose des abonnements, des paquets de monnaie A, des packs de ressources Token et des cartes journalières de puissance de calcul. Selon les règles officielles : la carte mensuelle est valable 31 jours, la carte trimestrielle 93 jours ; généralement, aucun remboursement n’est possible pendant la durée de l’abonnement ; la monnaie A offerte aux abonnés est distribuée selon le cycle d’exécution et n’est valable que pour le mois en cours, sans prolongation en cas d’expiration ; les paquets de monnaie A achetés séparément sont valables 365 jours, et aucun remboursement n’est généralement accordé après achat ; la facturation commence dès que les ressources payantes sont activées, et moins d’une minute est comptée comme une minute entière ; différents grands modèles entraînent une déduction de tokens à des taux différents, et les règles spécifiques peuvent être modifiées. La documentation officielle ne précise pas de prix fixe à long terme pour les abonnements ni le taux de conversion de la monnaie A en yuans ; le prix d’achat est indiqué sur la page de commande. Avant le lancement, il convient de vérifier le solde, les spécifications des ressources et les paramètres d’arrêt automatique. |
Points de puissance de calcul et facturation en monnaie A
La monnaie A est une monnaie virtuelle utilisée par AI Studio pour échanger des ressources telles que des GPU payants. Le prix d’exemple actuel pour la ligne de modèles est :
- V100 32G carte unique :3 unités de puissance de calcul/hour, ou 30 monnaie A/hour ;
- V100 32G à quatre cartes :120 A monnaie/heure ;
- V100 32G huit cartes :240 A par heure.
Certaines nouvelles fonctionnalités offrent à chaque compte trois abonnements gratuits et limités dans le temps pour V100 32G par carte ; en cas d’échec de l’entraînement ou d’arrêt volontaire, les crédits ne sont pas toujours remboursés. D’autres instances GPU disponibles incluent le V100 16G, l’A100, le DCU, etc. Les prix et les stocks sont indiqués sur la page de démarrage.
Règles pour les membres, la monnaie A et les tokens
AI Studio propose des abonnements, des portefeuilles A, des packs de ressources Token et des cartes journalières de puissance de calcul. Règles officielles :
- La carte mensuelle est valable 31 jours, la carte trimestrielle est valable 93 jours ; en général, aucun remboursement n’est possible pendant la durée de l’abonnement.
- Les jetons A offerts aux membres sont distribués selon le cycle d’exécution et ne sont valables que pour le mois en cours ; ils ne sont pas renouvelés après expiration.
- Le portefeuille de monnaie A acheté séparément est valable 365 jours, et le remboursement n’est généralement pas accordé après achat ;
- La facturation commence dès le démarrage réussi des ressources payantes ; si la durée est inférieure à une minute, elle est comptée comme une minute.
- Les différents grands modèles déduisent des tokens à des taux différents, et les règles spécifiques peuvent varier.
La documentation officielle ne fournit pas de prix fixe à long terme pour les abonnements ni pour le taux de change entre la monnaie A et le yuan. Le prix d’achat est indiqué sur la page de commande. Avant de lancer le programme, il convient de vérifier le solde, les spécifications des ressources et les paramètres d’arrêt automatique.
Token d’accès, SDK et CLI
La plateforme fournit des tokens d’accès, un SDK, une API et AI Studio CLI, permettant de télécharger et de téléverser des modèles, de soumettre des tâches d’entraînement, de gérer des projets et d’appeler des applications de grands modèles. Les tokens doivent être stockés dans des variables d’environnement ou un service de gestion de clés, et ne doivent pas être placés dans des notebooks publics.
Les appels via SDK ou CLI sont soumis aux droits d’accès du compte, aux quotas de ressources et aux restrictions réseau. Les tâches automatisées doivent gérer les tentatives répétées, l’idempotence, les journaux et les coûts, afin d’éviter des entraînements redondants.
Écosystème open source de PaddlePaddle
Le framework principal de PaddlePaddle ainsi que plusieurs outils officiels sont open source sur GitHub. Les projets représentatifs incluent Paddle, PaddleNLP, PaddleOCR, PaddleX, PaddleSpeech, PaddleMIX, PaddleDetection et PaddleSeg. La plupart des projets principaux sont licenciés sous la licence Apache 2.0, ce qui permet leur utilisation commerciale et leur modification conformément à cette licence.
La plateforme cloud AI Studio elle-même, les comptes, la monnaie A, les abonnements et le gestionnaire de ressources ne constituent pas un produit entièrement open source. Les modèles et données communautaires peuvent également être soumis à des licences personnalisées, de recherche ou non commerciales ; il ne faut pas en déduire automatiquement que toutes les ressources peuvent être utilisées à des fins commerciales simplement parce que le framework Paddle est sous licence Apache 2.0.
Sécurité des données
Le Notebook dans le cloud traite des fichiers de code, de données et de modèles. Avant de télécharger des données sensibles, il convient de vérifier l’autorisation de l’organisation, la région de stockage, les droits de partage et le mécanisme de suppression.
Ne mettez pas de bases de données de production, de clés et de données personnelles non masquées dans des projets publics.
Lors de la publication de projets Fork ou de l’installation de dépendances tierces, du code inconnu peut être exécuté ; il convient de vérifier l’origine, d’utiliser des versions fixes et d’appliquer les droits minimums. Les fichiers de modèles peuvent également contenir du contenu de sérialisation non sécurisé.
Guide d'utilisation de Feijiang AI Studio
Terminer une tâche de base
- Installer et configurer Paddle AI Studio, en créant des projets indépendants et des noms d’exécution pour les expériences ;
- Enregistrer les hyperparamètres, la version des données, la version du code et la graine aléatoire dans le script d’entraînement ;
- Initialiser les tâches de développement dans le cloud via Notebook et se connecter au service cloud ou privé approprié ;
- Enregistrer de manière continue les pertes, les indicateurs, les journaux et l’état du matériel à l’aide de projets, de datasets et de communautés ;
- Exécuter un entraînement à petite échelle pour vérifier que le nombre d’itérations, les unités, les courbes et les échantillons multimédias sont corrects ;
- Après achèvement, enregistrer le modèle, les paramètres, les résultats ainsi que la description de l’expérience reproductible ;
Créer des flux de travail professionnels réutilisables
- Unifier les normes de nommage des projets, des expériences, des indicateurs et des étiquettes ;
- Intégrer le développement cloud de Notebook, les projets, les ensembles de données, ainsi que la communauté et les cours et stages dans le modèle de formation ;
- Établir des liens de version pour les ensembles de données, le code, l’environnement et les modèles ;
- Utiliser le même ensemble d’évaluation et les mêmes conditions expérimentales pour comparer, afin d’éviter de ne se baser que sur des courbes lissées ;
- Restreindre la portée du téléchargement des échantillons sensibles, des prompts et des sorties du modèle ;
- Définir les alertes d’anomalies, les stratégies de conservation et la révision manuelle avant de les déployer à l’équipe ;
À qui s’adresse-t-il ?
- Étudiants qui n’ont pas de GPU local et qui ont besoin d’un notebook cloud pour apprendre l’IA ;
- Développeurs qui apprennent PaddlePaddle, l’OCR, la vision, le NLP et les grands modèles ;
- Enseignants et créateurs qui publient des cours, des projets, des modèles et des ensembles de données ;
- Équipe qui valide les modèles industriels à l’aide de la ligne de production sans code PaddleX ;
- Chercheurs participant à des compétitions d’algorithmes et effectuant du training sur GPU ;
- Les entreprises ayant besoin de frameworks nationaux et de solutions de déploiement sur plusieurs types de matériel.
Restrictions et précautions
- Les ressources de calcul gratuites peuvent être en file d’attente, avoir une durée limitée et varier, ce qui ne garantit pas leur disponibilité à long terme ;
- Le coût de l’entraînement dépend non seulement du prix indiqué, mais aussi des données, des époches, du nombre de cartes, des tentatives de réessai en cas d’échec et du nombre de réglages paramétriques ;
- Le succès de l’entraînement en ligne ne signifie pas que le modèle peut être mis en production directement ;
- Il reste à vérifier la précision, la déviation, la robustesse, le délai de raisonnement, l’utilisation des ressources, les licences et la sécurité du contenu ;
Questions fréquentes
Est-ce que le FeiJiang AI Studio est gratuit ?
Les communautés de base, les cours et une partie de la puissance de calcul des Notebook sont gratuits ; les GPU haute performance, les abonnements, la monnaie A, les tokens et une partie des déploiements relèvent de services payants ou à quota.
Combien coûte le V100 32G ?
L’exemple actuel de la ligne de production du modèle est de 30 A-monnaie/hour par carte, soit 3 unités de puissance de calcul/hour ; 120 A-monnaie/hour avec quatre cartes, et 240 A-monnaie/hour avec huit cartes.
La monnaie A expire-t-elle ?
Les jetons A offerts aux membres sont généralement valables uniquement pour le mois en cours ; les forfaits de jetons A achetés séparément sont valables 365 jours.
Les ressources achetées et consommées ne sont généralement pas remboursables.
Est-il possible d’exécuter PyTorch ?
Notebook est un environnement Python/Linux universel ; certains environnements permettent d’installer des frameworks tiers, mais l’optimisation officielle et les cours sont principalement axés sur PaddlePaddle, il convient donc de vérifier la compatibilité de CUDA et des dépendances.
AI Studio est-il open source ?
La plateforme cloud n’est pas un produit entièrement open source ; les outils clés tels que PaddlePaddle, PaddleNLP, PaddleOCR et PaddleX sont open source sous licence Apache 2.0.
Numéro d’enregistrement de sécurité publique du Guangxi : 45132202000164