Cours
L'intelligence artificielle (IA) est extrêmement puissante, mais elle s'appuie souvent sur des serveurs cloud distants pour les calculs lourds. Cette approche pose problème pour les usages nécessitant des réponses immédiates ou sur des appareils aux ressources limitées.
Imaginez une voiture autonome attendant qu'un serveur cloud lui dise dans quelle voie se rabattre : pas idéal !
L'edge AI résout ce problème en amenant les capacités d'IA directement sur l'appareil lui-même.
Devenez un scientifique ML
Qu'est-ce que l'edge AI ?
L'edge AI consiste à déployer des modèles et algorithmes d'IA directement sur des dispositifs en périphérie, situés à la lisière du réseau, au plus près des sources de données et des actions à mener.
Ces dispositifs couvrent un large éventail, des serveurs en périphérie très puissants aux capteurs IoT contraints en ressources, et incluent des exemples familiers comme les smartphones, appareils domestiques intelligents, véhicules autonomes ou encore robots industriels.
Les récents progrès en IA, comme le développement de modèles de langage plus compacts et efficaces tels que GPT-4o Mini, Llama 3.1 8B et Gemma 2 2B, accélèrent encore l'adoption de l'edge AI.
Ce passage à l'edge AI offre plusieurs avantages :
- Vitesse : décisions et actions se font en temps réel, là où la donnée est produite. C'est indispensable pour des applications comme les voitures autonomes ou les dispositifs médicaux qui ne peuvent supporter les délais liés à l'envoi des données dans le cloud.
- Confidentialité : les données sensibles peuvent être analysées localement sans être transmises au cloud, renforçant sécurité et vie privée.
- Fiabilité : l'edge AI réduit la dépendance à une connexion Internet constante, ce qui la rend plus fiable dans les zones à connectivité limitée ou instable.
- Efficacité : traiter les données localement réduit la bande passante nécessaire pour tout envoyer dans le cloud, ce qui permet d'économiser énergie et coûts.
Comment fonctionne l'edge AI
Pour comprendre le fonctionnement de l'edge AI, examinons ses principaux composants et processus.
Composants clés
L'edge AI regroupe trois composantes principales : les dispositifs en périphérie, les modèles d'IA et la communication.

Dispositifs en périphérie
Les dispositifs en périphérie couvrent une vaste gamme de matériels, des serveurs edge capables de charges de calcul importantes jusqu'aux capteurs IoT très limités, conçus pour des tâches ciblées.
On y trouve des smartphones, drones, véhicules autonomes, robots industriels et appareils domestiques intelligents, tous capables d'exécuter localement des modèles d'IA pour traiter les données en temps réel. Certains fabricants, comme NVIDIA et Intel, proposent même un support matériel pour déployer des modèles de ML en périphérie.
Modèles d'IA
L'edge AI utilise divers types de modèles d'IA, dont l'apprentissage automatique, le deep learning et des algorithmes de vision par ordinateur, optimisés pour une exécution efficace en périphérie.
Ces modèles sont adaptés aux contraintes de l'edge afin de rester performants malgré une puissance de calcul, une mémoire et un stockage limités.
Par exemple, des modèles comme GPT-4o Mini et Llama 3.1 8B sont spécifiquement conçus pour être légers et efficaces, ce qui les rend adaptés aux déploiements en périphérie.
Communication
L'échange de données entre appareils en périphérie et cloud repose sur des protocoles comme MQTT et les API REST. Ils assurent une connectivité fluide et des transferts de données efficaces, permettant une synchronisation entre dispositifs edge et systèmes centraux lorsque nécessaire. Ces protocoles autorisent des transmissions compressées quasi sans perte afin de préserver l'information essentielle.
MQTT (Message Queuing Telemetry Transport) est un protocole de messagerie léger conçu pour des appareils contraints et des réseaux à faible bande passante, forte latence ou peu fiables. Il s'appuie sur un modèle publication-abonnement, permettant d'envoyer (publier) et de recevoir (s'abonner à) des messages sans connexion directe. Idéal pour l'IoT, il assure des communications efficaces et robustes.
L'API REST (Representational State Transfer Application Programming Interface) est un style d'architecture pour concevoir des applications en réseau. Elle utilise des requêtes HTTP pour accéder aux données et les exploiter. Les API REST sont sans état (stateless) : chaque appel contient toutes les informations nécessaires au serveur pour traiter la demande. Elles sont donc évolutives et adaptées à de nombreux services web, y compris ceux impliquant des dispositifs en périphérie.
Le processus
Le flux de travail de l'edge AI se déroule en trois étapes : collecte de données, traitement, action.

Collecte de données
Les dispositifs edge collectent en continu des données depuis des capteurs, caméras ou autres sources, générant un flux constant d'informations. Ces données vont des mesures environnementales et paramètres de santé jusqu'aux flux vidéo et enregistrements audio, servant de base aux analyses en temps réel.
Un bon exemple : votre montre connectée qui enregistre le nombre de pas effectués aujourd'hui.
Traitement des données
Les modèles d'IA déployés sur les appareils en périphérie traitent localement les données collectées. Cette étape consiste à analyser les données pour en extraire des insights, détecter des schémas et produire des prédictions sans recourir aux ressources cloud.
Le traitement local garantit une prise de décision rapide, par exemple lorsqu'une voiture autonome choisit sa voie en temps réel.
Action en temps réel
Selon la sortie du modèle, les dispositifs edge peuvent agir immédiatement : déclencher une alerte, ajuster une trajectoire ou envoyer des données dans le cloud pour analyse complémentaire. Cette capacité d'action instantanée est essentielle dans des scénarios comme la sécurité ou les dispositifs médicaux.
Applications concrètes de l'edge AI
L'edge AI transforme de nombreux secteurs en permettant l'intelligence et la décision en temps réel. Voici quelques applications marquantes.
Industrie manufacturière
En production, les arrêts d'équipement coûtent cher. L'edge AI y répond en surveillant l'état des machines et en prédisant les pannes potentielles avant qu'elles ne surviennent. En analysant en temps réel les données capteurs, les modèles d'IA détectent les anomalies et alertent les équipes de maintenance pour une intervention préventive. On réduit ainsi les arrêts et on prolonge la durée de vie des machines.
Garantir la qualité des produits est primordial. Des caméras dopées à l'IA en périphérie inspectent les produits en temps réel pour repérer les défauts. Elles analysent les images pour identifier rayures, bosses ou erreurs d'assemblage. En automatisant le contrôle, les industriels gagnent en précision, constance et efficacité, au bénéfice de la qualité et de la satisfaction client.
Santé
Le secteur de la santé bénéficie largement de l'edge AI. Des appareils portables dotés d'edge AI peuvent analyser des images médicales (radios, IRM, scanners) pour accélérer le diagnostic. Cette capacité est précieuse dans les zones éloignées ou sous-dotées où les spécialistes sont rares. Le traitement local réduit les délais, favorisant une prise en charge rapide et de meilleurs résultats pour les patients.
Les objets connectés embarquant de l'edge AI révolutionnent le suivi en permettant une surveillance continue des paramètres de santé. Ils collectent fréquence cardiaque, tension, glycémie, etc., et analysent ces données en temps réel pour détecter les anomalies. En cas de situation critique, une alerte est envoyée immédiatement aux soignants. Cette approche proactive aide à gérer les maladies chroniques, détecter précocement les problèmes et réduire les hospitalisations.
Retail
Une gestion des stocks efficace est cruciale dans le retail. Des caméras et capteurs dopés à l'IA suivent les niveaux de stock en temps réel pour garder les rayons remplis. En analysant ces données, l'edge AI optimise le réassort, réduit le gaspillage et évite les ruptures. Résultat : satisfaction client en hausse et coûts d'inventaire en baisse.
Comprendre le comportement des clients est clé pour offrir des expériences d'achat personnalisées. L'edge AI analyse les données des caméras et capteurs en magasin pour dégager des insights sur les préférences et comportements, puis proposer des recommandations et promotions ciblées. La personnalisation enrichit l'expérience, fidélise et stimule les ventes.
Villes intelligentes
Gérer le trafic urbain est une tâche complexe qui exige des analyses en temps réel. L'edge AI optimise les flux en exploitant les données des caméras, capteurs et GPS. En détectant les schémas de congestion et en prédisant les conditions, elle ajuste les feux, propose des itinéraires alternatifs et diffuse des mises à jour aux conducteurs. À la clé : trafic plus fluide, temps de trajet réduit et sécurité renforcée.
Assurer la sécurité publique est une priorité. Des systèmes de vidéosurveillance intelligents en périphérie surveillent les espaces publics, détectent les anomalies et identifient les menaces potentielles. Ils analysent les flux vidéo en temps réel pour reconnaître des activités suspectes (accès non autorisé, bagages abandonnés). En alertant rapidement les autorités, l'edge AI renforce la sécurité et accélère la réponse aux incidents.
Edge AI : solutions matérielles et logicielles
Mettre en œuvre l'edge AI requiert la bonne combinaison de matériel et de logiciel. Voici quelques options populaires :

Plateformes matérielles
Pour réussir vos projets d'edge AI, vous aurez besoin de plateformes matérielles capables d'exécuter efficacement des modèles en périphérie. Voici quelques pistes :
- NVIDIA Jetson : NVIDIA Jetson est une plateforme puissante pour l'IA en périphérie, offrant une haute performance de calcul. Très utilisée en robotique, villes intelligentes et santé, elle fournit la puissance nécessaire pour exécuter localement des modèles complexes, idéale pour les déploiements edge.
- Google Coral : Google Coral propose des dispositifs conçus pour des déploiements edge rapides et efficaces. Ils accélèrent l'inférence en apprentissage automatique, adaptés à la vision par ordinateur et à l'IoT. Coral est réputé pour sa simplicité d'usage et son intégration avec les frameworks d'IA courants.
- Intel Movidius : Intel Movidius est reconnu pour son efficacité énergétique, idéale pour les applications de vision. Il prend en charge les charges de deep learning et de vision par ordinateur sur les dispositifs edge, permettant un traitement en temps réel avec une consommation minimale. On le retrouve notamment dans les drones, caméras de sécurité et appareils domestiques intelligents.
Cadres logiciels
Au-delà du matériel, des frameworks logiciels robustes sont essentiels pour développer et déployer des applications d'edge AI. Voici quelques références :
- TensorFlow Lite : version allégée de TensorFlow, optimisée pour le mobile et l'edge. Elle permet de déployer efficacement des modèles de ML sur des appareils contraints. TensorFlow Lite couvre un large éventail d'usages, de la classification d'images au traitement du langage naturel.
- PyTorch Mobile : permet de déployer des modèles PyTorch sur mobile et en périphérie. Il prend en charge la vision, la reconnaissance vocale et les systèmes de recommandation. PyTorch Mobile est apprécié pour sa flexibilité et sa facilité d'intégration avec les workflows PyTorch existants.
- ONNX (Open Neural Network Exchange) : format open source pour les modèles d'IA, ONNX facilite le transfert de modèles entre frameworks. Particulièrement utile en edge AI, il permet d'exploiter des modèles préentraînés sur diverses plateformes, dont TensorFlow et PyTorch. ONNX Runtime est optimisé pour la performance sur les appareils en périphérie.
- Edge Impulse : plateforme dédiée au développement d'edge AI, avec des outils pour la collecte de données, l'entraînement et le déploiement, simplifiant la création de solutions edge. Edge Impulse prend en charge de nombreux matériels et offre une interface intuitive.
Défis et points de vigilance
Si l'edge AI présente de multiples atouts, elle soulève aussi plusieurs défis à relever :
- Ressources limitées : exécuter des modèles complexes sur des appareils à puissance, mémoire et stockage restreints est difficile. Il faut optimiser les modèles pour équilibrer performance et consommation de ressources. Des techniques comme la quantification, le pruning et la distillation des connaissances réduisent la charge de calcul et l'empreinte mémoire.
- Contraintes énergétiques : les appareils edge, notamment sur batterie, exigent des algorithmes et matériels sobres en énergie. Préserver l'autonomie tout en maintenant les performances est crucial pour une adoption large. Conception matérielle basse consommation, algorithmes économes et gestion dynamique de l'énergie sont essentiels pour minimiser la consommation sans sacrifier la performance.
- Sécurité et confidentialité des données : le traitement de données sensibles en périphérie impose des mesures de sécurité robustes. Protéger les données et respecter les réglementations comme le RGPD est essentiel pour maintenir la confiance et prévenir les fuites. Chiffrement, secure boot et environnements d'exécution de confiance figurent parmi les techniques courantes.
Conclusion
L'edge AI marque une évolution majeure dans la façon de déployer et d'exploiter l'intelligence artificielle.
En rapprochant le calcul des sources de données, elle répond aux limites de l'IA basée sur le cloud : latence, confidentialité et coûts de bande passante.
Les avancées matérielles et logicielles, dont des modèles plus petits et plus efficaces, stimulent son essor dans de nombreux secteurs.
L'edge AI promet un futur où des appareils et applications intelligents s'intègrent naturellement à notre quotidien, plus rapides, plus sûrs et plus réactifs.
Obtenez une certification de haut niveau en matière d'IA
Ingénieur GenAI senior et créateur de contenu qui a recueilli 20 millions de vues en partageant ses connaissances sur la GenAI et la science des données.
