Points clés
Numendo a conçu, réalisé et optimisé une plateforme cloud IA de pointe pour l’EBU, offrant flexibilité et robustesse pour l’intégration rapide d’applications innovantes. Grâce à une approche agile, des technologies avancées (Docker, AWS, Terraform, LLM) et une optimisation rigoureuse, cette plateforme renforce leur capacité d’innovation technologique en Europe.
phases clés d'intervention menées par une squad d'experts
technologies de pointe intégrées avec des méthodes RAG
CONTEXTE
intervention
Phase d’imagination
Numendo a organisé des ateliers collaboratifs afin d’imaginer l’architecture technique et fonctionnelle répondant précisément aux attentes de l’EBU. Une conception UX/UI complète a été réalisée sur Figma pour définir précisément les comportements attendus des applications. Enfin, Numendo a élaboré une architecture cible reposant sur des modèles LLM (LLama 2 et LLama 3), intégrant des méthodes avancées telles que le RAG (Retrieval-Augmented Generation).
Phase de réalisation
Numendo a pris en charge l’intégralité du setup technique, incluant l’infrastructure AWS, le front-end, le back-end et la gestion des données. Terraform a été utilisé pour gérer dynamiquement l’infrastructure et s’adapter rapidement aux montées en charge simultanées. Les briques IA ont été encapsulées dans des containers Docker utilisant FastAPI et Python, facilitant ainsi leur déploiement. Une couche d’authentification centralisée sécurisée par Keycloak a été mise en place, tandis que des modèles IA spécifiques ont été entraînés et affinés pour des applications telles que la reconnaissance faciale en vidéo et le traitement NLP avancé.
Phase d’optimisation
Numendo a procédé à une optimisation poussée des ressources AWS afin de réduire les coûts, notamment par la gestion intelligente de l’utilisation des machines. L’approche DevOps et une architecture logicielle robuste ont permis une transition fluide de la phase de preuve de concept à une infrastructure opérationnelle fiable et performante. Enfin, un accompagnement agile continu en squad intégrant des experts en data science et en dockérisation a été assuré pour garantir la gestion optimale des applications IA.
résultats
• lancer rapidement une plateforme cloud IA puissante et évolutive capable d’intégrer efficacement de nouvelles applications innovantes.
• déployer des solutions IA performantes en production, dont la reconnaissance faciale et l’analyse sémantique, avec des résultats précis et fiables.
• maîtriser les coûts d’exploitation grâce à une optimisation poussée de l’infrastructure cloud.
• accompagner un acteur européen majeur du secteur média dans la réalisation de ses ambitions technologiques et son positionnement innovant sur le marché.