fr.wedoany.com Rapport : Le sud-coréen Cafe24 a récemment lancé un routeur pour grands modèles de langage (LLM) capable de connecter plus de 120 modèles d’IA générative, et de sélectionner automatiquement le modèle le plus adapté à des tâches telles que le codage, la traduction ou la création, en fonction des requêtes des utilisateurs.

Avec la généralisation du « multihébergement » des IA génératives comme ChatGPT, Claude, Gemini ou DeepSeek, les utilisateurs doivent comparer et choisir eux-mêmes les modèles, ce qui alourdit leur charge. Le routeur LLM de Cafe24 intègre ces modèles via une interface de programmation d’applications (API), afin de réduire cette charge décisionnelle.
Les opérateurs de services peuvent définir les modèles utilisés selon des critères tels que le type de tâche, le coût, la vitesse de réponse ou les performances, et activer un basculement automatique vers un autre modèle prédéfini en cas de défaillance, garantissant ainsi la continuité des tâches.
Le marché de l’IA générative connaît un « paradoxe du choix » : une offre accrue peut entraîner des retards de décision ou une moindre satisfaction après sélection. Chaque IA ayant ses atouts, les utilisateurs alternent entre plusieurs services selon les besoins (traduction, recherche, codage, etc.), mais la comparaison des modèles et la répétition des mêmes requêtes allongent le temps de décision. Cafe24 a lancé ce routeur LLM précisément pour résoudre ce problème, permettant aux utilisateurs de se concentrer sur la tâche elle-même sans avoir à choisir un modèle.
Selon l’« Enquête 2025 sur l’état des activités de communication additionnelles » du ministère sud-coréen des Sciences et des TIC, 53,2 % des utilisateurs d’IA générative utilisent simultanément plus de deux services, le multihébergement étant déjà répandu. À l’étranger, les services d’intermédiation entre modèles d’IA ont déjà formé un marché : par exemple, OpenRouter, fondé en 2023, propose via une API plus de 400 modèles d’IA générative de plus de 70 entreprises, et traiterait plus de 100 000 milliards de tokens par mois, avec plus de 10 millions d’utilisateurs dans le monde.

Cafe24 fait son entrée sur le marché sud-coréen de l’intermédiation en IA générative avec ce routeur LLM. Son objectif est de fournir un environnement où les modèles sont automatiquement attribués en fonction de l’objectif, du coût, de la vitesse et des performances de la tâche, et d’améliorer l’efficacité opérationnelle et la stabilité des services d’IA générative grâce à la sélection automatique des modèles et au basculement automatique en cas de panne, aidant ainsi les utilisateurs à se concentrer sur la tâche à accomplir.










