InnAIO lance un dictaphone IA en France
InnAIO lance deux produits : le dictaphone IA TransNote et le cadre photo intelligent Vinabot. Le Tr...
Le groupe OVH envisage l’acquisition de la start-up spécialisée dans l’IA vocale Gladia
Le groupe OVH (OVH Groupe) annonce être entré en négociations exclusives en vue d’acquérir Gladia, u...
Google lance le modèle de traduction vocale en temps réel Gemini 3.5 Live Translate
Le 9 juin, Google a annoncé le lancement de son modèle de traduction vocale en temps réel Gemini 3.5...
Microsoft lance une API de reconnaissance vocale côté client et les petits modèles de langage Aion pour Windows
Les 2 et 3 juin, Microsoft a publié une mise à jour des Windows AI APIs lors de la Build 2026, avec ...
Google lance une fonction de détection des appels frauduleux pour Android, capable d'identifier les arnaques par clonage vocal IA
Google a lancé une fonction de détection des appels frauduleux pour le système Android, afin de lutt...
AethexAI, une startup américaine, lève 3 millions de dollars pour l'IA vocale en Afrique et au Moyen-Orient
AethexAI, une startup spécialisée dans la création de produits d'IA vocale pour les marchés africain...
Le géant chinois JD.com a open-sourcé JoyAI-Echo, un framework de génération de vidéos longues avec audio
Le 3 juin, JD.com a lancé JoyAI-Echo, un framework de génération de vidéos longues avec audio, dont ...
Deepgram, en partenariat avec Fortanix et NVIDIA, oriente l'IA vocale locale vers le déploiement du calcul confidentiel
Récemment, l'entreprise américaine d'IA vocale en temps réel Deepgram a conclu un partenariat avec l...
Le modèle MAI-Transcribe-1.5 de Microsoft intègre Foundry, un modèle de transcription en 43 langues complète le flux de travail de l'IA vocale
Le 2 juin, Microsoft a dévoilé un nouveau membre de la famille de modèles MAI lors du Build 2026. Le...
L'application chinoise Soul App rend open source SoulX-Transcriber, un modèle de transcription de conversations multipartites intégrant la reconnaissance des locuteurs, des horodatages et du texte
Le 3 juin, l'équipe IA de Soul App (Soul AI Lab), en collaboration avec le groupe de recherche ASLP@...
Tencent Cloud et Soniox s'associent pour promouvoir l'IA vocale multilingue
Tencent Cloud a conclu un partenariat stratégique avec Soniox, une entreprise d'IA vocale basée à Sa...
NTT lance un cadre d'IA explicable multimodal pour le raisonnement, les modèles de langage visuel entrent dans une phase de calibration de sortie fiable
NTT a récemment annoncé la création du cadre de raisonnement d'IA explicable multimodal « Rationale-...
Tencent Cloud (Chine) s’associe à Soniox (États-Unis) pour intégrer la transcription vocale en temps réel aux infrastructures de communication mondiales
Tencent Cloud (Chine) a récemment conclu un partenariat stratégique avec Soniox, une entreprise spéc...
MiniMax lance le modèle M3 : un contexte d’un million de tokens propulse la compétition IA vers les agents à longues tâches
Le 1er juin, la société chinoise d’intelligence artificielle MiniMax a dévoilé son nouveau modèle gé...
xAI lance officiellement les API de synthèse vocale et de reconnaissance vocale Grok, avec un coût de traitement par lots de 0,10 $ par heure
xAI a annoncé le 17 avril, heure locale, le lancement officiel des API de reconnaissance vocale (STT...
ByteDance lance le modèle vocal full-duplex Seeduplex sur l'application Doubao
ByteDance a lancé le 9 avril le grand modèle vocal natif full-duplex Seeduplex, désormais déployé in...