Catégorie: Ingénierie du traitement du langage

InnAIO lance un dictaphone IA en France

InnAIO lance deux produits : le dictaphone IA TransNote et le cadre photo intelligent Vinabot. Le Tr...

2026-06-12

Le groupe OVH envisage l’acquisition de la start-up spécialisée dans l’IA vocale Gladia

Le groupe OVH (OVH Groupe) annonce être entré en négociations exclusives en vue d’acquérir Gladia, u...

2026-06-12

Google lance le modèle de traduction vocale en temps réel Gemini 3.5 Live Translate

Le 9 juin, Google a annoncé le lancement de son modèle de traduction vocale en temps réel Gemini 3.5...

2026-06-10

Microsoft lance une API de reconnaissance vocale côté client et les petits modèles de langage Aion pour Windows

Les 2 et 3 juin, Microsoft a publié une mise à jour des Windows AI APIs lors de la Build 2026, avec ...

2026-06-04

Google lance une fonction de détection des appels frauduleux pour Android, capable d'identifier les arnaques par clonage vocal IA

Google a lancé une fonction de détection des appels frauduleux pour le système Android, afin de lutt...

2026-06-04

AethexAI, une startup américaine, lève 3 millions de dollars pour l'IA vocale en Afrique et au Moyen-Orient

AethexAI, une startup spécialisée dans la création de produits d'IA vocale pour les marchés africain...

2026-06-04

Le géant chinois JD.com a open-sourcé JoyAI-Echo, un framework de génération de vidéos longues avec audio

Le 3 juin, JD.com a lancé JoyAI-Echo, un framework de génération de vidéos longues avec audio, dont ...

2026-06-04

Deepgram, en partenariat avec Fortanix et NVIDIA, oriente l'IA vocale locale vers le déploiement du calcul confidentiel

Récemment, l'entreprise américaine d'IA vocale en temps réel Deepgram a conclu un partenariat avec l...

2026-06-03

Le modèle MAI-Transcribe-1.5 de Microsoft intègre Foundry, un modèle de transcription en 43 langues complète le flux de travail de l'IA vocale

Le 2 juin, Microsoft a dévoilé un nouveau membre de la famille de modèles MAI lors du Build 2026. Le...

2026-06-03

L'application chinoise Soul App rend open source SoulX-Transcriber, un modèle de transcription de conversations multipartites intégrant la reconnaissance des locuteurs, des horodatages et du texte

Le 3 juin, l'équipe IA de Soul App (Soul AI Lab), en collaboration avec le groupe de recherche ASLP@...

2026-06-03

Tencent Cloud et Soniox s'associent pour promouvoir l'IA vocale multilingue

Tencent Cloud a conclu un partenariat stratégique avec Soniox, une entreprise d'IA vocale basée à Sa...

2026-06-03

NTT lance un cadre d'IA explicable multimodal pour le raisonnement, les modèles de langage visuel entrent dans une phase de calibration de sortie fiable

NTT a récemment annoncé la création du cadre de raisonnement d'IA explicable multimodal « Rationale-...

2026-06-02

Tencent Cloud (Chine) s’associe à Soniox (États-Unis) pour intégrer la transcription vocale en temps réel aux infrastructures de communication mondiales

Tencent Cloud (Chine) a récemment conclu un partenariat stratégique avec Soniox, une entreprise spéc...

2026-06-02

MiniMax lance le modèle M3 : un contexte d’un million de tokens propulse la compétition IA vers les agents à longues tâches

Le 1er juin, la société chinoise d’intelligence artificielle MiniMax a dévoilé son nouveau modèle gé...

2026-06-02

xAI lance officiellement les API de synthèse vocale et de reconnaissance vocale Grok, avec un coût de traitement par lots de 0,10 $ par heure

xAI a annoncé le 17 avril, heure locale, le lancement officiel des API de reconnaissance vocale (STT...

2026-04-20

ByteDance lance le modèle vocal full-duplex Seeduplex sur l'application Doubao

ByteDance a lancé le 9 avril le grand modèle vocal natif full-duplex Seeduplex, désormais déployé in...

2026-04-09
Préc Suiv Aller à
Confirmer