IA : Alexa, porte-drapeau du silicium AWS

La migration d’Alexa vers le silicium Amazon atteint un nouveau stade. Le groupe américain affirme avoir basculé la majorité des tâches d’inférence initialement exécutées sur GPU.

Les tâches en question relèvent de la synthèse vocale. Celle-ci s’enclenche à la fin du processus d’interaction avec l’assistant. Elle permet à ce dernier de fournir des réponses. Deux étapes d’inférence se déroulent au préalable : la transcription et la compréhension du langage naturel.

Le basculement se fait vers les instances EC2 Inf1, dotées de puces Inferentia* alliées à des Xeon Scalable 2^e génération. AWS évoque une réduction de latence (25 %) et de coûts (30 %) par rapport aux instances en GPU Nvidia précédemment exploitées.

Autre service Amazon à adopter les puces Inferentia : Rekognition (reconnaissance faciale). On ne nous précise pas l’état d’avancement de la transition. Mais on nous promet des gains plus significatifs qu’avec la synthèse vocale. En l’occurrence, une latence divisée par 8 sur la catégorisation d’objets.

* Les puces Inferentia complètent, au catalogue AWS, les Graviton, fondées sur des cœurs Arm Neoverse 64 bits.

Illustration principale © Edelweiss – Fotolia

NextSurface : des appareils faits pour durer 4 ans ? »

Previous « Investissements IT : un retour à la croissance en 2021

Published by

Clément Bohic

Tags: Alexa

3 années ago

Laurent Carlier – BNP Paribas Global Market : « L’IA permet de modéliser des relations plus complexes, mais il faut rester prudent »

La banque d’investissement utilise l'IA pour proposer des stratégies individualisées, en termes de rendement et…

3 jours ago

Open Compute Project : les datacenters partagent des bonnes pratiques pour l’environnement

OVHCloud partage ses efforts environnementaux au sommet de l’Open Compute Project qui se tient à…

4 jours ago

IA : Alexa, porte-drapeau du silicium AWS

Recent Posts

Legapass : comment protéger ses données privées jusque dans l’au-delà

Iris, un assistant d’IA conversationnelle en langue des signes

GenAI : le Royaume-Uni poursuit ses investigations sur les partenariats de Microsoft et Amazon

Clients de VMware : les raisons de la colère

Laurent Carlier – BNP Paribas Global Market : « L’IA permet de modéliser des relations plus complexes, mais il faut rester prudent »

Open Compute Project : les datacenters partagent des bonnes pratiques pour l’environnement

IA : Alexa, porte-drapeau du silicium AWS

Related Post

Recent Posts

Legapass : comment protéger ses données privées jusque dans l’au-delà

Iris, un assistant d’IA conversationnelle en langue des signes

GenAI : le Royaume-Uni poursuit ses investigations sur les partenariats de Microsoft et Amazon

Clients de VMware : les raisons de la colère

Laurent Carlier – BNP Paribas Global Market : « L’IA permet de modéliser des relations plus complexes, mais il faut rester prudent »

Open Compute Project : les datacenters partagent des bonnes pratiques pour l’environnement