Maison
Le PDG d'ElevenLabs prédit que les outils audio basés sur l'intelligence artificielle deviendront des produits de base

Mati Staniszewski, PDG et cofondateur de la société d'audio IA ElevenLabs, a récemment fait une déclaration révélatrice pour une entreprise dédiée à la création de modèles IA : il pense que ces modèles finiront par devenir une marchandise.
Il a partagé ce point de vue lors d'une discussion sur l'avenir de l'audio IA sur la scène de la conférence TechCrunch Disrupt 2025 ce mardi, exposant ses perspectives à court et à long terme pour ce domaine.
M. Staniszewski a souligné que l'équipe de recherche de son entreprise avait réussi à relever les principaux défis liés à l'architecture des modèles, et que cette priorité accordée au développement des modèles de base resterait d'actualité pendant les deux prochaines années.
« À long terme, cette technologie deviendra un produit de base, au cours des prochaines années », a prédit M. Staniszewski. « Même si des différences persistent pour certaines voix ou certaines langues, l'écart global en termes de capacités de base se réduira considérablement. »
Lorsqu'on lui a demandé pourquoi ElevenLabs se concentrait sur la création de modèles alors que ceux-ci étaient destinés à devenir des produits de base, M. Staniszewski a précisé que, pour l'instant, ils représentaient « l'avantage concurrentiel le plus important et le progrès le plus significatif disponible ».
Il a cité le problème persistant des voix ou des interactions IA qui manquent de qualité et de naturel comme un problème qui nécessite encore une solution.
« La seule façon de le résoudre actuellement est... de développer les modèles en interne. À plus long terme, d'autres acteurs relèveront également ce défi », explique M. Staniszewski.
Il a ajouté que pour des applications fiables et évolutives, les utilisateurs continueront probablement à utiliser des modèles spécialisés adaptés à des tâches spécifiques.
Pour l'avenir, M. Staniszewski prévoit un changement dans les deux prochaines années, avec un nombre croissant de modèles adoptant des architectures multimodales ou fusionnées.
« Cela signifie que vous générerez simultanément de l'audio et de la vidéo, ou que vous combinerez l'audio avec de grands modèles linguistiques dans une interface conversationnelle », a-t-il déclaré, citant Veo 3 de Google comme exemple de ce que les modèles intégrés peuvent accomplir.
Le fondateur a révélé qu'ElevenLabs avait l'intention de conclure des partenariats et d'explorer les technologies open source afin de fusionner sa spécialisation audio avec les atouts d'autres modèles d'IA.
La stratégie de l'entreprise, a-t-il déclaré, consiste à investir à la fois dans le développement de modèles fondamentaux et dans des applications pratiques afin de créer une valeur durable.
« Tout comme la synergie entre les logiciels et le matériel a été révolutionnaire pour Apple, nous pensons que la combinaison de la conception de produits et de l'IA définira la prochaine génération de cas d'utilisation transformateurs », a-t-il conclu.
Article connexe
Google teste l'agent IA Remy pour Gemini à mesure que l'accent se déplace vers le contrôle utilisateur
Selon Business Insider, Google teste Remy, un nouvel agent personnel d’IA pour Gemini. Cet outil vise à exécuter des tâches au nom des utilisateurs, rationalisant ainsi les flux de travail professionnels et les routines quotidiennes.Actuellement, Re
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements
Recommandations de sujets spéciaux liés
commentaires (0)

Mati Staniszewski, PDG et cofondateur de la société d'audio IA ElevenLabs, a récemment fait une déclaration révélatrice pour une entreprise dédiée à la création de modèles IA : il pense que ces modèles finiront par devenir une marchandise.
Il a partagé ce point de vue lors d'une discussion sur l'avenir de l'audio IA sur la scène de la conférence TechCrunch Disrupt 2025 ce mardi, exposant ses perspectives à court et à long terme pour ce domaine.
M. Staniszewski a souligné que l'équipe de recherche de son entreprise avait réussi à relever les principaux défis liés à l'architecture des modèles, et que cette priorité accordée au développement des modèles de base resterait d'actualité pendant les deux prochaines années.
« À long terme, cette technologie deviendra un produit de base, au cours des prochaines années », a prédit M. Staniszewski. « Même si des différences persistent pour certaines voix ou certaines langues, l'écart global en termes de capacités de base se réduira considérablement. »
Lorsqu'on lui a demandé pourquoi ElevenLabs se concentrait sur la création de modèles alors que ceux-ci étaient destinés à devenir des produits de base, M. Staniszewski a précisé que, pour l'instant, ils représentaient « l'avantage concurrentiel le plus important et le progrès le plus significatif disponible ».
Il a cité le problème persistant des voix ou des interactions IA qui manquent de qualité et de naturel comme un problème qui nécessite encore une solution.
« La seule façon de le résoudre actuellement est... de développer les modèles en interne. À plus long terme, d'autres acteurs relèveront également ce défi », explique M. Staniszewski.
Il a ajouté que pour des applications fiables et évolutives, les utilisateurs continueront probablement à utiliser des modèles spécialisés adaptés à des tâches spécifiques.
Pour l'avenir, M. Staniszewski prévoit un changement dans les deux prochaines années, avec un nombre croissant de modèles adoptant des architectures multimodales ou fusionnées.
« Cela signifie que vous générerez simultanément de l'audio et de la vidéo, ou que vous combinerez l'audio avec de grands modèles linguistiques dans une interface conversationnelle », a-t-il déclaré, citant Veo 3 de Google comme exemple de ce que les modèles intégrés peuvent accomplir.
Le fondateur a révélé qu'ElevenLabs avait l'intention de conclure des partenariats et d'explorer les technologies open source afin de fusionner sa spécialisation audio avec les atouts d'autres modèles d'IA.
La stratégie de l'entreprise, a-t-il déclaré, consiste à investir à la fois dans le développement de modèles fondamentaux et dans des applications pratiques afin de créer une valeur durable.
« Tout comme la synergie entre les logiciels et le matériel a été révolutionnaire pour Apple, nous pensons que la combinaison de la conception de produits et de l'IA définira la prochaine génération de cas d'utilisation transformateurs », a-t-il conclu.
Ollie mise sur la protection de la vie privée pour remporter la course aux assistants IA
Pour être véritablement utile, un assistant IA doit comprendre en profondeur son utilisateur. Ollie, un assistant personnel conçu pour la vie quotidienne, part du principe que cela ne nécessite pas de
Comment « AI LIVE : Londres » abordera les thèmes de l'IA et de l'automatisation industrielle
Ce sommet réunira des dirigeants de haut niveau venus du monde entier afin d'aborder les défis urgents auxquels sont confrontés les secteurs d'activité à l'échelle mondiale, allant des bouleversements











