L'audio IA travaille à l'ère 2.0 des modèles
Face aux progrès fulgurants des grands modèles de langage, les IA génératives dédiées à la musique donnent parfois l'impression de faire du sur-place. ChatGPT, Gemini ou Claude raisonnent, programment et dialoguent avec une fluidité impressionnante, tandis que les générateurs musicaux peinent encore à offrir le même niveau de contrôle créatif. Ce constat est réel, mais il a une explication, les acteurs de la musique… ne sont pas moins avancés, ils affrontent un défi infiniment plus complexe. Contrairement au texte, la musique n'est pas une simple suite de symboles. Une chanson combine simultanément une mélodie, une harmonie, un rythme, des timbres, une interprétation vocale, un mixage et une progression émotionnelle. Le modèle doit maintenir cette cohérence pendant plusieurs minutes. Là où un article représente quelques milliers de tokens, un morceau de…