Plein de trucs intéressants inside.
@Ghadzoeux : T'as des goûts de chiotte vieux
C'était vraiment pas le sens hein ![]()
Mais j'imagine que quand ils ont pondu leur film IA, ils ont demandé par prompt une représentation de chaque divinité .... et ce qui en est ressorti est une "valeur moyenne" des représentations déjà connues et établies de chaque personnage. C'est donc conforme à l'imaginaire qu'on en a.
Je n'ai pas encore vu le film de Nolan, par contre j'ai vu qu'on lui a beaucoup reproché des anachronismes ... mais c'est ce qui fera toujours la différence : Nolan (encore une fois qu'on aime ou pas) arrive avec une proposition qui lui est propre et singulière. Et s'il a envie de représenter Agamemnon de cette façon là, c'est parce que ça sert sa vision.
L'IA ne servira jamais de vision artistique originale, elle ne fera jamais que recracher un imaginaire pré-existant pour nous tous. Alors oui : c'est sûrement confortable et rassurant. Mais ça ne fait pas avancer la culture pour autant.
100% d’accord avec toi. Il n’y a qu’à voir l’engouement pour Angine de Poitrine et leur musique microtonale. Jamais l’IA serait aller chercher un truc pareil vu comme c’est pour ainsi dire inexistant dans la musique « occidentale » (à la fois géographiquement et dans le sens du bloc qui se croit dominant). Pour moi, leur succès est la preuve que pour l’instant, la créativité est encore l’apanage de l’humain.
Hors-sujet, mais c'est loin d'être inexistant dans la musique occidentale. Il y a plein d'exemples de microtonalité dans la musique depuis les Grecs de l'Antiquité (qu'on considère souvent comme les inventeurs) jusqu'à des artistes contemporains comme King Gizard entre autres, en passant par des courants classiques des siècles passés (la musique spectrale en France, Wendy Carlos et une bonne partie des avant-gardistes de la musique électronique), ou encore en électro plus contemporaine (techno, IDM, musique expérimentale) et même en jazz. La vérité, c'est que la microtonalité est largement répandue partout dans le monde, même si dans la musique "populaire" en Occident, son utilisation est plus marginale que dans certains pays.
D'où le "pour ainsi dire" parce que je voulais faire court, conscient d'être déjà un peu dans le HS ![]()
C'est juste pour dire que si l'IA, alimenté par une vaste majorité de musique mainstream (et donc strictement tonale), arrive à sortir un truc microtonal, j'en serais le premier étonné.
Désolé, je me dois de rebondir à nouveau, mais c'est toujours incorrect. La musique mainstream n'est pas "strictement tonale", loin de là. Il y a de nombreux exemples de compositions microtonales chez des artistes dits "mainstream", depuis la nuit des temps.
Juste à titre d'exemple, parce que là tout de suite, j'ai pas le temps de fouiller plus :
Une tetrachiée de merdes microtonales générées sur Suno
Je suis navré, mais des exemples ne font pas une tendance. Je suis entièrement d'accord avec le fait que cette musique est représentée, je connais la plupart des exemples que tu cites. Je m'exprime sûrement de façon trop péremptoire, je le concède. Je vais essayer de préciser ma pensée :
Je reste convaincu (et c'est bien une conviction, pas une certitude) que si on devait faire le ratio de la musique microtonale parmi les oeuvres présentes sur les plateformes de streaming (sur lesquelles s'alimentent les IA comme Suno), elle représenterait une proportion trop marginale pour qu'on ait des chances que spontanément, un truc comme Suno sorte de son chapeau un morceau utilisant ces modes.
(Et pardon d’avoir fait dériver le topic comme ça
)
Des exemples ne font pas une tendance, mais démontrent que ce n'est pas "strictement tonal".
Ça fait deux fois que tu affirmes que la microtonalité est (je cite) "pour ainsi dire inexistante dans la musique occidentale" et que "la musique mainstream est strictement tonale". Je te réponds juste que c'est faux, dans les deux cas. Les mots ont un sens, les utiliser à bon escient permettrait d'avoir un débat serein sans absolus qui s'avèrent en fait être des contre-vérités.
Et la notion de ratio n'a rien à voir là-dedans (même si à titre personnel, et vu les exemples pré-cités, je pense qu'elle est largement moins marginale que ce que tu sembles penser).
Quant au fait que...
Tu as un contre-exemple juste au-dessus.
Le lien de @fabiouchka m’amène sur l’invite de prompt de Suno ![]()
Mais j’ai bien précisé que j’avais été , dans mes premiers messages, exagérément péremptoire.
J'aurais plutôt dit "erronément catégorique", mais oui. ![]()
Si le lien c’était des morceaux générés par Suno avec de la microtonalité, ça soulève une dernière question qui était sous-jacente à mon propos : les a-t-il générés spontanément ou avec un prompt le spécifiant ?
Sauf erreur de ma part, Suno ne génère rien spontanément. Si la question est : "Si je ne lui précise pas de générer une composition avec des éléments microtonaux, en est-il capable ?" La réponse est probablement oui, mais pas dans la grande majorité des cas, son corpus d'entraînement ayant été a priori principalement basé sur des compositions tempérées, il y aura forcément un biais j'imagine...
Par spontanément, je voulais dire qu'il crée un morceau avec de la microtonalité sans qu'on le lui ait spécifiquement demandé. C'est mon point depuis le début, même si je n'étais pas clair.
Je résume : selon moi, le succès d'Angine de Poitrine montre qu'il y a à la fois la place pour la créativité et l'intérêt du public pour ce genre de musique plus "originale". Suno et consorts n'auraient jamais spontanément (j'entends par là sans qu'on le lui demande spécifiquement) généré un morceau avec de la microtonalité, celle-ci étant finalement assez peu représenté dans son corpus d'entraînement. Ça faisait directement écho au commentaire de @Sherlock51 sur le fait que l'IA avait généré des créatures pour l'Odyssée plus classiques que la vision singulière de Nolan (qui ne me plait pas, mais c'est un autre débat).
Attention, t'es encore une fois très catégorique alors que la réalité est sans doute un peu plus nuancée. ![]()
Si on part du principe que son corpus est essentiellement tempéré (mais ça reste une conjecture), je ne dirais pas "jamais", mais plutôt "très rarement"... (Sans oublier aussi qu'une composition n'est pas forcément exclusivement microtonale ou tempérée, mais qu'elle peut mélanger les deux).
Le pire, c'est que je fais attention à ne pas être trop catégorique, mais "chassez le naturel..."
Pour ramener ça à la façon dont la genAI fonctionne:
Dans les matériaux d'entraînement de ce type de modèle, qu'on parle de musique ou de texte, il y a des éléments, propriétés, attributs (peu importe comment on appelle ça) qui sont plus rares que d'autres. Mais seulement la quasi-absence d'un de ceux-là est en mesure de quasi-priver un (bon) modèle de produire quoi que ce soit avec l'élément, la propriété, l'attribut manquant du training set.
Et encore, ce n'est pas garanti, car certains attributs pourraient émerger à nouveau d'un training set où ils sont absents, en vertu du fait qu'ils pourraient tout à fait être représentés par des dimensions vectorielles qui ne sont pas absolument orthogonales aux autres dimensions, si on utilise des données synthétiques réinjectées dans le processus de training.
Aussi, dans les architectures typiques de LLM ou de gros modèles de genAI, il y a ce qu'on appelle des circuits d'attention. La tâche de ceux-ci est de déterminer l'importance, ou le poids, d'un élément ou d'un groupe d 'éléments dans leur ensemble local. C'est en fait ceux-ci qui seraient responsables tout particulièrement, dans l'exemple de la musique microtonale, d'accorder un poids au motifs spécifiquement micro-tonaux eux-mêmes; et ce poids est évidemment conditionné par ce qu'on prompte. Si l'utilisateur indique vouloir du microtonal, les circuits d'attention vont focaliser là-dessus.
Sans compter sur le renforcement / fine tuning qui peut ramener des éléments qui ont pourtant des proba plus faible de sortir.
Attention on ne veut pas de simplifications et on veut utiliser les mots à bon escient sur ce thread pour permettre un débat serein et nuancé ![]()
Je me permets donc de préciser : dans un transformer (l'archi reine de la genai) le mécanisme d'attention porte sur l'ensemble du contexte traité et pas uniquement sur une sous partie "locale". L'importance donnée à un mot (en vrai un token mais ca change pas grand chose) peut etre en théorie influencée par un mot situé à 10 000 mots de distance.
C'est en partie pour ca que les llm ont besoin de BCP de ram (en plus de celle nécéssaire à stocker les poids du modèle) pour pouvoir traiter des gros contexte car on calcul "l'importance" de chaque mot par rapport à tous les autres. Et d'autant plus que pour accélérer l'inférence on génère un cache de ce calcul de l'importance pour ne pas avoir à le recalculer entièrement pour chaque nouveau mot généré. Mais qui dit cache dit forcement besoin de RAM.
C'est aussi pour ca qu'il reste compliqué de faire des taches "serieuses" avec un modele local car meme si on assez de ram pour stocker les poids d'un "gros" modele, il faut prévoir beaucoup de ram en plus pour que le modele soit capable de travailler sur un gros contexte. Bref les transformer ca marche bien mais c'est quand meme super bourrin.