Se connecter
Se connecter

ou
Créer un compte

ou
FR
EN
Audiofanzine

réactions au dossier Commentaires sur le dossier : Suno Studio 2.0 devient-il une vraie STAN ?

  • 60 réponses
  • 30 participants
  • 4 915 vues
  • 42 followers
Commentaires sur le dossier : Suno Studio 2.0 devient-il une vraie STAN ?
6291.png
Cette semaine, La Matinale se penche sur l’évolution de Suno Studio, qui cherche désormais à dépasser la simple génération musicale par prompt.


Lire l'article


Ce thread a été créé automatiquement suite à la publication d'un article. N'hésitez pas à poster vos commentaires ici !
Afficher le sujet de la discussion
On commence à parler du watermarking dans les créations IA. Cela rend tout fichier généré identifiable. Dans l'audio, il n'y a rien de plus facile que d'insérer des watermarks et même d'y inclure les prompts qui ont servis à générer cet audio (ainsi que la version du modèle IA utilisé). Les watermarks audio sont assez résistants aux modifications de l'audio (égalisation notamment) Si Spotify détecte si facilement les contenus IA, c'est surement grâce à ces watermaks. Il est très probable que les fournisseurs de contenus IA aient prévu de changer les règles du jeu et de se ré-approprier les contenus qu'ils ont générés. Dans l'audio, on a déjà eu le cas d'une certaine plateforme qui proposait des samples "royalty free" revendiquer la propriété de leurs samples quand des musiques commençaient à générer de grosses sommes d'argent en streaming. On a aussi vu Youtube refuser la monétisation sur des musiques contenant des samples (y compris des samples royalty free). C'est indiqué dans les conditions des distributeurs quand vous voulez activer le monétisation.
Pour revenir à l'IA, ce qui est certain, c'est que tous les prompts créés par les utilisateurs et validés par ces mêmes utilisateurs, servent à entrainer gratuitement les IA pour les aider à produire des contenus pertinents pour l'auditeur de base qui les identifie comme étant un tant soit peu euphoniques. Si un contenu généré fait un nombre d'écoutes conséquent, l'IA pourrait identifier ce contenu comme étant pertinent et même retrouver les prompts engravés dans les watermarks (ainsi que la version du modèle IA utilisé).
  • J’aime
2 réactions
  • Dasman
  • VSTI
Citation de Krapod (voir le message) :
Le sujet est rouvert. Entre les gros hors-sujet et les invectives, il n'y a pas eu grand chose à sauver. Désolé pour les dommages collatéraux.
A défaut de respecter le sujet, respectez-vous au moins les uns les autres.


Merci pour ton taf (vu que j'avais signalé moi meme ce sujet, un peu lassé des attaques perso grossières) car on sait que c'est chiant pour vous.
Du coup je vais aller tenter de mon coté l'autre sujet Suno qui vit un peu plus.
  • J’aime
1 réaction
  • SweetMask
Suno, c'est pas mon rayon musical, mais si ça peut mettre un bon coup de pied au c... des STANs dinausores, je dis tant mieux! C'est quand même mieux d'orchestrer sa config que de cliquer partout pendant des heures!
Je ne suis pas convaincu par le côté utilitaire de l’ia dans les stans.
Par exemple j’ai un code couleur qui m’est propre pour mes pistes et je les repère très rapidement. Je ne suis pas pour qu’une IA vienne m’imposer des couleurs.
Il doit exister des choses pour lesquelles l’ia pourrait apporter une plus value mais franchement je ne vois pas.
En plus ce n’est pas long du tout d’assigner des couleurs ;)
En conclusion je demande vraiment à voir mais je ne suis pas convaincu…
Il faudrait vraiment qu’elle apprenne de mes habitudes pour être utile

La musique habille le silence

  • J’aime
2 réactions
  • Menelwen85
  • grol
Ça dépend, imaginons un fonction qui exprime « recale moi ces 2 guitares sur la partie de batterie » ou je ne sais…
Classes moi les pistes selon mon code couleur (celui que tu connais puisque tu as déjà scanné mes précédents projets)

Renommes mes pistes par type de timbres

Crées moi un bus pour chaque timbre

Sans utiliser de compresseur et juste en utilisant le fader de volume fait en sorte que telle piste de 3 mn oscille entre -4 et -3,5 dB sur l’ensemble de sa durée

Trouves moi et corriges la piste qui génère un clic à la mesure 76

Sur la base de cette mélodie que je viens d’enregistrer proposes moi une piste midi d’arrangement de cordes façon feu john barry,

proposes moi parmi l’ensemble de mes banques de sons orchestraux une lecture de cet arrangement midi de cordes en alternants les presets toutes les 4 mesures

Proposes moi des variations de cette ligne de basse en rapport avec le reste de mon projet,

Ajoutes des ornementations a cette partie de piano

Extrapoles une suite mélodique à ce sample de flute

Proposes moi des ponts harmoniques entre ces 2 accords

Joues de la basse et accompagnes moi pendant que je joue au clavier la partie de rhodes

Etc etc


  • J’aime
1 réaction
  • BBmiX
Exactement, qu'on le veuille ou non c'est déjà là...
Citation de Shantee (voir le message) :
Classes moi les pistes selon mon code couleur (celui que tu connais puisque tu as déjà scanné mes précédents projets)

Renommes mes pistes par type de timbres

Crées moi un bus pour chaque timbre

Sans utiliser de compresseur et juste en utilisant le fader de volume fait en sorte que telle piste de 3 mn oscille entre -4 et -3,5 dB sur l’ensemble de sa durée

Trouves moi et corriges la piste qui génère un clic à la mesure 76

Sur la base de cette mélodie que je viens d’enregistrer proposes moi une piste midi d’arrangement de cordes façon feu john barry,

proposes moi parmi l’ensemble de mes banques de sons orchestraux une lecture de cet arrangement midi de cordes en alternants les presets toutes les 4 mesures

Proposes moi des variations de cette ligne de basse en rapport avec le reste de mon projet,

Ajoutes des ornementations a cette partie de piano

Extrapoles une suite mélodique à ce sample de flute

Proposes moi des ponts harmoniques entre ces 2 accords

Joues de la basse et accompagnes moi pendant que je joue au clavier la partie de rhodes

Etc etc


Qu'on le veuille ou non, en effet, ça nous est très largement imposé. On nous colle des outils d'IA partout et il faut faire des démarches volontaires pour les virer. Voire c'est parfois impossible (comme META AI dans WhatsApp).

Perso, j'adooooore quand on m'impose des trucs. :mrg:
  • J’aime
4 réactions
  • skarabee.nc
  • will01
  • Dasman
  • DocK'S
Vivement Windows 12…

La musique habille le silence

Citation :
Will Zégal[/user] Qu'on le veuille ou non, en effet, ça nous est très largement imposé.


autant que l'OS préinstallée sur ton pc,

il sera difficile d'acheter un pc sans avoir un agent IA en local pré installé dessus à terme, tout simplement parce que l'interface homme-machine via clavier / souris va sans doute laisser la place a l'interface homme-machine via le verbal et le non verbal,

et vu la complexité de la société en devenir mise en oeuvre par la technocratie illibérale normative européenne, je peux t'assurer que cette IA en local va considérablement simplifier ta vie qui va devenir rapidement ingérable sans.

Double bénéfice pour l'IA le STAN est payant et des musiciens en herbe vont lui donner des idées.
Avec toutes ces données, les développeurs vont peut être trouvé a rendre l'IA créative. Il n'y aura plus besoin de musiciens!
Je suppose que si c'est L'IA qui fait l'arrangement ou les solo elle devient en partie propriétaire de l’œuvre?
Citation :
tout simplement parce que l'interface homme-machine via clavier / souris va sans doute laisser la place a l'interface homme-machine via le verbal et le non verbal,

Cela existe déjà depuis longtemps et c'est une plaie.

On a tenté les voitures qui parlaient à la fin des années 80. Cela a été un flop parce que c'était insupportable.
Vu les activités que je mène avec mon ordinateur, je ne me vois vraiment pas lui causer toute la journée.
Citation de Shantee (voir le message) :
mise en oeuvre par la technocratie illibérale normative européenne,

Sans avoir un amour particulier pour celle-ci, je trouve beaucoup plus dangereuse la classe techno-féodale illibérale des possesseurs des géants de la tech, notamment des possesseurs et promoteurs de l'IA.
Une Von Der Leyen me semble autrement plus facile à combattre et autrement moins cinglée qu'un Elon Musk et surtout qu'un Peter Thiel.
  • J’aime
  • J’adore
4 réactions
  • skarabee.nc
  • Nico38_
  • Sylv1984
  • will01
Citation :
On a tenté les voitures qui parlaient à la fin des années 80. Cela a été un flop parce que c'était insupportable.


Ah non je me suis sans doute pas assez clairement exprimée, le but c’est pas que le pc te réponde verbalement mais qu’il exécute ta commande vocale
Citation :
la classe techno-féodale illibérale des possesseurs des géants de la tech, notamment des possesseurs et promoteurs de l'IA.


je ne t'ai jamais dit non plus qu'il fallait absolument utiliser claude, chatgpt ou grok, le modèle centralisé avec abonnement et grosse ferme à GPU est un non sens pour un usage individuel,

après si la défiance vis a vis de l'IA empèche certains de prendre en compte l'alternative de l'IA en local, ce qu'elle implique et ce qu'elle évacue comme problématiques, la discussion tournera forcément en rond.

je suis pas là non plus pour débattre sur le fait de savoir qui est le plus super méchant de la bande, juste pour constater que plus le monde avance plus il nous impose de trucs administrativo - reglementaires et plus il faudra faire appel à des outils pour alleger cette lourdeur normative, et à ce niveau là j'en attend plus de l'IA en local que de notre administration obèse même pas foutue de protéger nos données.


  • J’aime
2 réactions
  • SweetMask
  • Will Zégal
x
Hors sujet :
D'accord. Il y avait un excellent sketch des Guignols où des Mr Sylvestre de la World Compagny se demandaient quelles entreprises ils pouvaient encore acheter. Ils se rendaient compte qu'ils avaient déjà tout et donc avaient créé... le communisme.

Quand on voit ce que deviennent nos mondes dits libéraux au niveau paperasse et gloubi-boulgas administratifs kafkaïens, j'ai l'impression que les fonctionnaires de l'ancien monde dit communiste rigoleraient bien.
  • J’aime
2 réactions
  • skarabee.nc
  • will01
J'arrive un peu tard dans ce post, mais l'IA c'est une nouvelle technologie qui peut être bonne si on s'en sert bien et mauvaise si on s'en sert mal, finalement, comme tout outil.

Je connais très bien Suno que j'utilise depuis un an et demi, et clairement je ne l'utilise pas pour remplacer mon cher Studio One. (Fender Studio Pro). D'ailleurs, les dernières évolutions en midi ne me parlent pas plus que ça, car je limite Suno à me créer des brouillons de musique.

Le principe est simple, ce sont mes mélodies, et mes musiques de base. Qui ont toujours un peu manqué de peps (arrangements pas terribles, notamment). Aussi, je n'arrivais pas à trouver une personne pour chanter comme je veux sur mes morceaux (j'ai vraiment essayé des dizaines de gens). J'ai donc créé un modèle de voix Suno.
J'upload donc dans Sunon une base de ma musique avec le chant, et je le prompt comme il faut (pas si compliqué que ça peut paraître, surtout avec les dernières versions de Suno il ne faut pas être trop précis). Je précise toujours la structure du morceaux(intro, cuplets, refrains, etc.).

J'obtiens une mouture assez identifiable à Suno (franchement j'arrive à reconnaître les prods Suno quasi à tous les coups).
Je produis entre 10 et 20, voire plus, versions différentes de ma chanson. Tempo bloqué. Paroles faites par moi et écrites dans Suno car c'est pas freestyle :-)

Ensuite je trie ce que j'aime : je sépare les instruments dans Suno et je prends la batterie d'une version, la base d'une autre, etc... De l'audio edit, et sincèrement c'est long quand même..

Ensuite j'obtiens une mouture avec un arrangement global qui me plaît.
Et là je réenregistre guitares, basses, batterie, et synthés. Tout sauf la voix dans 90% des cas.
D'ailleurs, c'est assez drôle mais il copie ma manière de jouer de la guitare et souvent le joue mieux que moi.
Mais je le refais quand même, je suis guitariste et comme la basse, je préfère mon jeu à celui de Suno.

Voilà mon expérience avec cet outil.
J'ai testé Ace Studio, mais je le trouve trop long à générer avec un résultat pas à la hauteur de Suno.

Désolé de ce long post :P:

  • J’aime
3 réactions
  • BBmiX
  • Belford
  • SweetMask
x
Hors sujet :
Spoiler - Cliquer ici pour lire la suite
  • J’aime
1 réaction
  • SweetMask
SweetMask,

Omnivocal de Steinberg, Vocal Synth d’ACE Studio ou encore SynthV de Dreamtonics semblent déjà avoir été adoptés par une partie de la communauté. L’IA semble réussir là où les technologies précédentes, comme Vocaloid, n’avaient jamais vraiment réussi à s’imposer durablement.

D’autres utilisateurs se tournent également vers Suno pour travailler ce même instrument qu’est la voix humaine.

Bonus : dans ce contexte précis, on ne peut d’ailleurs pas vraiment parler d’IA générative au sens strict du terme. On est davantage dans des outils de synthèse.

Donc, qu’est-ce qui nous empêcherait d’avoir un fil où nous pourrions échanger autour de ces technologies ?

Ou alors… s’agit-il là d’une discussion impossible ?

  • J’adore
1 réaction
  • SweetMask
Citation de Belford (voir le message) :
SweetMask,

Omnivocal de Steinberg, Vocal Synth d’ACE Studio ou encore SynthV de Dreamtonics semblent déjà avoir été adoptés par une partie de la communauté. L’IA semble réussir là où les technologies précédentes, comme Vocaloid, n’avaient jamais vraiment réussi à s’imposer durablement.



Il me semble que Omnivocal est un synthé et non une voix crée par modèle d'IA
Gam,

Plus précisément, Omnivocal de Steinberg est une synthèse assistée par IA. D’ailleurs, c’est à ce type de technologie que je fais allusion dans le paragraphe 3 de mon message.

(cf. https://www.steinberg.net/fr/cubase/omnivocal/)
  • J’aime
1 réaction
  • SweetMask
Citation de VSTI (voir le message) :
En revanche, lors du congrè dont tu parles, personne n'a dit que l'IA "pouvait détruire le monde". C'est un raccourci, une interprétation personnelle.

La vidéo en question pour fact checking :

https://www.youtube.com/live/fP5YdyjTfG0

Ce n'est pas du tout ce dont je parle. Je chercherai les vidéos d'origine si on ouvre un sujet de discussion sur les IA, mais j'avoue que je ne suis pas sûr d'y participer vu la façon dont certains donnent des leçons sur la façon de débattre qu'ils ne s'appliquent même pas à eux-mêmes (mais l'enfer, c'est toujours les autres).
Pour rappel, je n'ai pas dit que ces propos étaient de Sam Altman. Lui a juste (à ma connaissance) réclamé de la régulation. Il s'agissait de propos de chercheurs.
  • J’aime
1 réaction
  • skarabee.nc
Je trouve que ce professionnel parle très bien de l'évolution de ce que sera l'avenir d'un musicien pro dans l'avenir notamment avec l'IA:

Analo-Geek !

  • J’aime
3 réactions
  • skarabee.nc
  • BBmiX
  • SweetMask
Citation de Moog.Fighter (voir le message) :
Je trouve que ce professionnel parle très bien de l'évolution de ce que sera l'avenir d'un musicien pro dans l'avenir notamment avec l'IA:



x
Hors sujet :
off-topic


Chaine très intéressante en effet, il dit en résumé que les 3 piliers de la musique sont en crise, la compo, la musique à l'image (ce que j'aime) concurrencés par l'IA, la scène/live plus de concurrence salaire en baisse, je n'en suis pas sûr mais bon, et l'enseignement, plus de monde, plus d'exigence et de pression, on sait de quels profs on se souviens, on a oublié les autres.
Après tout ça, ce qui va survivre, l'identité, la voix artistique, le style reconnaissable, la singularité "humaine". en conclusion, "reste amateur si tu hésites, c'est une protection, une liberté, une joie, une gymnastique cognitive, l'IA ne remplacera jamais le plaisir de pratiquer, les erreurs, la sensibilité, la créativité humaine.
Après on arrête avec ses digressions

La musique est la langue des émotions.

Emmanuel Kant

  • J’aime
1 réaction
  • will01
Pour en revenir à Suno, Ce que je voudrais, c’est simplement ajouter des parties vocales sur mes tracks, avec mes propres paroles, pour tester des idées de voix, des couleurs, des intentions, avant d’aller plus loin.

Est‑ce que Suno est efficace pour ça ?

Est‑ce que c’est intuitif pour générer une voix propre, calée, exploitable ?

Pour quelqu’un qui veut juste tester des voix sur sa musique, est‑ce que ça vaut la peine d’essayer, ou bien Suno n’est pas adapté à cet usage ?

Merci pour vos retours d’expérience.

La musique est la langue des émotions.

Emmanuel Kant

SweetMask,

J’utilise d’abord SynthV pour les voix anglaises : c’est précis et expressif.

Pour Suno, j’utilise deux modes opératoires. Je lui donne l’acapella généré par SynthV, ainsi que les paroles et le style, puis la fonction « Cover » donne des résultats allant de 80 % à 98 % de précision. SynthV n'a pas de voix françaises opérationnelles.

Pour les voix françaises féminines, même démarche avec ACE Studio. Maintenant, ACE n’a pas de voix françaises masculines. Donc, pour les voix masculines, je lui donne un guide chanté, qui est moins précis. Mais si tu chantes, tu peux tester cette méthode.

Suno Studio, pour la même utilisation, n’amène pas forcément des résultats plus performants.

Mais s’il y a d’autres types de procédures ou des retours d’expérience, je suis à mon tour preneur.
  • J’adore
1 réaction
  • SweetMask