Je découvre Mid-Journey depuis quelques jours. Voici quelques réflexions en vrac :
D'abord, le prix de l'abonnement me semble vraiment excessif. Si seulement c'était mensualisé sans engagement, j'étais prêt à payer 30 dollars par mois pendant quelques temps. Mais payer d'un seul coup 360 dollars, ça me semble vraiment trop cher. Et présenter cela comme un abonnement mensuel de 30 dollars est plutôt mensonger. Mais j'ai peut-être manqué une info ? Y a moyen de mensualiser ?
Par contre, je le trouve bien meilleur, largement supérieur même, à Dall-E. Mid-Journey fait de très belles images de qualité. C'est indiscutable.
Par contre, il est limité pour certaines choses, ce qui est un peu dommage :
- les mains et les pieds, notamment, sont systématiquement ratés. C'est pour moi le gros point noir. J'espère que cette A.I. va finir par acquérir une maîtrise pour ces parties du corps.
- les visages, par contre, sont généralement très réussis, même s'il y a parfois des ratés au niveau des yeux.
- les silhouettes, l'attitude des corps : plutôt mitigé. Parfois, c'est très réussi. Et parfois, les corps sont complètement désarticulés.
- l'autre grand problème, c'est son incapacité à dissocier les personnages. Par exemple, j'ai vainement essayé d'obtenir Poutine et Biden jouant aux échecs : systématiquement, il me présente deux personnages qui sont l'un et l'autre la fusion de Poutine et Biden. Si quelqu'un arrive à obtenir la dissociation bien distincte, je voudrais bien savoir comment il s'y prend. Idem : un tyrannosaure affrontant un diplodocus aux échecs, j'obtiens deux dinosaures bizarres mélangeant chacun le corps du diplodocus avec la gueule du tyrannosaure. Intéressant, mais pas ce que je voulais.
- troisième problème, le puritanisme ambiant qui nous interdit d'employer le mot : "bare", par exemple. Complètement ridicule. Je me demande si les abonnés utilisant des salons privés n'ont pas la possibilité de faire sauter ce carcan.
- et globalement, l'intelligence artificielle est en soi limitée pour certaines requêtes. Par exemple, je voulais obtenir un portrait de JS Bach sans perruque. Il en est incapable. Même si je tape "short hair", ce genre de chose. Il ne comprend pas.
- En fait, pour arriver à ses fins, on est obligé de faire un montage en amont. Prendre le portrait de JS Bach, par exemple, découper la perruque pour l'enlever, et la remplacer par la chevelure que l'on souhaite. Et là, je pense que l'AI va y arriver (je vais faire l'essai ce soir). Bref, il faut l'assister, elle n'est pas autonome.
- D'ailleurs, l'une des questions que je me pose, c'est si les particuliers ont la possibilité de faire évoluer l'AI, et de lui faire reconnaître des choses. Par exemple, je cherche à utiliser un instrument de musique de la Renaissance, que l'AI ne connait pas, et arriver à ce qu'elle finisse par la reconnaître. Mais j'ai l'impression que c'est impossible. Peut-être faut-il faire des suggestions ?
- Enfin, l'une des critiques qui me vient, c'est que l'AI a tendance, j'ai l'impression, à se formater dans ses choix. Par exemple, c'est un peu toujours le même visage de femme qui a tendance à s'imposer. Même quand on part d'un modèle, au fur et à mesure des "variations", l'AI fait évoluer son visage vers cet espèce de modèle standard. C'est un peu embêtant.
- D'ailleurs c'est embêtant que l'on ne puisse pas obtenir de conserver quelque chose du modèle initial, et que la "variation" ne soit pas systématique et générale. Ça, c'est aussi l'un des très gros problèmes de cette AI.