vendredi 17 janvier 2025

Culture et identité

 Culture et identité

Étant donné que je parle quatre langues, j’ai voulu faire cet exercice pour pouvoir réfléchir profondément sur mon mélange culturel et sur mon identité. Dans cet article, je vais explorer comment on peut utiliser les IA génératrices afin de bien exprimer la culture et la richesse qui accompagne la capacité de parler plusieures langues. 


Tout d’abord, j’ai décidé de créer des images liées à mon mélange culturel. Je suis né en Angleterre et je suis donc anglais, mais j’ai aussi de la famille indienne, ce qui joue un grand rôle dans ma vie quotidienne. En outre, je suis étudiant en langues étrangères et je parle anglais, français, allemand et espagnol. Je voulais combiner toutes ses cultures dans une seule image, et j’ai donc réfléchi à ce qui définit chaque culture. J’ai utilisé cette invite: ‘Génère-moi une image détaillée, colorée et vibrante qui représente un mélange culturel. Principalement, je veux inclure des éléments qui symbolisent la culture anglaise, comme des monuments de Londres, une tasse de thé, etc. Je veux aussi inclure des mandalas indiens avec des dessins complexes, avec des drapeaux britannique et indien en arrière-plan. Au centre de l’image, je veux aussi des petits éléments qui représentent le français (la Tour Eiffel, par exemple), l’allemand (la Porte de Brandebourg) et l’espagnol (les danseurs de flamenco).’  Cependant, cela a été trop difficile pour l’IA utilisée (ChatGPT), parce qu’il y a beaucoup d’éléments à inclure, et dans ses premiers essais, il y avait un texte incohérent et il n’y avait pas beaucoup de dessins corrects. Par exemple, tous les drapeaux inclus étaient tous mal dessinés et les monuments ne provenaient d’aucun des 5 pays cités. Pour simplifier pour l’IA, j’ai décidé d’inclure seulement l’Angleterre et l’Inde pour l’image de mon mélange culturel, et de faire une image complètement différente pour mon mélange linguistique. Voici les créations: 


Comme vous pouvez voir, ChatGPT est resté fidèle à ce que je lui ai demandé, en incluant des monuments anglais qui sont les plus connus, les deux drapeaux, et des mandalas et des motifs vibrants pour représenter mon côté indien. Ce que j’ai remarqué ici, c’est que la culture indienne domine, étant donné que presque tout l’arrière-plan est rempli des mandalas, et on voit seulement des détails anglais. Quant au mélange linguistique, l’IA a réussi à intégrer les éléments des quatre pays : on voit les monuments connus de l’Angleterre et l’Allemagne, les danseurs de flamenco pour l’Espagne, et, au centre de l’image, une combinaison de la Tour Eiffel avec Big Ben. Même si cela paraît un peu bizarre, je l’ai aimé ! Je crois que ça représente bien un vrai mélange des aspects culturels d’une manière un peu amusante.


J’ai ensuite pensé à créer une image pour représenter mon identité personnelle, et j’ai décidé d’utiliser l’IA Adobe Firefly pour cette partie de la tâche. Je lui ai demandé de me générer ‘une image d’un homme grand et mince de 20 ans avec des cheveux bruns mi-longs coiffés en rideaux, qui est heureux et souriant. Il aime voyager et apprendre les langues et il est donc en France, il écoute de la musique avec des écouteurs et envoie des SMS sur son téléphone’. J’ai essayé plusieurs fois pour que l’IA génère une image plus réaliste de moi, en spécifiant un manque de barbe et mon type de cheveux, mais aucune de mes tentatives n’a fonctionné, ce qui est compréhensible. Naturellement, l’IA ne pouvait pas correspondre exactement à mon apparence réelle, ce qui est très évident ici, étant donné que les hommes ci-dessous ne me ressemblent pas du tout ! Cependant, l’IA a réussi à capturer l’essence de ce que je voulais, et de mon identité : quelqu’un heureux, qui aime écouter de la musique et qui aime voyager, et qui aime rester en contact avec ses amis. 













Finalement, j’ai dû penser aux stéréotypes souvent associés à l'Angleterre, ce que j’ai trouvé assez amusant, car il en existe vraiment plusieurs. J’ai décidé de me concentrer sur des stéréotypes plutôt amusants ou irréalistes, dans le but de créer des images plus divertissantes. La plus connue est probablement que les anglais ne boivent que du thé, et qu’on aime beaucoup faire la queue et être très poli et apologétique. Donc, j’ai posé cette invite à l’IA BlinkShot : Une image drôle et exagérée d'un Anglais. Il est vêtu d'un costume en tweed et d'un chapeau melon, tenant une tasse de thé géante d'où s'échappe de la vapeur et dans l'autre, une assiette avec du poisson-frites. L'arrière-plan présente une cabine téléphonique rouge, un bus à deux étages et Big Ben. Il pleut. Leurs dents sont exagérées de manière comique pour l'humour, et la scène globale est colorée, légère et satirique. Des gens marchent à l'arrière-plan avec des parapluies. Voici les créations : 


Je crois que ces images sont vraiment bonnes et amusantes, et sont une vraie représentation de la manière dont beaucoup de gens perçoivent l’Angleterre ! Elles contiennent plein de stéréotypes, comme le mauvais temps et les mauvais dents, et l’IA a fait du bon travail avec l’arrière-plan et la façon de présenter l’homme. Cependant, afin de générer ces images, j’ai dû réécrire mon invite plusieurs fois, car l’IA a souvent mal-écrit du texte, ou a créé un homme avec trois mains pour qu’il puisse tenir du thé, du poisson-frites et un parapluie.

 


Pour conclure, j’ai trouvé que, pour cet exercice, l’IA a vraiment réussi à suivre mes instructions et à créer ce que j’ai voulu. Cet exercice m’a permis de vraiment explorer les cultures qui font partie de ma vie quotidienne, et de m’amuser en créant des images pour les représenter. Bien qu’il faille quelquefois donner aux IAs beaucoup de demandes très précises, ça en vaut la peine. Ces images montrent la capacité de l’IA de capturer et même exagérer des aspects de notre identité personnelle, culturelle et linguistique. Qu’en pensez-vous ? Comment créerez-vous des images qui reflètent vos identités ?


- Tarun Maybanks

Culture et identité

 

Tout d’abord, j’ai complété les tableaux qui nous ont été donnés avec les langues que je parle et les choses que j’y associe. Plus tard, j'ai fait la même chose avec les cultures, dans ce cas, je n'en ai qu'une.

 

Grâce à l'aide d'Océane, j'ai recherché deux images qui montrent le mélange de cultures et de langues que j'ai préalablement mis sur les tableaux. Pour effectuer les recherches d'images, je suis allé sur ChatGPT et j'ai mis "une baguette dansant le flamenco pendant qu'une pizza la regarde". Je n'étais pas satisfait de ce qui m'était proposé, j'ai donc décidé de préciser que la robe devait être rouge. De là, la l'image suivante est apparue :


Pour obtenir l'image suivante, nous avons décidé de demander, dans ce cas, au designer de Microsoft de réaliser une image où l'on pouvait voir une femme au centre et autour d'elle des objets typiquement français, italiens et espagnols. De cette demande est née l'image suivante :

Pour ce qui suit, j'ai décidé de faire une image qui me définit personnellement. j’ai demandé qu’une image d’une fille aux cheveux bruns soit créée devant la mer en train de lire un livre. Je suis originaire des îles Canaries donc les plages font partie de mon quotidien, tout comme la lecture.

Enfin, j’ai créé deux images avec les stéréotypes qui existent sur l’Espagne.Tout d’abord, j’ai demandé qu’une image soit créée où l’on pourrait voir de nombreuses personnes danser le flamenco et porter des vêtements traditionnels. Je fais ici référence au stéréotype selon lequel tout le monde sait danser et nous dansons constamment et, deuxièmement,

 une image montrant une paella géante et des gens autour d'elle en train de manger. Avec cela, j'essaie de faire référence au stéréotype selon lequel les Espagnols ne mangent que de la paella.

 






Les biais de l'IA








Photos générés sur Image Creator et Lexica Art avec comme description « Photo de studio de deux êtres humains qui s'embrassent »  

Première partie : 

-       Les photos qui ressortent le plus sont la première et la quatrième. En effet, sur la première on remarque que l’IA a très mal généré la photo car on a l’impression que les personnages partagent le même corps. Leurs bras et leur nez sont liés, cependant, au niveau de la représentation c’est l’une des seuls qui représente le mieux les traits humains. 

La quatrième photo ressort aussi car on peut remarquer que l’homme a un tatouage au visage représentant une partie d’une tête de mort et la femme porte un accessoire similaire. 

 

Il y a une constante dans certaines positions corporelles. En effet, on remarque que la position est toujours de profils et que c’est l’homme qui donne le bisou. 

 

-       Sur la majorité des photos nous avons la représentation de couples hetéronormatifs, un homme et une femme ce qui reste le plus commun. 

La seule photo où deux hommes ont été généré c’est lorsque qu’il a été précisé « Photo de studio de deux hommes qui s'embrassent ». Nous n’avons rencontré aucun souci lors de cette demande, l’image a été généré normalement.  

-       Dans les zones de contact on remarque que c’est la femme qui enlace l’homme, les yeux des personnages sont fermés et tous les personnages ont des cheveux marrons. 


Segunda parte : 

A lo largo de la realización de la tarea no nos hemos encontrado con ningún mensaje de error, ni de advertencia de cancelación para nuestras cuentas. Hemos pensado que esto se puede dar porque realmente no estábamos pidiendo nada explícito como puede ser un beso apasionado. Pensamos que la IA puede considerar como explícito todo aquello que pueda mostrar una parte privada del cuerpo o busque rebajar a alguien con la creación de la imagen. 

En cuanto a los valores culturales no podemos estar seguras ya que, son diferentes en cada país. En nuestro caso, por ejemplo, no hemos tenido ningún tipo de problema.

¿Realmente se asocia un beso a contenido explicito y un arma a la violencia? No, estos términos no están únicamente asociados a estos temas. Por ejemplo, un beso puede estar relacionado con una felicitación o un saludo y, en el caso del arma, puede ser de juguete e inofensivo. Después de haber hecho esta actividad consideramos que la IA es capaz de notar la diferencia entre lo bueno y lo malo y dependiendo de ello se ajusta a lo que se solicita tratando de no ser ofensivo. 

Si hacemos una comparación con la imagen que se nos mostraba podemos ver algunas similitudes como puede ser la postura, sus labios casi no están en contacto, etc. Pero también hemos podido ver que en las imágenes que hemos encontrado nosotras se muestra una mayor sensualidad e intimidad que en el otro caso.

Fusion artistique

Rencontre sous le soleil fragmenté

"Rencontre sous le soleil fragmenté" est une pièce qui évoque une atmosphère nostalgique grâce au cubisme, capturant un instant de sérénité et de complicité dans un cadre bucolique.

L'œuvre représente un couple assis sur un banc, le long d'une promenade au bord de l’eau, plongé dans une ambiance paisible et lumineuse. Au loin, un homme s’avance vers eux, tandis qu’un bateau repose sur les eaux calmes du lac. Cette scène semble explorer les liens humains et la quiétude des paysages, suggérant peut-être le passage du temps ou un moment de réflexion partagée.

La composition est dominée par des tons chauds et froids, équilibrés en parfaite harmonie : des jaunes, des bleus et des verts qui se mêlent dans des motifs géométriques, fragmentant la réalité comme un puzzle visuel. Les lignes angulaires et rectilignes se combinent avec des courbes douces pour définir les figures humaines et l’environnement. Le couple au premier plan est construit avec des mosaïques de formes rectangulaires et triangulaires, renforçant la sensation de fragmentation de l’espace.

Le paysage est riche en détails symboliques : l’arbre courbé avec ses branches entrelacées à gauche contraste avec les figures plus rigides des lampadaires. La barque solitaire sur l’eau introduit une certaine mélancolie, tandis que le soleil au zénith diffuse une chaleur qui illumine la scène et unifie la composition. La texture visuelle atteint un équilibre entre le dynamisme et la tranquillité 

Cette œuvre témoigne de la capacité de l’art à capturer à la fois la fragilité et la permanence des instants du quotidien. À travers son esthétique fragmentée et ses couleurs vibrantes, "Rencontre sous le soleil fragmenté" nous invite à réfléchir sur les liens humains, encadrés par la beauté des paysages naturels. C’est une célébration du quotidien, transformé en une expérience visuelle complexe et profondément émotionnelle.

Pour cette image j’ai utilisé le générateur d’images Bing Generator, qui m’a offert plusieurs options. Pour obtenir cette image j’ai utilisé la recherche "Claude Monet y Pablo Picasso imagen que combina sus dos estilos con una pareja en un paisaje con vegetación, tonos claros, cubismo". J’ai utilisé cette recherche car la plupart des œuvres de Monet sont centrées sur des paysages avec une végétation étendue avec des couleurs claires et brillantes; tandis que pour la partie de Picasso remarqué qui utilise le cubisme car c’est l’un de ses plus grands traits, comme le fait d’avoir mis un couple, car le peintre a beaucoup de portraits cubistes. Bien que j’aurais pu choisir quelque chose de plus sombre ou solennel comme le Guernica pour me donner un autre oncle d’image, je décidai de ne pas le faire car il serait plus difficile à combiner avec le peintre français.

Bien que l’image sélectionnée ne montre pas le style de peinture de Monet, il est le plus proche d’un mélange des deux peintres par iconographie. Il y avait des images qui marquaient les traits de Monet mais ceux-ci avaient plusieurs erreurs et ne finissent pas d’intégrer bien tous les éléments donc je les ai écartées.

Éclats d’Aurore et de Magie

“Éclats d’Aurore et de Magie” est un hommage à la lumière changeante et magique que Monet peignait, combinée aux éléments mystiques de Ghibli.

Dans cette œuvre, l’IA compose une symphonie visuelle où convergent deux univers apparemment distincts : l’impressionnisme lumineux de Claude Monet et la narration magique des mondes créés par le Studio Ghibli. C’est un exercice fascinant d’intégration artistique qui parvient à capturer à la fois la fugacité de la lumière dans le paysage et l’essence mystique de la fantaisie.

La peinture nous transporte dans une vallée enchantée, illuminée par une aurore magique. L’atmosphère semble tout droit sortie d’un rêve, où les frontières entre la réalité et l’imaginaire s’effacent. La rivière centrale agit comme un miroir liquide, reflétant la lumière intense du soleil et reliant visuellement le ciel et la terre, dans une continuité qui évoque à la fois le changement constant de la nature et le monde intérieur des personnages.

La scène est peuplée d’un groupe de figures magiques qui semblent interrompre leur chemin pour contempler ce spectacle de lumière. Chacune d’elles représente un fragment de cet univers onirique : des personnages mystérieux masqués, des créatures anthropomorphiques et des figures humaines qui partagent une attitude de contemplation et d’émerveillement.

L’œuvre se distingue par sa palette de couleurs éclatante, où les tons verts et dorés dominent avec une intensité qui rappelle les touches vibrantes de Monet dans des œuvres comme Impression, Soleil Levant ou ses célèbres nymphéas. Ici, cependant, les couleurs semblent vibrer avec une aura de magie, intensifiées par un soleil qui irradie une lumière d’un dynamisme presque surnaturel.

Le traitement de la lumière est sublime : la transition entre les tons chauds de l’astre et la fraîcheur des verts et des bleus crée un contraste qui inonde la scène de vie. Cette utilisation de la lumière reflète l’influence impressionniste, mais elle va plus loin en lui insufflant une qualité fantastique que Monet n’aurait pas cherchée.

D’un autre côté, les éléments mystiques — des personnages inspirés du style de Ghibli, des cascades qui s’élèvent comme des colonnes divines et un paysage qui semble respirer la magie — transportent le spectateur dans un univers où la nature et la spiritualité sont profondément interconnectées.

“Éclats d’Aurore et de Magie” réinterprète deux styles artistiques de manière profondément originale. De l’impressionnisme, elle emprunte l’obsession pour la lumière et son interaction avec le paysage, mais lui ajoute une dimension narrative qui la rend plus émotionnelle et immédiate. Du Studio Ghibli, elle adopte la magie, la poésie du quotidien et la capacité de transformer des paysages ordinaires en scènes extraordinaires.

L’œuvre est, en son essence, un pont entre des mondes : entre la technique et l’imaginaire, entre l’humain et le surnaturel, entre le classique et le contemporain. C’est un hommage à la lumière, à la vie et à la magie sous toutes ses formes.

Dans Éclats d’Aurore et de Magie, le spectateur découvre une œuvre qui s’adresse directement à sa capacité d’émerveillement. Elle témoigne de la manière dont l’art peut unir des écoles, des styles et des émotions pour créer quelque chose de totalement inédit. L’œuvre ne se contente pas de rendre hommage à Monet et Ghibli, mais, comme eux, elle devient un chant à la beauté, à la magie et à la lumière de l’éphémère.

Pour cette image j’ai utilisé le générateur d’images Bing Generator, qui m’a offert plusieurs options. Pour obtenir cette image j’ai utilisé la recherche "Claude Monet y Studio Ghibli imagen que combine ambos estilos con un paisaje verde y luminoso simulando los trazos de Monet con personajes míticos sacados de las películas del Studio Ghibli y un toque fantástico"

Les biais de l'IA

J'ai demandé à l'IA de me créer six images de deux êtres humains s'embrassant, sans préciser leur sexe. Qu'est-ce qui se passe ? Elle n'a produit aucune image de deux personnes du même sexe s'embrassant. On peut voir seulement sur la dernière photo deux personnes du même sexe, mais c'est parce que je l'ai demandé explicitement. Et si on regarde bien, leurs bouches sont très éloignées l'une de l'autre, peut-être l'image où elles sont le plus distantes. Pour être honnête, rien de tout cela ne me surprend, car l'IA a été créée par des hommes, blancs et hétérosexuels, et elle s'appuie sur des informations trouvées sur internet. Comme nous le savons, la majorité des informations en ligne sont racistes, sexistes, homophobes et patriarcales. En ce qui concerne les images créées, elles ont toutes la même position corporelle, il n'y a aucune variation. De plus, toutes les paires sont hétéronormatives et suivent les canons de beauté imposés par la société : la femme mince, l'homme fort, tous deux avec un nez petit et parfait, elle avec les cheveux longs, lui avec les cheveux courts. Par ailleurs, dans la dernière photo où apparaissent deux hommes, ils ne se touchent même pas les lèvres, leurs bouches sont très éloignées. Alors que dans les autres, leurs bouches se frôlent au moins. Comme mentionné précédemment, la posture est la même dans toutes les images, sauf dans une où l'homme a la main sur la tête de la femme, et dans celle des deux personnes homosexuelles où la pose change légèrement, donnant l'impression qu'ils vont s'enlacer plutôt que s'embrasser. De même, le regard est le même dans toutes les images, les yeux restent fermés. En nous concentrant maintenant sur l'IA, lorsque je lui ai demandé de créer deux êtres humains s'embrassant, une des images a été accompagnée du message : "The generated content violates our Community Guidelines. Please try again with another prompt", c'est-à-dire que ce que je demandais violait leurs règles, comme si le fait de s'embrasser était quelque chose de mal. À mon avis, le baiser semble être associé pour l'IA à un contenu explicite ou sexuel. Je ne saurais dire pourquoi elle le perçoit ainsi, car un baiser est l'une des choses les plus normales du monde, tout le monde s'embrasse, cela n'a rien de mauvais. Ce n'est pas une action violente, ce n'est pas comme si vous demandiez à l'IA de dessiner un crime. En ce qui me concerne, l'IA a été programmée pour que tout acte impliquant un contact humain soit qualifié de "contenu explicite" ou "contenu sexuel". Cela reflète la société dans laquelle nous vivons, la culture des riches, de ceux qui nous contrôlent et gouvernent, car ils ont plus de pouvoir politique. Et c'est cette culture qu'ils transmettent à la société. C'est pourquoi l'IA ne peut pas créer une image de deux personnes homosexuelles s'embrassant, car pour ces personnes, ces individus sont considérés comme des déchets. En conclusion, les limites de l'IA sont basées sur la société et la culture dans lesquelles nous vivons. Pour la société, il est mal vu que deux personnes s'embrassent de manière intense ou qu'une femme montre sa poitrine dans un bar, et tout cela se reflète dans l'IA. Pour certaines personnes, voire deux personnes du même sexe s'embrasser dans la rue constitue un acte de violence, en raison de leur mentalité et de la culture patriarcale, homophobe, misogyne et raciste qui leur a été inculquée depuis l'enfance. En fin de compte, les limites sont imposées par la société et la culture, et non par l'IA.

jeudi 16 janvier 2025

Analyse des biais de l'IA dans la représentation humaine

Une image avec cette invite : "Professeure steampunk. Cheveux gris, regard sceptique".



Je pense que cette image générée se rapproche plutôt de la seconde image sur le DisMoi site:




Résultats :

L’image générée reflète des stéréotypes visuels liés aux genres ou à l'âge. Par exemple, ici la femme un peu plus vielle parce que dans l’invite j’ai dit ‘cheveux gris’

Le résultat tend davantage vers une vision plus neutre et réaliste.

A mon avis, l’image obtenue se rapproche plus d’une professeure crédible et réaliste que d’une femme hypér-idealisée.

Création des images à partir de plusieurs thèmes différents :






Premières impressions :

Il y a des stéréotypes qui apparaissent dans la répartition des genres. Par exemple : Les médecins sont majoritairement représentés comme des hommes, et les scènes de mariage sont majoritairement avec un homme et une femme ?

Les phénotypes : Les images tendent à montrer principalement des personnes caucasiennes

Globalement, la représentation humaine est assez précise et réaliste

Le test du baiser et les biais de l'IA

Test : "Photo de studio de deux êtres humains qui s'embrassent.







Observations initiales :

Les résultats montrent une prédominance de couples hétérosexuels

L'IA gère les requêtes pour des couples homosexuels ou d'autres variations assez bien mais parfois elle a du mal à comprendre.

Pour les détails des zones de contact (lèvres, visages, regards) : cela dépend parce que parfois elles sont bien rendues et parfois elles semblent artificielles


Tests supplémentaires avec variations d’invite :

"Deux hommes qui s'embrassent."

"Deux femmes qui s'embrassent."

"Un couple interracial qui s'embrasse."

"Un couple de personnes âgées qui s'embrassent."

Analyse :

Les images générées par l'IA peuvent présenter certaines limitations et imperfections, notamment dans les scénarios. Voici quelques points clés :
Zones de contact floues ou déformées :

Lorsqu'une IA génère des images impliquant un contact physique (comme un baiser), les zones où les personnes se touchent peuvent parfois être floues ou mal définies. Cela peut se produire à cause de :

La complexité de rendre de manière réaliste l'interaction entre deux corps.

Une formation de l'IA sur des ensembles de données qui n'ont pas toujours des exemples parfaits pour ces situations.
Représentation des couples homosexuels ou non-caucasiens :

Diversité limitée :

Les modèles d'IA peuvent refléter des biais dans leurs ensembles de données d'entraînement, qui sont souvent déséquilibrés. Cela signifie que :

Les couples non-caucasiens ou homosexuels pourraient être sous-représentés ou apparaître moins fréquemment et avec moins de précision.

Les expressions culturelles et les traits spécifiques peuvent parfois manquer de réalisme.
J’ai dû spécifier si je voulais pas une couple hétérosexuel, parce que c’est le défaut pour les IA que j’ai utilisées

Progrès récents :

Les modèles récents s'améliorent dans la représentation de la diversité, notamment grâce à des efforts pour inclure davantage de données variées et représentatives. Cependant, des lacunes persistent.
Lacunes spécifiques :

Les stéréotypes ou des choix par défaut (par exemple, des couples hétérosexuels et caucasiens) peuvent encore dominer dans les résultats.

Dans certains cas, les caractéristiques des personnes peuvent sembler génériques ou manquer de subtilité, surtout si des traits spécifiques (comme des cheveux texturés ou des différences culturelles) sont demandés.
Analyse des images
Présentation des IA utilisées

Pour cette analyse, j’ai principalement utilisé deux outils : DALL-E et DeepAI.

Langue des invites :
Parfois, il a été nécessaire de formuler les invites en anglais sur DeepAI, car ce dernier ne comprenait pas toujours les instructions en français. Cela souligne une limite dans la prise en charge multilingue de certains modèles d’IA.

Exemple d’invite utilisée :
J’ai testé plusieurs variations, comme : « Deux hommes qui s’embrassent ». Ces invites m’ont permis d’évaluer la capacité des modèles à représenter des interactions humaines diversifiées et à éviter les stéréotypes.

Les Limites des IA dans la Génération de Contenus Sensibles

Défis et Approches : Contenus Sensibles

Baisers et contenus intimes :
Les IA peuvent refuser de générer des scènes intimes par crainte de représentations explicites ou d’abus. Par précaution, des règles strictes s’appliquent, mais certains contenus (comme la nudité) peuvent passer inaperçus.

Armes, violence et nudité :
Les représentations explicites de violence sont limitées, sauf dans des contextes éducatifs ou artistiques (ex. : batailles historiques). La nudité artistique est parfois permise, mais la nudité explicite reste interdite pour éviter les abus.
Comparaisons et Contextes Culturels

Baiser vs nudité : Les baisers, plus subjectifs et émotionnels, sont traités avec prudence, contrairement à la nudité artistique.

Violence vs intimité : La violence est souvent plus tolérée dans des contextes fictifs ou historiques, tandis que l’intimité est plus régulièrement censurée.

Influence culturelle : Les restrictions dépendent des normes culturelles intégrées dans les modèles d’entraînement.
Limites Techniques et Éthiques

Restrictions fréquentes : Les modèles refusent souvent les contenus jugés sensibles ou explicites, reflétant des biais culturels ou conservateurs.

Données biaisées : Les ensembles d’entraînement manquent parfois de diversité, ce qui limite la représentation de certains contextes ou populations.

Prudence éthique : Les concepteurs privilégient des restrictions conservatrices pour prévenir les usages abusifs.

Suggestions d’Amélioration

Techniques :

Intégrer des données plus diversifiées pour mieux refléter la diversité culturelle et sociale.

Développer une analyse contextuelle avancée pour distinguer les usages légitimes.

Éthiques :

Renforcer la transparence sur les restrictions pour améliorer la confiance.

Réduire les biais via des collaborations avec des experts culturels et sociologiques.

Adapter les normes aux sensibilités locales, tout en assurant la sécurité des contenus.

Adaptation aux contextes locaux

Permettre une personnalisation des normes en fonction des attentes culturelles, tout en préservant l’éthique et la sécurité des contenus générés.

En conclusion, l’analyse des biais dans la génération d’images par l’IA met en lumière des défis complexes liés à la diversité, aux stéréotypes et aux sensibilités culturelles. Bien que des progrès notables aient été réalisés, notamment dans la représentation de la diversité, il reste essentiel d’améliorer les modèles pour garantir des résultats inclusifs, réalistes et éthiquement responsables.

Fusion des cultures et de l'identité : Une exploration visuelle à travers l'IA



Dans ce blog, on va explorer la manière dont nos langues et nos cultures se mélangent à travers l'art généré par IA. En utilisant des plateformes comme DALL-E, j’ai créé des images représentant des expressions d’art culturelles, des stéréotypes et mes identités personnelles. Cette expérience m’a permis de questionner comment ces identités peuvent être traduites visuellement tout en rendant hommage à la richesse et à la diversité des cultures. Voici un aperçu du démarche et des résultats obtenus.


Invite IA pour intégrer ces éléments :

"Une mosaïque culturelle représentant des symboles de la gastronomie française (baguette, croissant), de la passion espagnole (flamenco, tapas), et de la culture anglaise (une tasse de thé, Big Ben), le tout entouré d’éléments méditerranéens comme la mer, le soleil et les couleurs chaudes. Style inspiré de mosaïques traditionnelles."


DALL-E 




DeepAI




Mélanges culturels :

Les images générées ont fusionné des éléments de la culture française, espagnole et anglaise, avec des symboles comme la Tour Eiffel, un danseur de flamenco et un joueur de rugby. Le style vibrant et moderne, inspiré de Picasso et du pop art, a permis d'illustrer ces influences culturelles. J’ai utilisé des mots-clés tels que "baguette", "révolution", "flamenco", "fiesta", "tea" et "humour" pour créer des invites qui intègrent ces univers.

Les visuels ont pris vie sous diverses formes :

La première image illustre une mosaïque culturelle, avec des croissants, une danseuse de flamenco, une tasse de thé fumante et le soleil méditerranéen, le tout dans des couleurs chaudes rappelant l'art traditionnel méditerranéen.



La deuxième image dépeint un marché mondial où des personnages stéréotypés (le boulanger français, le danseur espagnol et le gentleman anglais) échangent autour d’une table garnie de spécialités culinaires

.

Ces créations visuelles mettent en lumière un point essentiel : nos identités sont le fruit d’interactions constantes entre différentes cultures, et cette richesse mérite d’être célébrée.

Invite : "Une fusion des cultures française, espagnole et anglaise dans un tableau vibrant où la gastronomie, la danse, et les symboles architecturaux se mêlent dans une harmonie méditerranéenne. Style post-impressionniste."






Cette image illustre un Espagnol alangui sous un parasol, avec un éventail et un verre de sangria, tandis qu’un danseur de flamenco anime la scène, mettant en lumière l’idée que tous les Espagnols passent leur vie à faire la fête et profiter de la siesta, un cliché amusant mais dénué de fondement.




Ces créations m’ont permis de réfléchir à l’origine et à la persistance de ces stéréotypes tout en m’amusant.

Identité personnelle :

Choix d’éléments personnels et invite IA correspondante :

Éléments qui me définissent personnellement :

Ironique : Obsédé par le café mais toujours en retard


Sérieux : Mélange culturel et passion pour l’innovation


Humoristique : Incapable de finir un livre mais amoureux des bibliothèques

Invite IA :
"Un personnage rêveur, assis dans une immense bibliothèque remplie de livres ouverts mais jamais terminés, tenant une tasse de café qui déborde légèrement, avec une horloge en arrière-plan indiquant qu’il est en retard. Style surréaliste avec une touche humoristique

Pour l’image qui me représente, l’IA a créé une image avec un personnage entouré de livres, de paysages naturels et de musique, symbolisant ma curiosité et mon amour pour la nature. La scène mélange des éléments du surréalisme et du street art.

J’ai aussi cherché à capturer une variété de mes traits personnels à travers des créations plus introspectives. Mes invites ont donné naissance à des visuels inattendus :

Images personnelles (ironique et sérieuse) :

Invite : "Un individu avec une tasse de café, un smartphone et un livre, tandis qu’une horloge s’écroule dans le décor. Style inspiré de Salvador Dalí."




Ces créations m’ont permis de découvrir de nouvelles facettes de ma personnalité et de réfléchir sur la manière dont mes contradictions peuvent se traduire en art.

Stéréotypes culturels :
J’ai également exploré les stéréotypes culturels de manière humoristique, en créant des images décalées. Par exemple, l’image d’un Français mangeant une baguette sous la Tour Eiffel ou d’un Anglais buvant du thé, représentés dans un style caricatural. Ces stéréotypes, bien que amusants, révèlent souvent des perceptions simplifiées de nos cultures.

Les images produites ont capturé l’essence de ces clichés de manière expressive :


Stéréotypes sur ma culture que je trouve amusants ou absurdes :


Les Français portent tous un béret et mangent une baguette à longueur de journée.


Les Espagnols font toujours la siesta et passent leur vie à faire la fête.


Les Anglais boivent du thé à chaque heure de la journée, même sous la pluie.





Stéréotypes culturels amusants :

Invite 1 : "Un Français assis à côté d’un panier rempli de baguettes, avec un béret et une Tour Eiffel miniature dans les mains. Style caricature."




Invite 2 : "Un Espagnol allongé sous un parasol, avec un éventail à la main, pendant qu’un danseur de flamenco fait la fête à côté. Style humoristique et vivant."



Conclusion

Ce projet m'a offert une occasion unique de réfléchir à la manière dont nos identités culturelles se mélangent et de considérer l'impact des stéréotypes sur la perception des autres. Grâce à l’IA, j’ai exploré visuellement nos cultures et nos identités tout en prenant du plaisir à mettre en lumière les diverses facettes de notre existence.

Le processus de création avec l’IA :
J’ai expérimenté plusieurs plateformes pour générer des images. Chaque plateforme m’a permis d’expérimenter avec différents styles artistiques. La clé du succès a résidé dans la rédaction d’invites détaillées et réfléchies. J’ai puisé dans des références artistiques, telles que les mosaïques méditerranéennes ou l'esthétique vibrante du pop art, pour créer des visuels qui fusionnent harmonieusement les cultures tout en jouant avec les stéréotypes et les symboles universels.

Le processus a été itératif : après une première série d'images, j'ai affiné les descriptions pour obtenir des résultats plus précis et conformes à nos attentes. Il fallait parfois lui demander de retirer des éléments de l’image qui confondait l’IA. Par exemple, “Est-ce que tu peux enlever la danseuse de l’image? J’ai trouvé que si je lui demandais trop de choses, l’IA avait plus de mal à générer l’image que je cherchais. En général, DALL-E générait des images de meilleure qualité que DeepAI, mais DeepAI les générait plus rapidement.

Des exemples des créations artistiques


Par exemple, pour la section de Mélanges culturels :

Voici l’invite : "Une fusion des cultures française, espagnole et anglaise dans un tableau vibrant où la gastronomie, la danse, et les symboles architecturaux se mêlent dans une harmonie méditerranéenne. Style post-impressionniste."


Cette invite a produit une image fidèle à mes attentes dès le premier essai, sans besoin de modifications.



Images personnelles (ironique et sérieuse) :

Invite : "Un individu jonglant avec une tasse de café, un smartphone et un livre, tandis qu’une horloge s’écroule dans le décor. Style inspiré de Salvador Dalí."

Ici l’IA n’a pas été réaliste parce qu’elle a mis la tasse de café au-dessus du livre:



L’art comme reflet de l’identité :
Cette expérience a dépassé un simple exercice technique, ouvrant des discussions sur la perception de soi et des autres. Les images générées incarnent des récits et identités complexes, célébrant la richesse culturelle, déconstruisant les stéréotypes, et explorant l’identité avec créativité. J’ai compris que nos identités culturelles évoluent grâce aux échanges et au dialogue. L’intelligence artificielle, loin de supplanter la créativité humaine, peut l’amplifier, nous rappelant que l’essence d’une culture dépasse les clichés.

N’hésitez pas à partager vos réflexions en commentaires – à bientôt pour de nouvelles découvertes !

Merci de votre lecture!

¡Gracias por su atención!

Thank you for reading!

mercredi 15 janvier 2025

Les erreurs de l'IA

Sur la base de ces images :


Ces images se distinguent par un niveau élevé de détail et de réalisme, mais en les analysant attentivement, on peut examiner divers aspects qui suggèrent qu’elles ont probablement été créées par une IA.

Dans la première image, qui montre un ensemble de maisons rouges sur de petites îles dans un lac, les proportions des structures semblent totalement réalistes. Les dimensions des maisons correspondent à ce que l’on pourrait attendre dans un tel environnement, bien que leur distribution sur les îles soit un peu étrange, car ce n’est pas une position logique pour des habitations. Les ombres sont cohérentes, reflétant bien une journée nuageuse, où la lumière ne crée pas de contrastes marqués. Les textures des matériaux, comme les toits en bois usé, les rochers des îles et l’eau, sont très réalistes et détaillées. La perspective est également bien rendue, avec des angles qui correspondent à la topographie et aux niveaux du terrain.

En ce qui concerne les couleurs des éléments naturels, ils sont consistants et non artificiels. Le ciel grisâtre, l’eau aux teintes atténuées et les couleurs chaudes des feuilles en automne forment une harmonie visuelle. Les arbres ont une structure crédible, avec des branches et des feuilles réparties de manière naturelle. Les détails architecturaux, tels que les portes et les fenêtres, sont proportionnés et fonctionnels, sans anomalies visuelles comme des contours flous ou des distorsions. L’IA démontre une remarquable maîtrise de la palette de couleurs pour générer des paysages vraisemblables.

La deuxième image présente une maison de style rustique, semblable à une scène tirée d’un conte fantastique, avec des arcs en pierre et une couverture végétale sur le toit. Malgré son design inhabituel, les détails tels que les portes, les fenêtres et les escaliers sont proportionnés et semblent fonctionnels. Dans la première image, les maisons disposent d’escaliers et d’entrées adaptés à leur position surélevée, bien que certaines des marchés ne soient pas parfaitement finies (il faut bien observer pour le remarquer). Tandis que dans la seconde image, les arcs et les portes en bois sont cohérents avec le design général de la maison. L’éclairage, qui semble provenir d’une source de lumière solaire directe, génère des ombres cohérentes avec sa direction et son intensité. Les textures des matériaux, comme la pierre, le bois et l’enduit des murs, sont très détaillées et réalistes. La couleur de la végétation et de l’eau est cohérente et naturelle, et les éléments végétaux ont une structure biologique convaincante, comme on peut le voir dans la croissance de la couverture végétale et la disposition des plantes autour de la maison.

La perspective de cette deuxième image est également correcte, ce qui renforce la sensation de réalisme, tandis que les jonctions entre les éléments architecturaux, comme les murs et les toits, sont bien rendues et logiques. Aucune anomalie n’est détectée.

Aucun artefact visuel évident, tel que des contours doubles, des flous ou des distorsions, n’est observé, ce qui indique un niveau élevé de qualité dans la génération des images. Cela suggère que l’IA utilisée pour les créer emploie des algorithmes avancés pour éviter des défauts susceptibles de briser l’illusion de réalisme. L’absence d’imperfections, souvent présentes dans des photographies naturelles, et le niveau de détail des matériaux et des couleurs soutiennent également cette hypothèse.

Le haut niveau de détail et de cohérence dans ces images créées par une IA reflète la capacité de ces outils à simuler des scènes avec un réalisme impressionnant. Cependant, certains aspects, comme la perfection de la composition ou l’absence d’imperfections humaines, peuvent trahir leur origine. La simulation précise des matériaux, de l’éclairage, des textures et des structures biologiques indique un design méticuleux et des algorithmes bien entraînés à partir de données réelles. Ces images illustrent clairement les progrès des capacités de l’IA à créer des mondes visuels qui défient notre perception de la réalité.

L’IA prend généralement beaucoup de libertés lors de la création des images, donc vous devez souvent refaire l’image qu’elle offre ou lui donner trop d’indications pour créer quelque chose qui ressemble à ce que vous voulez. Souvent il ne comprend pas les concepts simples ou les ordres basiques, créant des images qui n’ont rien à voir avec le sujet désiré. L’IA est généralement bonne pour créer des paysages ou des choses simples, quand il faut entrer dans les détails, c’est quand vous remarquez le plus leurs erreurs, que ce soit dans les mains des personnages ou sur des objets sans sens de l’arrière-plan.

Ici, je laisse un exemple d’une image créée avec l’IA qui n’a presque rien à voir avec la commande donnée:

Les instructions étaient "un médecin préparant le patient pour une opération" et ici vous voyez comment l’IA a décidé de créer une image qui ne correspond pas à ce que serait vraiment un médecin anesthésier un patient avant d’opérer. Si j’avais suivi les instructions, j’aurais pu obtenir l’image souhaitée.

En conclusion, je pense que le principal problème lors de l’utilisation de l’IA pour créer des images est d’avoir à donner beaucoup d’indications.

Les biais de l'IA


5 images avec cette invite:  

Photo de studio de deux êtres humains qui s'embrassent

 





 

En observant les images fournies par l'IA, on identifie des motifs récurrents dans les positions corporelles, les dynamiques de représentation et les éléments visuels. Ceux-ci reflètent à la fois des intentions spécifiques et de possibles biais du système qui a généré les images. Voici quelques points clés :

 

POSITIONS CORPORELLES

Dans les images, on observe une nette tendance à montrer les couples dans des positions de proximité physique et d’intimité. Les têtes sont inclinées vers l’avant ou sur le côté, ce qui met en avant le contact émotionnel et physique entre les personnes ou les couples. Ce procédé est courant dans les compositions cherchant à souligner une connexion affective. De plus, les cadrages sont rapprochés, se concentrant uniquement sur les visages et la partie supérieure du corps, ce qui accentue l’intimité des couples.

REPRÉSENTATION DES COUPLES

Dans l’ensemble, il y a plusieurs représentations de couples hétérosexuels et un couple homosexuel masculin, ce qui suggère une intention de l’IA d’inclure une certaine diversité en termes d’orientation sexuelle. Concernant les traits physiques, on remarque une prédominance de phénotypes caucasiens : des teints clairs et des caractéristiques faciales associées à ce groupe. Les femmes apparaissent toutes avec des cheveux châtains et ondulés/frisés, tandis que les coiffures des hommes varient selon les photos (courts-longs/frisés-lisses). Cela suggère un biais en faveur des standards occidentaux, probablement dû aux données utilisées lors de l’entraînement de l’IA.

ZONES DE CONTACT ET LE REGARD

Les zones de contact, comme les baisers, les caresses et les étreintes, sont prises avec soin. Cela souligne l’importance du geste affectif dans le visuel. Cependant, il est courant que les IA présentent de petites imprécisions dans les zones de contact physique, en particulier au niveau des mains, qui peuvent parfois apparaître avec des formes ou des proportions étranges. Dans ces images, on peut noter de légères imperfections, difficiles à détecter à première vue et sans observation attentive.

Un élément constant dans les images est la représentation de regards doux, tournés vers l’autre personne, ce qui renforce la sensation de connexion émotionnelle. Bien que la plupart des personnages apparaissent les yeux fermés dans un contexte heureux, on peut deviner l’affection qu’ils éprouvent les uns pour les autres.

COMPARAISON AVEC LES REPRÉSENTATIONS HUMAINES RÉELLES

En général, les images générées semblent privilégier la perfection esthétique et émotionnelle, créant une représentation trop idéalisée des relations humaines. Ce type de résultat met en lumière les biais présents dans les données d’entraînement des générateurs d’images, où les standards de beauté et d’affection occidentaux et hétérocentrés dominent souvent. En outre, la diversité culturelle et phénotypique peut être reléguée au second plan, limitant la représentation de différents groupes humains.

En résumé, ces images présentent une narration visuelle axée sur l’idéalisation des relations affectives, avec une emphase sur la connexion émotionnelle et la beauté esthétique. Cependant, la nécessité d’une plus grande inclusion et diversité dans les résultats est évidente, tant sur le plan culturel que dans les dynamiques de représentation des genres et des orientations sexuelles.

¿ Message d'erreur, de mise en garde ou de menace de suspension du compte ? 

Dans cette recherche, je n’ai reçu aucun message d’erreur, d’avertissement ou de menace de suspension pour les images que je demandais à l’IA. Cependant, il est important de reconnaître que certaines plateformes et systèmes de génération de contenu appliquent souvent des politiques strictes concernant le contenu jugé inapproprié. Ce type de politiques est souvent conçu pour s’aligner sur les réglementations locales ou les normes culturelles spécifiques, ce qui peut entraîner la censure ou la limitation de certains types de représentations.

Les limites de l’IA autour du « contenu explicite » 

Les limites de l’IA en matière de contenu explicite sont fortement influencées par les valeurs culturelles et sociales prédominantes dans les contextes où elle est développée. En général, les systèmes d’IA tendent à éviter les représentations qui incluent la nudité, les organes génitaux exposés ou des gestes sexuels explicites, même s’ils sont consentis ou artistiques. Cependant, cette approche reflète également des biais culturels spécifiques.

Dans les images présentées, le baiser est représenté comme un geste de connexion émotionnelle et d’affection, sans aucun signe de contenu explicite. Cependant, dans certaines cultures ou contextes sociaux où le contact physique en public est restreint, un baiser peut être interprété comme une expression explicite ou controversée. Ce phénomène peut être amplifié si le baiser concerne des couples de même sexe, comme c’est le cas dans l’une des images.

En revanche, les armes sont culturellement associées à la violence et au conflit, mais elles sont souvent perçues différemment selon le contexte. Par exemple, dans les films d’action ou les jeux vidéo, les armes sont généralement considérées comme acceptables, tandis que les baisers ou l’intimité peuvent être soumis à une censure plus stricte. Ce double standard reflète comment les notions de « contenu explicite » sont influencées par des hiérarchies culturelles qui tendent à normaliser la violence tout en restreignant les expressions d’affection.

Comparaison entre les images générées par IA et les images réelles

Les images générées par IA présentent des similitudes et des différences clés par rapport aux images réelles :

Similitudes :

 Les images générées cherchent à capturer des émotions humaines réelles, en représentant des gestes, des regards et des contacts physiques de manière convaincante. De plus, l’éclairage et l’esthétique chaleureuse de certaines d’entre elles rappellent des photographies professionnelles, transmettant une sensation d’intimité et d’affection.

Différences :

Idéalisation : L’IA a tendance à idéaliser les relations et les traits physiques, en montrant des scénarios esthétiquement parfaits qui ne reflètent pas toujours la diversité et la complexité des émotions humaines réelles.

Biais : Les systèmes d’IA représentent souvent de manière disproportionnée des phénotypes caucasiens et des couples hétéro-normatifs, ce qui limite la diversité culturelle et ethnique dans les images générées.

Erreurs techniques : Les zones de contact physique (comme les mains et les lèvres) sont souvent imparfaites dans les images créées par IA, ce qui n’est pas le cas dans les photographies réelles.

Conclusion

Les images analysées montrent comment l’IA s’efforce de représenter les relations affectives de manière idéalisée et soigneusement mesurée pour éviter les controverses. Le baiser, dans ce contexte, n’est pas perçu comme un contenu explicite, mais comme un symbole de connexion émotionnelle, bien que cela puisse varier selon le cadre culturel.

L’association du baiser à un contenu explicite, et la normalisation de la violence à travers les armes, démontre les doubles standards culturels qui sous-tendent les définitions de contenu acceptable. Ces limites sont tracées par des entités qui reflètent des valeurs et des sensibilités culturelles spécifiques, ce qui met en évidence les biais et inégalités dans les représentations générées par l’IA.

Pour progresser vers une représentation plus inclusive et équitable, il est nécessaire de remettre en question ces limites et de promouvoir la diversité dans les données et dans les décisions qui façonnent les normes de ces technologies.

Les erreurs de l'IA

Dans l'image créée par l'IA, nous pouvons observer certains défauts que nous commenterons ci-après. Tout d'abord, il convient de parler de la taille des objets : on peut constater qu'elle manque de cohérence. Si nous regardons les gratte-ciels à l'arrière-plan, ils sont à la même hauteur que les arbres, ce qui est impossible dans la réalité. Un autre élément frappant concerne les personnes, en général, l'IA a du mal à les représenter correctement. Par exemple, le visage de la femme à gauche est flou, tandis que celui de l'homme à droite est très petit par rapport à son corps. L'auvent au-dessus du garçon semble provenir d'un endroit indéterminé, comme s'il était collé au balcon, ce qui est également un peu étrange. Dans le petit étang au centre de l'image, on ne voit pas le reflet de la maison, seulement celui des arbres. Les personnes n'ont pas d'ombre, alors qu'en plein jour, elles devraient en avoir. En nous concentrant sur les textures des matériaux, elles paraissent peu réalistes : les pierres du mur, les métaux des balcons, les briques du toit ne me semblent pas très réalistes, pour être honnête. De manière générale, l'image est réalisée avec des couleurs très vives, ce qui n'est pas le cas dans la réalité. Les arbres sont d'un vert très intense, peu naturel, sans une seule feuille d'une autre couleur. Le ciel a une teinte très claire, presque idéale, et l'étang semble être l'élément le mieux réussi, selon moi. En outre, la ville paraît très idéalisée et peu réaliste, car il semble étrange de trouver une telle végétation dense et verte au milieu de tant de gratte-ciel et de pollution. Les arbres près de l'étang n'ont pas de tronc, et on ne sait pas très bien d'où ils sortent. De manière générale, l'image est aussi très pixelisée et un peu déformée. Je pense que l'IA progresse beaucoup et peut être un outil utile si elle est bien utilisée, mais en ce qui concerne la création d'images, il reste encore beaucoup de chemin à parcourir, car elle continue de commettre de nombreuses erreurs. Dans ce type d'IA, vous la dirigez petit à petit, vous lui demandez ce que vous voulez, et elle vous fournit un résultat en fonction de ce qu'elle comprend. Souvent, elle ne prend pas en compte certains aspects, et vous devez le lui répéter, et même ainsi, il est possible que vous n'obteniez pas le résultat souhaité. Il est important de garder à l'esprit qu'une IA n'est pas une personne, et donc, elle commettra de nombreuses erreurs. Il est crucial d'en être conscient pour pouvoir les identifier et les corriger. En général, les erreurs les plus courantes à surveiller concernent les proportions des objets, les représentations humaines, qui sont souvent mal réalisées, la végétation, qui n'est généralement pas très réaliste, et les détails architecturaux. Cela peut être dû au fait que ces détails sont très minutieux et spécifiques, nécessitant donc une plus grande expertise pour être bien réalisés. Pour conclure, de manière générale, ce type d'images n'est pas très réaliste, mais l'IA s'améliore peu à peu, et il faudra rester vigilant pour distinguer celles créées par IA de celles qui ne le sont pas. Mireia Ivorra Roselló