{"id":2681,"date":"2026-05-01T02:24:13","date_gmt":"2026-05-01T02:24:13","guid":{"rendered":"https:\/\/deepinsightai.io\/?p=2681"},"modified":"2026-05-01T02:24:14","modified_gmt":"2026-05-01T02:24:14","slug":"sensenova-u1","status":"publish","type":"post","link":"https:\/\/deepinsightai.io\/fr\/sensenova-u1\/","title":{"rendered":"SenseNova U1 : L'IA multimodale open-source red\u00e9finit la g\u00e9n\u00e9ration et la compr\u00e9hension d'images"},"content":{"rendered":"<p>La bataille mondiale autour de la g\u00e9n\u00e9ration d'images par IA bat son plein. La semaine derni\u00e8re encore, OpenAI a officiellement d\u00e9voil\u00e9 GPT Image 2, laissant tout Internet bouche b\u00e9e. Qu'il s'agisse d'images pour le commerce en ligne en direct, de photos nostalgiques inspir\u00e9es des ann\u00e9es 90 ou de sch\u00e9mas conceptuels complexes, les d\u00e9monstrations \u00e9poustouflantes se succ\u00e8dent et inondent les fils d'actualit\u00e9 partout dans le monde.<\/p>\n\n\n\n<p>Inutile de se poser la question : la g\u00e9n\u00e9ration d'images par IA a clairement franchi une nouvelle \u00e9tape.<\/p>\n\n\n\n<p>En l'espace de quelques jours seulement, SenseTime, un g\u00e9ant chinois de la technologie, a r\u00e9agi rapidement en sortant un tout nouvel atout : <strong>SenseNova U1<\/strong>. Ce mod\u00e8le multimodal de compr\u00e9hension et de g\u00e9n\u00e9ration place la \u201c compr\u00e9hension des images \u201d et la \u201c g\u00e9n\u00e9ration d'images \u201d au sein d'un m\u00eame cerveau.<\/p>\n\n\n\n<p>Sa principale avanc\u00e9e r\u00e9side dans une \u201c architecture de mod\u00e8le unifi\u00e9e \u201d d\u00e9velopp\u00e9e en interne, baptis\u00e9e NEO-Unify, qui int\u00e8gre la compr\u00e9hension, le raisonnement et la g\u00e9n\u00e9ration au sein d'un m\u00eame syst\u00e8me.<\/p>\n\n\n\n<p>Mais surtout, ils ne l'ont pas gard\u00e9 ferm\u00e9. <strong>SenseNova U1<\/strong> est d\u00e9sormais enti\u00e8rement open source sur GitHub, et de nombreux utilisateurs ont d\u00e9j\u00e0 commenc\u00e9 \u00e0 l'exp\u00e9rimenter. M\u00eame les experts en IA de Hugging Face et du MLS Super Intelligence Lab suivent son \u00e9volution de pr\u00e8s et lui donnent leur aval.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Mod\u00e8les SenseNova U1 Lite : petite taille, grand impact<\/h2>\n\n\n\n<p>Cette version inclut la s\u00e9rie \u00ab lightweight \u00bb <strong>SenseNova U1 Lite<\/strong>, disponible en deux versions :<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Variantes du mod\u00e8le SenseNova U1<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li>SenseNova-U1-8B-MoT : bas\u00e9 sur un r\u00e9seau de structure dense<\/li>\n\n\n\n<li>SenseNova-U1-A3B-MoT : bas\u00e9 sur un r\u00e9seau de base MoE<\/li>\n<\/ul>\n\n\n\n<p>Les param\u00e8tres peuvent para\u00eetre \u201c modestes \u201d, mais les performances d\u00e9passent largement les attentes. D\u2019apr\u00e8s plusieurs tests de performance, <strong>SenseNova U1<\/strong> fait preuve de performances sup\u00e9rieures dans tous les domaines, atteignant les niveaux de pointe (SOTA) parmi les mod\u00e8les open source de taille similaire.<\/p>\n\n\n\n<p>Plus surprenant encore, sur plusieurs indicateurs, il se rapproche \u2014 voire d\u00e9passe \u2014 certains grands mod\u00e8les commerciaux propri\u00e9taires.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 : g\u00e9n\u00e9ration continue d'images et de textes<\/h2>\n\n\n\n<p>Avant d'entrer dans les d\u00e9tails techniques, regardons quelques d\u00e9monstrations concr\u00e8tes pour nous faire une id\u00e9e des limites de <strong>SenseNova U1<\/strong> capacit\u00e9s.<\/p>\n\n\n\n<p>Son principal atout r\u00e9side dans la g\u00e9n\u00e9ration continue d'images et de textes, rendue possible gr\u00e2ce \u00e0 la technologie originale de SenseTime dite \u00ab cha\u00eene de pens\u00e9e entrelac\u00e9e image-texte \u00bb.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Esquisse architecturale avec SenseNova U1<\/h3>\n\n\n\n<p>Prenons l'exemple de la cr\u00e9ation d'un croquis \u00e9tape par \u00e9tape d'une cath\u00e9drale gothique. Au cours de son processus de raisonnement, <strong>SenseNova U1<\/strong> analyse en d\u00e9tail l'esth\u00e9tique architecturale complexe, presque \u00e0 la mani\u00e8re d'un \u201c architecte \u201d dot\u00e9 d'une grande capacit\u00e9 de r\u00e9flexion spatiale.<\/p>\n\n\n\n<p>Par le pass\u00e9, garantir la coh\u00e9rence entre plusieurs images g\u00e9n\u00e9r\u00e9es constituait l'un des principaux d\u00e9fis. Or, dans cette d\u00e9monstration, depuis les contours sommaires jusqu'au r\u00e9sultat final richement orn\u00e9, la structure principale, le nombre d'arcs-boutants et m\u00eame les motifs des rosaces restent align\u00e9s de mani\u00e8re quasi parfaite.<\/p>\n\n\n\n<p>Ce niveau de coh\u00e9rence donne l'impression d'assister \u00e0 une v\u00e9ritable d\u00e9monstration de conception, propice \u00e0 l'apprentissage.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">G\u00e9n\u00e9ration de conceptions multi-angles avec SenseNova U1<\/h3>\n\n\n\n<p>Encore un sujet simple : concevez une biblioth\u00e8que situ\u00e9e sur une falaise en bord de mer et pr\u00e9sentez-la sous diff\u00e9rents angles.<\/p>\n\n\n\n<p>Cinq points de vue, cinq extraits de texte, cinq images \u2014 s\u2019alternant rigoureusement et s\u2019encha\u00eenant de mani\u00e8re logique. De l\u2019ext\u00e9rieur \u00e0 l\u2019int\u00e9rieur, de la structure \u00e0 l\u2019atmosph\u00e8re, du jour au cr\u00e9puscule, chaque \u201c pens\u00e9e \u201d est directement mise en images.<\/p>\n\n\n\n<p>Le texte explique l'intention de conception ; les images permettent de la valider visuellement. Les deux se compl\u00e8tent mutuellement.<\/p>\n\n\n\n<p>Ce qui est encore plus frappant, c'est la coh\u00e9rence stylistique qui se d\u00e9gage des cinq images : l'architecture, les mat\u00e9riaux et les palettes de couleurs s'inscrivent tous dans le m\u00eame concept de design.<\/p>\n\n\n\n<p>Voil\u00e0 \u00e0 quoi devrait ressembler le fait de \u201c r\u00e9fl\u00e9chir tout en dessinant \u201d.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 : narration et cr\u00e9ation artistique<\/h2>\n\n\n\n<h3 class=\"wp-block-heading\">R\u00e9cits sous forme de BD avec SenseNova U1<\/h3>\n\n\n\n<p>En quelques \u00e9tapes simples, <strong>SenseNova U1<\/strong> peut donner lieu \u00e0 une histoire de bande dessin\u00e9e.<\/p>\n\n\n\n<p>Le rythme, articul\u00e9 en quatre cases, est pr\u00e9cis : d\u2019une lumi\u00e8re isol\u00e9e au milieu de ruines cybern\u00e9tiques \u00e0 des robots se rassemblant autour d\u2019un vieil homme en train de lire, puis \u00e0 un gros plan sur des larmes coulant sur des pages, pour finir par un plan d\u2019ensemble sur une longue ligne d\u2019horizon. La progression \u00e9motionnelle se construit couche apr\u00e8s couche.<\/p>\n\n\n\n<p>Les personnages et les sc\u00e8nes gardent une coh\u00e9rence tout au long de l'\u0153uvre, gr\u00e2ce \u00e0 <strong>SenseNova U1<\/strong>\u2019l\u2019int\u00e9gration native de la compr\u00e9hension et de la g\u00e9n\u00e9ration d\u2019images et de textes.<\/p>\n\n\n\n<p>D'une case \u00e0 l'autre, il ajoute m\u00eame de lui-m\u00eame des d\u00e9tails narratifs \u2014 comme en nommant la \u201c Tour silencieuse \u201d, en d\u00e9crivant des doigts qui effleurent des traces us\u00e9es par le temps, ou encore en opposant les larmes aux pages jaunies. Le texte lui-m\u00eame se lit comme une mini-histoire de science-fiction, tandis que les images illustrent les moments d'intensit\u00e9 \u00e9motionnelle.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">G\u00e9n\u00e9ration d'images dans diff\u00e9rents styles avec SenseNova U1<\/h3>\n\n\n\n<p>Demandez-lui de dessiner un loup dans diff\u00e9rents styles, et vous obtiendrez des illustrations de style ukiyo-e, art d\u00e9co et expressionniste, toutes pr\u00e9sent\u00e9es les unes apr\u00e8s les autres.<\/p>\n\n\n\n<p>Il peut m\u00eame g\u00e9n\u00e9rer des r\u00e9sultats de type infographie \u00e0 haute dimension, similaires \u00e0 des diapositives, tout en conservant une coh\u00e9rence structurelle et visuelle gr\u00e2ce \u00e0 un contexte commun.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 pour l'infographie et la visualisation des connaissances<\/h2>\n\n\n\n<p><strong>SenseNova U1<\/strong> peut \u00e9galement expliquer des probl\u00e8mes du quotidien \u00e0 l'aide d'associations image-texte, ce qui les rend intuitifs et captivants.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Infographie sur le caf\u00e9 r\u00e9alis\u00e9e par SenseNova U1<\/h3>\n\n\n\n<p>Consigne : r\u00e9digez un guide sur le caf\u00e9 pr\u00e9par\u00e9 \u00e0 la main.<\/p>\n\n\n\n<p><strong>SenseNova U1<\/strong> Il commence par r\u00e9fl\u00e9chir, puis recherche les informations pertinentes et d\u00e9veloppe la consigne pour en faire une infographie d\u00e9taill\u00e9e. Le r\u00e9sultat final comprend huit \u00e9tapes bien articul\u00e9es entre elles, qui couvrent avec pr\u00e9cision l'ensemble du processus, de la mouture des grains \u00e0 l'extraction.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Visualisation du cycle de l'eau avec SenseNova U1<\/h3>\n\n\n\n<p>Autre exemple : \u201c le parcours du cycle de l'eau \u201d.\u201d<\/p>\n\n\n\n<p><strong>SenseNova U1<\/strong> Il recherche et compile des connaissances, pour produire un sch\u00e9ma ultra-clair de 2K qui reconstitue tous les \u00e9l\u00e9ments g\u00e9ographiques cl\u00e9s : rayonnement solaire, \u00e9vaporation, condensation, transport, pr\u00e9cipitations et ruissellement.<\/p>\n\n\n\n<p>Chaque \u00e9tape s'appuie pr\u00e9cis\u00e9ment sur la pr\u00e9c\u00e9dente.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Infographies \u00e0 haute densit\u00e9 g\u00e9n\u00e9r\u00e9es par SenseNova U1<\/h3>\n\n\n\n<p>Une consigne de six mots peut g\u00e9n\u00e9rer une infographie compl\u00e8te sur la past\u00e8que, abordant ses valeurs nutritionnelles, ses bienfaits pour la sant\u00e9 et des conseils de consommation \u2014 pr\u00eate \u00e0 \u00eatre publi\u00e9e sous forme d'article complet.<\/p>\n\n\n\n<p>Il peut \u00e9galement cr\u00e9er des guides de trajets domicile-travail tr\u00e8s complexes, des bandes dessin\u00e9es sur la reconversion professionnelle dans un style pop art, et m\u00eame des infographies sur les petits-d\u00e9jeuners du monde entier \u00e0 la mani\u00e8re des LEGO, en reconstituant des plats embl\u00e9matiques de pays tels que le Japon, le Mexique, le Royaume-Uni, la Turquie, le Br\u00e9sil et l'Inde.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">Architecture SenseNova U1 : pr\u00e9sentation de NEO-Unify<\/h2>\n\n\n\n<p><strong>SenseNova U1<\/strong>\u2019Les performances impressionnantes de ce mod\u00e8le soul\u00e8vent une question fondamentale : comment un mod\u00e8le relativement petit peut-il atteindre un tel niveau ?<\/p>\n\n\n\n<p>La r\u00e9ponse r\u00e9side dans son architecture.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">De l'IA modulaire au mod\u00e8le unifi\u00e9 SenseNova U1<\/h3>\n\n\n\n<p>Les mod\u00e8les multimodaux traditionnels suivent une approche \u201c modulaire \u201d :<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Encodeur visuel (VE) pour la vision<\/li>\n\n\n\n<li>Auto-encodeur variationnel (VAE) pour le dessin<\/li>\n\n\n\n<li>Mod\u00e8le linguistique \u00e0 grande \u00e9chelle (LLM) d\u00e9di\u00e9 au raisonnement<\/li>\n<\/ul>\n\n\n\n<p>Ces composants sont entra\u00een\u00e9s s\u00e9par\u00e9ment, puis combin\u00e9s. Cela fonctionne, mais la perception et la cr\u00e9ation restent dissoci\u00e9es.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">NEO-Unify : le c\u0153ur de SenseNova U1<\/h3>\n\n\n\n<p>NEO-Unify prend une mesure audacieuse : il supprime \u00e0 la fois le VE et le VAE.<\/p>\n\n\n\n<p>Ce concept repose sur un postulat fondamental : le langage et l'information visuelle sont intrins\u00e8quement li\u00e9s et doivent \u00eatre mod\u00e9lis\u00e9s comme une entit\u00e9 unique.<\/p>\n\n\n\n<p>Au lieu d'une conversion entre les syst\u00e8mes, <strong>SenseNova U1<\/strong> agit comme un penseur bilingue, en traitant simultan\u00e9ment les informations visuelles et linguistiques d\u00e8s le d\u00e9part.<\/p>\n\n\n\n<h3 class=\"wp-block-heading\">Parcours technique de SenseNova U1<\/h3>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Interface visuelle quasi sans perte pour une repr\u00e9sentation unifi\u00e9e des entr\u00e9es et sorties<\/li>\n\n\n\n<li>Architecture native \u00ab Mixture-of-Transformers \u00bb (MoT)<\/li>\n\n\n\n<li>Une base commune pour la compr\u00e9hension et la cr\u00e9ation<\/li>\n\n\n\n<li>Apprentissage conjoint : texte via l'entropie crois\u00e9e autor\u00e9gressive, vision via la correspondance de flux de pixels<\/li>\n<\/ul>\n\n\n\n<p>Des exp\u00e9riences montrent que, m\u00eame lorsque la branche de compr\u00e9hension est fig\u00e9e, la branche de g\u00e9n\u00e9ration est toujours capable de restituer des d\u00e9tails visuels tr\u00e8s fins. Cela sugg\u00e8re que la repr\u00e9sentation unifi\u00e9e conserve \u00e0 la fois la richesse s\u00e9mantique et la fid\u00e9lit\u00e9 au niveau des pixels.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 contre GPT-Image-2<\/h2>\n\n\n\n<p>Il y a tout juste une semaine, GPT-Image-2 (<a href=\"https:\/\/deepinsightai.io\/fr\/chatgpt-images-2-0\/\">Images ChatGPT 2.0<\/a>) a \u00e9tabli une nouvelle r\u00e9f\u00e9rence gr\u00e2ce \u00e0 un rendu de texte quasi parfait et \u00e0 des fonctionnalit\u00e9s d'\u00e9dition en plusieurs \u00e9tapes.<\/p>\n\n\n\n<p>Mais, fondamentalement, il s'agit toujours d'un \u201c mod\u00e8le sp\u00e9cialis\u00e9 dans la g\u00e9n\u00e9ration d'images \u201d.\u201d<\/p>\n\n\n\n<p><strong>SenseNova U1<\/strong> emprunte une voie diff\u00e9rente. Il ne sert pas uniquement \u00e0 g\u00e9n\u00e9rer des images : il s'agit d'un mod\u00e8le nativement unifi\u00e9 qui prend en charge :<\/p>\n\n\n\n<ul class=\"wp-block-list\">\n<li>Compr\u00e9hension des images<\/li>\n\n\n\n<li>Raisonnement visuel<\/li>\n\n\n\n<li>Pens\u00e9e entre image et texte entrelac\u00e9es<\/li>\n\n\n\n<li>Cr\u00e9ation d'infographies<\/li>\n<\/ul>\n\n\n\n<p>Tout cela repose sur la m\u00eame architecture, la m\u00eame formation, le m\u00eame mod\u00e8le.<\/p>\n\n\n\n<p>Et surtout, <strong>SenseNova U1<\/strong> est open source.<\/p>\n\n\n\n<p>Pour les d\u00e9veloppeurs qui ont besoin d'un d\u00e9ploiement priv\u00e9, d'une personnalisation pouss\u00e9e ou d'une int\u00e9gration multimodale dans leurs produits, <strong>SenseNova U1<\/strong> offre une possibilit\u00e9 que GPT-Image-2 ne propose pas.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 et la voie vers l'IA g\u00e9n\u00e9rale<\/h2>\n\n\n\n<p>Si l'on consid\u00e8re la situation dans son ensemble, la \u201c bataille de la g\u00e9n\u00e9ration d'images \u201d actuelle s'inscrit toujours dans un paradigme fragment\u00e9 : un meilleur rendu, une r\u00e9solution plus \u00e9lev\u00e9e, davantage de styles.<\/p>\n\n\n\n<p>Il s'agit l\u00e0 d'am\u00e9liorations progressives, et non de changements de paradigme.<\/p>\n\n\n\n<p>Vrai <a href=\"https:\/\/deepinsightai.io\/fr\/geoffrey-hinton-warns-about-agi\/\">AGI<\/a> ne sera pas un assemblage disparate de modules sp\u00e9cialis\u00e9s. Le cerveau humain n\u2019est pas une combinaison m\u00e9canique de syst\u00e8mes distincts d\u00e9di\u00e9s au langage, \u00e0 la vision et \u00e0 l\u2019action : c\u2019est une entit\u00e9 cognitive unifi\u00e9e.<\/p>\n\n\n\n<p>L'IA multimodale \u00e9voluera \u00e0 terme vers une unification native.<\/p>\n\n\n\n<p><strong>SenseNova U1<\/strong>, qui s'appuie sur la technologie NEO-Unify, est l'une des premi\u00e8res architectures \u00e0 int\u00e9grer pleinement ce concept, ce qui lui conf\u00e8re une valeur unique tant sur le plan acad\u00e9mique que sur le plan technique.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 Future : la version 8B n'est qu'un d\u00e9but<\/h2>\n\n\n\n<p>SenseTime l'a clairement indiqu\u00e9 : <strong>SenseNova U1 Lite<\/strong> Il ne s'agit que de la version all\u00e9g\u00e9e. Des mod\u00e8les \u00e0 plus grande \u00e9chelle bas\u00e9s sur NEO-Unify sont en cours de d\u00e9veloppement.<\/p>\n\n\n\n<p>Ils estiment qu'avec une architecture native efficace, il est possible d'atteindre des performances de haut niveau \u00e0 un co\u00fbt de calcul bien moindre.<\/p>\n\n\n\n<p>La conclusion est claire : si le mod\u00e8le 8B atteint d\u00e9j\u00e0 l'\u00e9tat de l'art en mati\u00e8re d'open source, passer \u00e0 des dizaines de milliards de param\u00e8tres pourrait amplifier encore davantage l'avantage architectural.<\/p>\n\n\n\n<h2 class=\"wp-block-heading\">SenseNova U1 marque un nouveau tournant<\/h2>\n\n\n\n<p>L'IA multimodale est en pleine mutation : elle passe d'un assemblage modulaire \u00e0 une unification native.<\/p>\n\n\n\n<p>La mise en open source de <strong>SenseNova U1<\/strong> Ce n'est qu'une premi\u00e8re \u00e9tape. Mais \u00e0 en juger par les r\u00e9sultats actuels, c'est d\u00e9j\u00e0 un pas solide.<\/p>\n\n\n\n<p>La direction que prendra finalement cette voie d\u00e9pendra peut-\u00eatre de la communaut\u00e9 mondiale des d\u00e9veloppeurs.<\/p>\n\n\n\n<p>Le code et les pond\u00e9rations sont d\u00e9j\u00e0 disponibles.<\/p>\n\n\n\n<p>Ce qui va se passer ensuite, c'est \u00e0 vous de d\u00e9cider.<\/p>","protected":false},"excerpt":{"rendered":"<p>The global AI image generation battle is in full swing. Just last week, OpenAI officially unveiled GPT Image 2, leaving the entire internet stunned. Whether it\u2019s livestream e-commerce visuals, nostalgic 90s-style photos, or complex knowledge diagrams, one mind-blowing demo after another has flooded feeds everywhere. No need to ask\u2014AI image generation has clearly evolved to [&hellip;]<\/p>\n","protected":false},"author":1,"featured_media":2684,"comment_status":"closed","ping_status":"closed","sticky":false,"template":"","format":"standard","meta":{"_seopress_robots_primary_cat":"none","_seopress_titles_title":"%%post_title%%","_seopress_titles_desc":"SenseNova U1 is a breakthrough open-source multimodal model that unifies image understanding and generation. Explore its NEO-Unify architecture, powerful demos, and why it\u2019s reshaping the AI image generation landscape.","_seopress_robots_index":"","_uag_custom_page_level_css":"","site-sidebar-layout":"default","site-content-layout":"","ast-site-content-layout":"default","site-content-style":"default","site-sidebar-style":"default","ast-global-header-display":"","ast-banner-title-visibility":"","ast-main-header-display":"","ast-hfb-above-header-display":"","ast-hfb-below-header-display":"","ast-hfb-mobile-header-display":"","site-post-title":"","ast-breadcrumbs-content":"","ast-featured-img":"","footer-sml-layout":"","ast-disable-related-posts":"","theme-transparent-header-meta":"","adv-header-id-meta":"","stick-header-meta":"","header-above-stick-meta":"","header-main-stick-meta":"","header-below-stick-meta":"","astra-migrate-meta-layouts":"set","ast-page-background-enabled":"default","ast-page-background-meta":{"desktop":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"ast-content-background-meta":{"desktop":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"tablet":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""},"mobile":{"background-color":"var(--ast-global-color-5)","background-image":"","background-repeat":"repeat","background-position":"center center","background-size":"auto","background-attachment":"scroll","background-type":"","background-media":"","overlay-type":"","overlay-color":"","overlay-opacity":"","overlay-gradient":""}},"footnotes":""},"categories":[2],"tags":[],"class_list":["post-2681","post","type-post","status-publish","format-standard","has-post-thumbnail","hentry","category-ai-news"],"uagb_featured_image_src":{"full":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding.webp",1536,1024,false],"thumbnail":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding-150x150.webp",150,150,true],"medium":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding-300x200.webp",300,200,true],"medium_large":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding-768x512.webp",768,512,true],"large":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding-1024x683.webp",1024,683,true],"1536x1536":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding.webp",1536,1024,false],"2048x2048":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding.webp",1536,1024,false],"trp-custom-language-flag":["https:\/\/deepinsightai.io\/wp-content\/uploads\/2026\/05\/SenseNova-U1-Open-Source-Multimodal-AI-Redefining-Image-Generation-and-Understanding-18x12.webp",18,12,true]},"uagb_author_info":{"display_name":"Claude Carter","author_link":"https:\/\/deepinsightai.io\/fr\/author\/cloud-han03gmail-com\/"},"uagb_comment_info":0,"uagb_excerpt":"The global AI image generation battle is in full swing. Just last week, OpenAI officially unveiled GPT Image 2, leaving the entire internet stunned. Whether it\u2019s livestream e-commerce visuals, nostalgic 90s-style photos, or complex knowledge diagrams, one mind-blowing demo after another has flooded feeds everywhere. No need to ask\u2014AI image generation has clearly evolved to\u2026","_links":{"self":[{"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/posts\/2681","targetHints":{"allow":["GET"]}}],"collection":[{"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/posts"}],"about":[{"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/types\/post"}],"author":[{"embeddable":true,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/users\/1"}],"replies":[{"embeddable":true,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/comments?post=2681"}],"version-history":[{"count":1,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/posts\/2681\/revisions"}],"predecessor-version":[{"id":2685,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/posts\/2681\/revisions\/2685"}],"wp:featuredmedia":[{"embeddable":true,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/media\/2684"}],"wp:attachment":[{"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/media?parent=2681"}],"wp:term":[{"taxonomy":"category","embeddable":true,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/categories?post=2681"},{"taxonomy":"post_tag","embeddable":true,"href":"https:\/\/deepinsightai.io\/fr\/wp-json\/wp\/v2\/tags?post=2681"}],"curies":[{"name":"wp","href":"https:\/\/api.w.org\/{rel}","templated":true}]}}