Openai avslöjar Dall-E 3, en bildgenerator baserad på chatgpt, dall-e 3: fusion mellan chatgpt och generering av bilder som skakar upp midjourney

Dall-E 3: Fusionen mellan chatgpt och generering av bilder som skakar upp midjourney

Genom att integrera Dall-E på Chatgpt stärker OpenAI sin position som ledare i den generativa AI-världen. Chatgpt och dall-e 3, tillsammans, lovar att avvisa gränserna till AI.

Openai avslöjar Dall-E 3, en bildgenerator baserad på chatgpt

Den senaste versionen av modellen är baserad på GPT för att underlätta skapandet av komplexa och sammanhängande bilder.

OpenAI, företaget bakom Essential GPT, har just avslöjat sin senaste generativa modell hittills. Och den här gången är det återigen bilden som är i rampljuset; Sam Altmans trupper avslöjade den tredje versionen av Dall-E-bildgeneratorn. Han lovar Fler nyanser, detaljer och komplexitet.

Den första punkten som framhävs av OpenAI är noggrannheten i prompt. Till och med de bästa generatorerna för tillfället, som Midjourney eller DreamStudio, lider av ett vanligt problem: de har tendens att ignorera vissa ord i den textuella begäran.

För att få bästa resultat är det därför nödvändigt Empiriskt lära sig att kommunicera med algoritm. Detta innebär att man gör massor av tester på ordförråd och vänder sig för att hitta de som troligtvis tolkas korrekt. Detta är en övning som kan vara känslig när användaren väntar på ett mycket specifikt resultat, därmed termen ” snabb teknik »».

Chatgpt mobiliserad för sammansättningen av prompt

Med Dall-E 3 vill OpenAi avsluta detta tillstånd. “” ” Moderna text-till-bilder-system tenderar att ignorera ord eller beskrivningar, som bildar användaren för att lära sig promineeringsprompten. Dall-E 3 representerar ett stort steg framåt i vår förmåga att generera bilder som följer exakt den tillhandahållna texten “Anger företaget.

Och för att göra detta har företaget redan det perfekta verktyget: Chatgpt. Den nya versionen av Diffusion 3 -modellen är ” Infödda »Runt chatboten. Det fungerar nu som en mellanhand för Tolka varje detalj i begäran. Språkmodellen kan också hjälpa användaren att generera prompt extremt detaljerad så att Dall-e förstår exakt vad som förväntas av honom utan att använda tekniker av snabb teknik Avancerad.

Och om det ursprungliga resultatet inte är lämpligt, att det inte gör det. Det räcker att gå igen genom att chatgpt för att hävda exakta förändringar när det gäller färg, form, stil, en viss detalj … Med andra ord har Openai lagt de små rätterna i de stora för att erbjuda en maximal kontrollgrad med Ett minimum av ansträngning och teknisk expertis.

I exemplen som föreslagits av OpenAI, notera också att Dall-E 3 kan generera sammanhängande texter. Detta är något som bildgeneratorer hade mycket problem att göra hittills. Till exempel ger den senaste versionen av Midjourney alltid tillräckligt … exotiska resultat när de blir ombedda att delta i denna övning.

Skydda offentliga personer

Företaget införde fortfarande ett antal gränser för denna tredje version. Till exempel har ingenjörer konsoliderat de skyddsåtgärder som redan finns på Dall-E och Dall-E 2 som hindrar användaren från att generera innehåll ” våldsam, vuxen eller hatsk »».

Dessutom är Dall-E 3 utformad för att vägra förfrågningar som uttryckligen nämner en offentlig person. Målet är att förhindra att det används för propaganda eller desinformationsändamål.

Respektera immateriell egendom

Den andra viktiga punkten med denna uppdatering är att Optai verkar ha noterat de många kritikerna som har riktats till de olika bildgeneratorerna om immateriell egendom. Dall-e går vägra förfrågningarna som ber honom att imitera stilen för en levande konstnär. Detta bör stänga dörren till många förfalskade försök.

Å andra sidan kommer detta skyddssystem säkert att vara ofullkomligt. Precisionen i denna tredje version är ett dubbel -kantat svärd. I teorin kan en tillräckligt uppfattande användare alltid få ett ganska nära resultat. Du måste bara kunna beskriva stilen för den riktade konstnären mycket exakt utan uttryckligen namn.

OpenAI erbjuder också två lösningar som tillåter en konstnär av vägra att hans arbete används för att utbilda Dall-e. Den första är att fylla i formuläret på den här adressen. Men om du vill skydda ett stort antal, som de du håller på din onlineportfölj, är idealet att förbjuda åtkomst till Crawler GPTBOT. För att göra detta, följ bara instruktionerna på den här adressen.

Detta kommer avsevärt att begränsa förmågan hos Dall-E 3 att imitera de aktuella verken. Åtminstone om de inte redan har överförts till rullen. Och det är tyvärr omöjligt att bestämma i praktiken, eftersom källdata inte hålls efter att ha integrerats i modellen.

Dall-E3 kommer officiellt att lanseras nästa oktober för kunder på Chatgpt Plus och Chatgpt Entreprise-erbjudanden.

Dall-E 3: Fusionen mellan chatgpt och generering av bilder som skakar upp midjourney

OpenAI, moderns moderbolag, ska inte längre presenteras. Efter att ha erbjudit oss Chatgpt tillkännager hon nu den senare förmågan att generera exakta bilder tack vare sammansmältningen av Dall-e och Chatgpt i Dall-e.

Frandroid, För dem som följer, använd ett bildgenereringsverktyg: Midjourney. Om detta instrument visade sig vara kraftfullt och innovativt i bildgenerationsvärlden, var Dall-E från Openai också på banan, med en lika imponerande kurs. Och den nya opusen Dall-E 3-risk Tja att ändra situationen.

Enligt demonstrationerna som delas av OpenAI är det uppenbart att Dall-E 3 skiljer sig från sina föregångare och konkurrenter. Där midjourney utmärker sig i fotorealistisk återbetalning, men fortfarande kräver många manipulationer, lovar Dall-E 3 en mycket mer effektiv och mindre felaktig bildgenerering. En anmärkningsvärd prestation, särskilt med tanke på att detta är ett stort framsteg jämfört med Dall-e.

Dessutom verkar detta nya verktyg ha utvecklat en specifik kompetens för att hantera texten i bilderna och överträffat kapaciteten hos några av dess konkurrenter som Stabil Diffusion XL och Deepfloyd. I synnerhet belyser Openai hennes förmåga att producera övertygande bilder av bokstäver, figurer och till och med mänskliga händer (en verklig svårighet för dessa verktyg).

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Dall-E 3 // Källa: OpenAI

Genom att integrera Dall-E på Chatgpt stärker OpenAI sin position som ledare i den generativa AI-världen. Chatgpt och dall-e 3, tillsammans, lovar att avvisa gränserna till AI.

Chatbots kommer inte bara att kunna prata på nästan mänskligt sätt, utan också för att föreställa sig och skapa bilder från enkla beskrivningar. Vi kan inte vänta med att testa.

Om du vill testa Dall-E 3 kommer det att vara tillgängligt för Chatgpt Plus och Enterprise-användare. Vilket är mycket lättare att använda än Midjourney … där du behöver en Discord -kund.

Chatgpt

Till vilka bilderna genererade ?

Frågan om upphovsrätt kopplad till de bilder som genereras av AI är för närvarande ett hett ämne. Nuvarande bestämmelser tyder på att IA -bilder går in i den allmänna domänen. Openai förklarar dock tydligt att egenskapen för bilderna som produceras av Dall-E 3 återvänder till sina skapare. Och det är en annan debatt i sektorn.

Bing Cat har också rätt till Dall-E 3

Denna torsdag 21 september höll Microsoft en konferens för att tillkännage nästa ankomst av Copilot, men också det nya ytområdet. Parallellt kommunicerade företaget vid ankomsten av Dall-E 3-modellen i Bing Image Creator. Som en påminnelse är detta Bing Chat Images Creation Tool. Enligt Microsoft, Bing Image Creator ” Förstår också vad du ber om, vilket gör att du kan få mer exakta bilder. »»

Microsoft säger också gå vidare genom att lägga till ” Ett digitalt vattenmärke osynligt för alla bilder som genererats av AI i Bing, inklusive tid och datum för deras skapelse. “Svårt att veta hur kraftfullt detta vattenmärke kommer att vara, inte heller hur vi kan kontrollera dess närvaro eller inte, men detta är ett första steg.

För att följa oss inbjuder vi dig att ladda ner vår Android- och iOS -applikation. Du kan läsa våra artiklar, filer och titta på våra senaste YouTube -videor.