"Zürafadan yapılmış ejderha" metni yazıldığında DALL-E'nin ürettiği görseller. | |
| Yazar | OpenAI |
|---|---|
| İlk yayınlanma | 5 Ocak 2021) (2021-01-05) |
| Tür | Dönüştürücü dil modeli |
| Resmî sitesi | openai.com/blog/dall-e |
| Yapay zekâ |
|---|
| dizisinin bir parçası |
DALL-E (ya da DALL·E), 5 Ocak 2021'de OpenAI tarafından piyasa sürülen, metinsel tanımlardan görüntü oluşturan bir yapay zekâ sanatı, metinden videoya model, metinden resme model ve yapay zeka programıdır.
Adını ünlü ressam Salvador Dali ve WALL-E adlı animasyon robottan almıştır. Program, doğal dil girdilerini (örneğin "beşgen şekilli yeşil deri çanta" veya "üzgün bir kapibaranın izometrik görünümü") tanımlamak için GPT-3 modelinin 12 milyar parametreden oluşan sürümünü kullanır ve dil girdisine karşılık gelen görüntüyü oluşturur. Gerçekçi nesnelerin ("mavi çilek resimli vitray bir pencere") ve gerçekte var olmayan nesnelerin ("kirpi dokusuna sahip bir küp") görüntülerini oluşturabilir.
Tarihçe
DALL-E OpenAI tarafından 5 Ocak 2021'de piyasaya sürüldü. Nisan 2022'de OpenAI, çıktıdaki görselde basit değişiklikler yapılmasına olanak sağlayan düzenleyiciyle birlikte metin açıklamalarından daha gerçekçi görüntüler üretebileceğini iddia ederek DALL-E 2'yi duyurdu. Duyuru itibarıyla, yazılımın hala yapım aşamasında olduğu ve erişimin önceden seçilmiş beta kullanıcıları ile sınırlı olduğu açıklandı. Modelin, hiçbir insanın yapmayacağı hatalar da dahil olmak üzere hala ciddi hatalar yapabildiği belirtildi. DALL-E 2, "metin açıklamasından orijinal, gerçekçi görüntüler ve sanat oluşturabilen, kavramları, nitelikleri ve stilleri birleştirebilen" bir model olarak tanımlandı.
DALL-E 3 sürümü Ekim 2023'te yayınlandı. Model, ChatGPT entegrasyonu sayesinde kullanıcıların doğal dil kullanarak daha kolay ve interaktif bir şekilde görsel oluşturmasını sağlamıştır. Ayrıca, içerik güvenliği ve telif haklarına saygı açısından geliştirilmiş filtreleme sistemleri sunarak daha etik bir kullanım deneyimi sunmuştur.
CLIP
DALL-E, CLIP (Contrastive Language-Image Pre-training) ile birlikte geliştirilmiş ve duyurulmuştur. Amacı, çıktıyı "anlamak ve sıralamak" olan ayrı bir modeldir. DALL-E'nin oluşturduğu görseller, herhangi bir girdi için en yüksek kaliteli görüntüleri sunan CLIP tarafından küratörlüğünü yapar.
Ayrıca bakınız
- Imagen (metinden görsel oluşturma modeli)
- Sufle mühendisliği
- Studio Ghibli
- Midjourney
- Bilgisayar grafikleri
- Bilgisayar sanatı
- Üretken yapay zekâ
Kaynakça
- ^ "DALL-E Dijital Ressam". Bilim ve Teknik Dergisi. Şubat 2021. 26 Şubat 2021 tarihinde kaynağından arşivlendi4 Şubat 2021.
- ^ "OpenAI debuts DALL-E for generating images from text". VentureBeat. 5 Ocak 2021. 6 Ocak 2021 tarihinde kaynağından arşivlendi. Erişim tarihi: 5 Ocak 2021.
- ^ a b "OpenAI's DALL-E creates plausible images of literally anything you ask it to". 5 Ocak 2021. 5 Ocak 2021 tarihinde kaynağından arşivlendi. Erişim tarihi: 5 Ocak 2021.
- ^ a b c "This avocado armchair could be the future of AI". MIT Technology Review. 5 Ocak 2021. 5 Ocak 2021 tarihinde kaynağından arşivlendi. Erişim tarihi: 5 Ocak 2021.
- ^ KAHN, JEREMY (6 Nisan 2022). "Move over Photoshop: OpenAI has just revolutionized digital image making". Fortune (İngilizce). 10 Nisan 2022 tarihinde kaynağından arşivlendi. Erişim tarihi: 10 Nisan 2022.
- ^ "DALL·E 2". OpenAI (İngilizce). 6 Nisan 2022 tarihinde kaynağından arşivlendi. Erişim tarihi: 6 Nisan 2022.
- ^ "DALL-E 3". OpenAI. 31 Aralık 2024 tarihinde kaynağından arşivlendi.
Kitaplar
- Jens Knappe: Genesis. A Creation Story in Cooperation with an Artificial Intelligence, Berlin 2022, ISBN 978-3-940948-45-8.
- Nöral Turing makinesi
- Farklılaştırılabilir nöral bilgisayar
- Transformer
- Tekrarlayan sinir ağı (RNN)
- Uzun kısa süreli bellek (LSTM)
- Gitli yinelemeli birim (GRU)
- Eko durum ağı
- Çok katmanlı algılayıcı (MLP)
- Evrişimli sinir ağı
- Artık ağ
- Otokodlayıcı
- Varyasyonel otokodlayıcı (VAE)
- Çatışmalı üretici ağ (GAN)
- Grafik sinir ağı
Kategoriler
- Yapay sinir ağları
- Makine öğrenimi
