File:DALL-E_2_artificial_intelligence_digital_image_generated_photo.jpg · Wikimedia Commons · See Wikimedia Commons
Key facts
- Software.name
- DALL-E
- Software.logo
- DALL-E 2 Signature.svg
- Software.logo caption
- Watermark present on DALL-E images
- Software.screenshot
- DALL-E 2 artificial intelligence digital image generated photo.jpg
- Software.caption
- An image generated by DALL-E 2, from the prompt "Teddy bears working on new AI research underwater with 1990s technology"
- Software.developer
- OpenAI
- Software.latest release version
- DALL-E 3
- Software.replaced_by
- GPT Image
- Software.genre
- Text-to-image model
- Software.platform
- Cloud computing platforms
- Software.license
- Proprietary service
via Wikipedia infobox
Wikidata facts
Show 7 more facts
- uses
- transformer
- terms of service URL
- labs.openai.com/policies/content-policy
- hashtag
- dalle
- Commons category
- DALL-E
- publication date
- 2021-01-05
- inception
- 2021-01-05
- language of work or name
- English language
via Wikidata · CC0
Article · Español
DALL-E (DALL · E estilizado) es un programa de inteligencia artificial que crea imágenes a partir de descripciones textuales, reveladas por OpenAI el 5 de enero de 2021. Utiliza una versión de 12 mil millones de parámetros del modelo GPT-3 Transformer para interpretar las entradas del lenguaje natural (como "un bolso de cuero verde con forma de pentágono" o "una vista isométrica de un capibara triste") y generar las correspondientes imágenes. Puede crear imágenes de objetos realistas ("una vidriera policromada con la imagen de una fresa azul") así como objetos que no existen en la realidad ("un cubo con la textura de un puercoespín"). Su nombre es un acrónimo de WALL·E y Salvador Dalí. Muchas redes neuronales artificiales desde la década de 2000 en adelante han podido generar imágenes realistas. DALL-E, sin embargo, es capaz de generarlos a partir de indicaciones de lenguaje natural, que "comprende [...] y rara vez falla de manera importante". DALL-E fue desarrollado y anunciado al público en conjunto a CLIP (Contrastive Language-Image Pre-training o Pre-entrenamiento de Imagen-Lenguaje Contrastante), un modelo separado cuya función es "comprender y clasificar" su resultado. Las imágenes que genera DALL-E están seleccionadas por CLIP, que presenta las imágenes de más alta calidad. OpenAI se ha negado a publicar el código fuente de cualquiera de los modelos; una "demostración controlada" de DALL-E está disponible en el sitio web de OpenAI, donde se puede ver la salida de una selección limitada de mensajes de muestra. Las comunidades han publicado alternativas de código abierto, capacitadas en cantidades más pequeñas de datos, como DALL-E Mini. Según MIT Technology Review, uno de los objetivos de OpenAI era "dar a los modelos de lenguaje una mejor comprensión de los conceptos cotidianos que los humanos usan para dar sentido a las cosas".
Abstract from DBpedia / Wikipedia · CC BY-SA