เมื่อเร็วๆ นี้ มีการนำเสนอโมเดลโครงข่ายประสาทเทียม DALL-E 2 ซึ่งสามารถสร้างรูปภาพตามคำอธิบายได้ นอกจาก
Blogger Denis Shiryaev และผู้เขียนช่อง Neural Networks และ Blender Telegram ได้ตีพิมพ์ภาพวาดดังกล่าว โดยรวมแล้ว โมเดลสร้างภาพได้แปดรูปแบบ และบล็อกเกอร์เลือกภาพที่ดีที่สุด
นี่คือตัวอย่างที่โดดเด่นที่สุด:







สิบแปด
จนถึงตอนนี้ DALL-E 2 มีให้บริการในจำนวนจำกัดของผู้ทดสอบเท่านั้น อย่างไรก็ตาม คุณสามารถสมัครทดสอบบนเว็บไซต์ได้
DALL-E 2 "เรียนรู้" ความสัมพันธ์ระหว่างภาพและข้อความที่ใช้บรรยาย ตัวแบบใช้กระบวนการที่เรียกว่า diffusion ซึ่งทุกอย่างเริ่มต้นด้วยรูปแบบของจุดสุ่ม แล้วค่อยๆ เปลี่ยนไปสู่ภาพตามลักษณะที่จำเพาะเจาะจง