World model (model dunia) adalah jenis AI yang dilatih untuk membangun pemahaman internal tentang bagaimana dunia fisik bekerja: bagaimana objek bergerak, bertabrakan, atau berubah dari waktu ke waktu, dan bagaimana suatu tindakan menghasilkan konsekuensi tertentu. Berbeda dengan model bahasa besar yang terutama memprediksi urutan kata, world model berusaha memprediksi bagaimana suatu "keadaan" berubah menjadi keadaan berikutnya, baik dalam bentuk video, simulasi 3D, maupun lingkungan interaktif.
Contoh yang menonjol termasuk Genie dari Google DeepMind, yang bisa menghasilkan dunia permainan interaktif dari satu gambar atau deskripsi teks, serta riset dari startup World Labs milik Fei-Fei Li yang berfokus membangun "spatial intelligence" bagi AI. Model generative AI video seperti Sora dari OpenAI juga sering disebut menunjukkan bentuk awal world model, karena tampak memahami fisika dasar seperti gravitasi dan oklusi objek, meski masih jauh dari sempurna.
World model dianggap penting untuk kemajuan robotika dan agen otonom, karena agen yang beroperasi di dunia nyata perlu memperkirakan akibat dari tindakannya sebelum benar-benar melakukannya — mirip cara manusia membayangkan skenario di kepala sebelum bertindak. Beberapa peneliti, termasuk Yann LeCun, menyebut world model sebagai komponen kunci yang masih hilang dari AI saat ini untuk mencapai kecerdasan umum.
