Llama 4 lần đầu dùng MoE, ra mắt Scout và Maverick
Meta phát hành Llama 4 với kiến trúc MoE lần đầu tiên, gồm hai phiên bản Scout (17B tham số kích hoạt, 16 chuyên gia, 10 triệu token ngữ cảnh) và Maverick (17B tham số kích hoạt, 128 chuyên gia, 1 triệu token ngữ cảnh), hỗ trợ đa phương thức gốc, hiệu năng vượt GPT-4o và Gemini 2.0 ở nhiều tác vụ, với dữ liệu huấn luyện hơn 30 nghìn tỷ token và hơn 200 ngôn ngữ.