OpenClaw 2.0 gộp 16.000 pull request vào một bản
OpenClaw ra bản 2.0 sau bảy tuần im lặng, gộp hơn 16.000 pull request từ 933 người đóng góp, cải tổ cài đặt, trình duyệt và cộng tác đám mây.
112 bài đã kiểm chứng về Mã nguồn mở, sản phẩm và diễn biến ngành. Trang 1/2
OpenClaw ra bản 2.0 sau bảy tuần im lặng, gộp hơn 16.000 pull request từ 933 người đóng góp, cải tổ cài đặt, trình duyệt và cộng tác đám mây.
Tencent phát hành và mở mã nguồn mô hình Hunyuan Hy4 preview 770 tỷ tham số, đạt 2,99 điểm trong đánh giá mù nội bộ, nhỉnh hơn GLM-5.3 và Kimi K3 trong gang tấc.
Theo The Information, Nvidia đã đồng ý mua lại Hugging Face với giá 12,9 tỷ USD; thỏa thuận chưa ký, thương vụ vẫn có thể đổ vỡ.
LMSYS thử nghiệm SGLang Diffusion trên 8 card H200: đường không mất mát nhanh hơn Diffusers 1,95 lần, mức 6,24 lần phải đánh đổi bằng chất lượng hình ảnh.
OpenWorker, tác nhân AI mã nguồn mở của Andrew Ng, ra bản mới đặt việc rà soát bảo mật lên hàng đầu, quét cả mã nguồn lẫn thư viện phụ thuộc, và cấm agent tự duyệt bản vá của chính mình.
Đội ngũ Thị giác WeChat của Tencent mở mã WeMM-Embedding: bản 2B vượt qua Qwen3-VL-Embedding-8B lớn gấp bốn lần trên bảng xếp hạng MMEB-v2.
Zhipu ra mắt GLM-5.3-Flash mã nguồn mở giấy phép MIT, giảm tham số kích hoạt xuống 18 tỷ nhưng vẫn đạt 57 điểm trên chỉ số AA, giá chỉ bằng 1/40 Claude Opus 4.8.
Sau sáu ngày ẩn danh dẫn đầu bảng xếp hạng lượng sử dụng trên OpenRouter, Zhipu mới lên tiếng nhận Ox Alpha là phiên bản mới của dòng GLM, với bản xem trước miễn phí đã vượt DeepSeek gấp đôi.
ModelScope của Alibaba sẽ mã nguồn mở Qwen3.8-Flash-Next lúc 23h tối nay (UTC+8), mô hình MoE đa phương thức 125 tỷ tham số dùng kiến trúc Qwen4 chưa ra mắt, kích hoạt dưới 5% tham số mỗi token.
Meta công bố MetaRoCE, giao thức RDMA tự phát triển thay cho RoCE chuẩn, chuyển xử lý tắc nghẽn về card mạng và bỏ PFC; đặc tả đầy đủ ra mắt tại OCP tháng 10.
Hugging Face đã nhờ các ngân hàng đánh giá mức độ quan tâm của người mua, với định giá thương vụ khả dĩ đạt 13 tỷ USD trở lên, gần gấp ba mức 4,5 tỷ USD của ba năm trước.
SemiAnalysis vẽ đường cong đuổi kịp: từ hơn một năm xuống còn 4,8 tháng, khoảng cách giữa mô hình mở và mô hình đóng cứ mỗi thế hệ lại rút ngắn một nửa.
SGLang và Ant Group giảm độ trễ mỗi token của Ling-3.0-flash ở mức đồng thời 1 tới 77% trên bốn GPU Blackwell.
Ant, Alibaba và nhóm SGLang giữ trọng số đã lượng tử hóa thường trực trong bộ nhớ GPU, rút thời gian khởi động lại mô hình nghìn tỷ tham số từ 8,8 phút xuống còn 32 giây.
Anthropic tích hợp Claude Mythos 5 vào các sản phẩm an ninh mạng của đối tác, đưa nó vào tính năng quét của Claude Security, đồng thời dành 35 triệu USD tín dụng cho bảo mật mã nguồn mở.
OpenBMB mở mã nguồn MathForm, mô hình 8B dịch toán học sang Lean 4, vượt qua nhiều mô hình hình thức hóa chuyên dụng 32B trên bài kiểm tra khó nhất FATE-X.
SenseTime phát hành chính thức SenseNova-U1.5-8B-MoT theo giấy phép Apache 2.0, tạo ảnh 4K gốc và gộp chỉnh sửa ảnh, kiểm soát chính xác vào cùng một mô hình.
OpenAI công bố mở mã nguồn "harness" của Codex qua ba cấp độ tích hợp; Cisco, GitHub, JetBrains và một dịch vụ khai thuế đã đưa vào sản phẩm, một thử nghiệm xử lý 7.000 hồ sơ thuế.
Liquid AI ra mắt mô hình nháp LFM2.5-DSpark, tăng tốc suy luận cục bộ tới 3,18 lần bằng giải mã suy đoán, kế thừa phương pháp của DeepSeek và Đại học Bắc Kinh.
Prime Intellect cho 18 mô hình AI tự chạy 153 thí nghiệm nanoGPT: mô hình tốt nhất thu hẹp 82% khoảng cách với con người, nhưng chưa ai đưa ra phương pháp mới.
Liquid AI phát hành loạt checkpoint LFM2.5 dạng GGUF Q4_0 dùng phương pháp QAD, khôi phục tới 97% độ chính xác so với bản BF16 gốc trên bốn kích thước mô hình.
GLM-5.3 đạt 60 điểm trên chỉ số Intelligence Index của Artificial Analysis, xếp thứ 8 trong 182 mô hình; giá API 1,4/4,4 USD nhưng tiêu tốn nhiều token hơn đối thủ cho mỗi tác vụ.
Modular vừa đưa trình biên dịch và bộ công cụ Mojo lên GitHub theo giấy phép Apache 2.0 kèm ngoại lệ LLVM, chỉ một tháng sau khi Qualcomm hoàn tất thương vụ mua lại công ty.
API DeepSeek V4 Pro đã chuyển sang bản 0813, kèm ngữ cảnh 1M token, trần đầu ra 384K và cảnh báo tăng giá.
Qwen3.8-2.4T-A95B đã xuất hiện trên ModelScope như một kho open-weight, biến lời hứa mở trọng số thành đối tượng có thể kiểm chứng.
InclusionAI mở nguồn Ling-3.0-tiny, mô hình MoE 7,9B tham số, kích hoạt 1,3B tham số mỗi token cho tác vụ agent cục bộ.
Muse Glimmer của Meta là model agent open-weight 30B cho quy trình cục bộ, dùng giấy phép Apache 2.0, nhắm tới máy 24GB/32GB, hỗ trợ ảnh, gọi công cụ và speculative decoding DFlash.
BigBang-V1 biến dữ liệu tổng hợp thành một vòng lặp: AI đặt bài, giải bài, kiểm chứng và lọc dữ liệu.
WeatherNext Cyclones của Google DeepMind cho thấy AI có thể giúp dự báo đường đi, cường độ và cấu trúc gió của xoáy thuận sớm hơn khoảng một ngày.
ForgeStencil dùng hai agent để tối ưu stencil và triển khai speedup đã kiểm chứng vào phần mềm khoa học, công nghiệp thật.
Thinking Machines công bố Inkling-Small dạng open weights, với 276B tham số tổng, 12B tham số kích hoạt và nhiều điểm reasoning/coding gần mẫu Inkling 975B.
MiniMax H3 kết hợp video 2K 15 giây, âm thanh stereo gốc, giá 0,8 nhân dân tệ mỗi giây và kế hoạch mở trọng số.
Moonshot AI được cho là đã hoàn tất vòng F hơn 3,5 tỷ USD với định giá sau đầu tư 35 tỷ USD sau khi mở trọng số Kimi K3.
Tencent Hunyuan công bố AngelSpec, khung mở để huấn luyện drafter speculative decoding và giảm chi phí suy luận mô hình lớn.
N0 của NeoteAI và Fudan đưa dữ liệu xúc giác vào trung tâm học robot.
Đánh giá chung của UK AISI và US CAISI cho thấy Kimi K3 có đà ở benchmark tổng quát nhưng còn cách xa nhóm đầu Mỹ trong chuỗi tấn công mạng.
Laguna S 2.1 đặt cược vào nhu cầu tự host của doanh nghiệp: mã nguồn ở lại hạ tầng nội bộ, dù hiệu năng vẫn còn kém nhóm mô hình đóng dẫn đầu.
OpenBMB công bố MiniCPM-Robot với mô hình thao tác 1.5B, mô hình theo dõi 0.9B và hướng triển khai cục bộ có độ trễ thấp.
Hugging Face cho biết một dataset độc hại đã mở đường cho chiến dịch tác nhân AI tự động, còn đội phòng thủ dùng LLM nội bộ để phân tích hơn 17.000 sự kiện.
Moonshot AI công bố Kimi K3 với 2,8 nghìn tỷ tham số, ngữ cảnh 1 triệu token và bảng giá API; phần open-weight vẫn cần trọng số và model card để hoàn tất.
SingGuard mở guardrail cho hành động agent và kiểm tra chính sách đa phương thức. Bài viết tóm lược các dữ kiện đã kiểm chứng và ý nghĩa vượt ra ngoài một thông báo riêng lẻ.
Claude viết lại Bun sang Rust, cộng đồng Zig phản ứng. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
Zhipu đặt cược vào tác nhân nhiệm vụ dài sau niêm yết. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
Mô hình LingBot dự đoán trước khi hành động. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
Ollama gọi vốn 65 triệu USD cho mô hình cục bộ được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
LingBot mở mô hình nền tảng thị giác robot được biên tập lại cho độc giả công nghệ Việt Nam, giữ nguyên các số liệu và điểm cần kiểm chứng.
Bốn mô hình Trung Quốc vượt Opus với chi phí thấp hơn nhiều được biên tập lại cho độc giả công nghệ Việt Nam, giữ nguyên các số liệu và điểm cần kiểm chứng.
Model choice, Azure hosting and coding-model price pressure.
Sovereign AI, open weights and sensitive government workloads.
Aramco Ventures dẫn dắt Series C, định giá nhà cung cấp hạ tầng mô hình mở có Nvidia tham gia ở mức 8,3 tỷ USD.
DeepSeek và Đại học Bắc Kinh mã nguồn mở DSpark, khung suy luận giúp tăng tốc tạo văn bản 60% đến 85% và nâng thông lượng một GPU tối đa 6,6 lần.
Meituan mở LongCat-2.0 sau bí ẩn Owl Alpha。
GPT-5.5-Cyber của OpenAI tìm ra lỗi OpenBSD 23 năm tuổi
Patch the Planet kết hợp Codex Security với Trail of Bits và HackerOne để maintainer nhận lỗi đã xác minh, mức độ nghiêm trọng, bản vá và kiểm thử.
Phòng thí nghiệm AI mã nguồn mở trẻ này thuê năng lực Nvidia GB300 từ trung tâm dữ liệu Colossus 2 của SpaceX, hợp đồng có thể kéo dài đến 2029 và cho thấy compute khan hiếm nhất.
GLM-5.2 mở trọng số của Z.ai đạt 74,4 trên FrontierSWE, gần Claude Opus và vượt GPT-5.5 ở vài benchmark coding trong khi giá token thấp hơn nhiều.
Moonshot AI tung Kimi K2.7-Code cùng chế độ HighSpeed. Một vài điểm benchmark tự công bố vượt Claude Opus 4.8, nhưng lợi thế lớn hơn nằm ở giá đầu ra thấp.
SemiAnalysis ước tính gói ChatGPT Pro 200 USD nếu dùng hết mức có thể tương đương khoảng 14.000 USD theo giá API.
Mirage lưu đặc trưng tiềm ẩn thay vì point cloud đã render, giúp video world model nhanh hơn, nhẹ hơn và nhất quán hơn.
GLM-5.2 của Zhipu kết hợp kiến trúc MoE 744B tham số, cửa sổ 1 triệu token và kế hoạch mở trọng số kiểu MIT cho agent lập trình.
Mô hình MoE mở của Moonshot rẻ hơn đáng kể ở cả input lẫn output token, đồng thời cải thiện benchmark lập trình kiểu agent so với K2.6.
Mô hình mở 26B MoE của Google tạo văn bản song song, đổi một phần chất lượng lấy tốc độ cục bộ hơn 1.000 token mỗi giây trên H100.
Moonshot mở Kimi K2.7-Code cho lập trình AI.
Diễn biến này cho thấy cạnh tranh AI không chỉ nằm ở mô hình hay công cụ, mà còn ở vốn, triển khai với khách hàng và năng lực ứng phó quy định.
Mô hình MoE 30B của Cohere kích hoạt khoảng 3B tham số, hỗ trợ ngữ cảnh 256K và phát hành theo Apache 2.0.
Dữ liệu Ramp và OpenRouter cho thấy DeepSeek tăng tốc khi agent lập trình và dữ liệu chạy lâu biến giá token thành chi phí doanh nghiệp cấp một.
Moonshot AI đang đàm phán vòng gọi vốn mới để nâng định giá lên 30 tỷ USD, ngay khi vòng 20 tỷ USD trước đó chưa hoàn tất giải ngân.
Reve 2 và Ideogram 4 đưa bố cục thành mặt trận mới. Bài viết tóm tắt thông báo, bối cảnh chiến lược và rủi ro thực tế với người dùng hoặc doanh nghiệp liên quan.
Ideogram mở mô hình tạo ảnh 9,3 tỷ tham số. Bài viết tóm tắt thông báo, bối cảnh chiến lược và rủi ro thực tế với người dùng hoặc doanh nghiệp liên quan.
Nvidia phát hành Cosmos 3, mô hình AI mã nguồn mở giúp robot và xe tự hành hiểu và dự đoán tương tác trong thế giới vật lý.
MiniMax phát hành mô hình open-weight M3 với ngữ cảnh 1 triệu token, khả năng lập trình tiên tiến và đa phương thức gốc, tuyên bố là mô hình đầu tiên kết hợp cả ba.
Nvidia ra mắt mô hình mã nguồn mở Nemotron 3 Ultra với 550 tỷ tham số, đạt 48 điểm trên chỉ số trí tuệ Artificial Analysis, thấp hơn Kimi K2.6 của Trung Quốc với 54 điểm.
NVIDIA công bố Nemotron-Labs-Diffusion, mô hình hỗ trợ ba chế độ giải mã, tăng thông lượng lên tới 6 lần so với Qwen3-8B mà vẫn duy trì độ chính xác.
Cohere đã phát hành mô hình chủ lực Command A+ theo giấy phép Apache 2.0 vào ngày 20 tháng 5. Mô hình MoE 218B tham số có thể chạy trên chỉ hai GPU H100, nhắm đến AI có chủ quyền và triển khai doanh nghiệp.
Hermes Agent đạt 224 tỷ token trong một ngày trên OpenRouter, đẩy OpenClaw xuống vị trí thứ hai sau nhiều tháng dẫn đầu.
Moonshot AI huy động 2 tỷ USD ở mức định giá hơn 20 tỷ USD, đưa Kimi vào tâm điểm cuộc đua mô hình lớn mã nguồn mở và kế hoạch IPO Hong Kong.
Vòng Series B của DeepInfra cho thấy hạ tầng suy luận độc lập cho mô hình mở và tác nhân AI đang tách thành một lớp thị trường riêng.
Mistral mở bản xem trước công khai Workflows, lớp điều phối dựa trên Temporal cho quy trình AI doanh nghiệp với phê duyệt thủ công, truy vết và dữ liệu nằm trong môi trường khách hàng.
CVE-2026-25874 cho phép kẻ tấn công tiếp cận Hugging Face LeRobot PolicyServer thực thi mã qua giải tuần tự pickle.
Xiaomi mở nguồn MiMo V2.5 Pro 1,02 nghìn tỷ tham số. Bài viết tóm tắt thông báo, bối cảnh chiến lược và rủi ro thực tế với người dùng hoặc doanh nghiệp liên quan.
DeepSeek phát hành mô hình V4 với 1,6 nghìn tỷ tham số, nhưng thị trường không còn bất ngờ như năm ngoái. Giá rẻ hơn đối thủ, hiệu suất cải thiện, nhưng tác động địa chính trị từ việc tương thích chip Huawei mới đáng chú ý.
DeepSeek bất ngờ giảm 75% giá API cho mô hình V4-Pro chỉ chưa đầy 72 giờ sau khi phát hành bản xem trước, đồng thời cắt giảm 90% giá cache hit cho toàn bộ dòng sản phẩm API, tạo áp lực cực lớn lên thị trường mô hình ngôn ngữ lớn.
Mô hình 27B tham số của Alibaba vừa được phát hành theo giấy phép Apache 2.0, đạt điểm SWE-bench Pro 53,5, vượt qua mô hình 397B tham số Qwen3.5-397B MoE (50,9) nhờ tính năng Thinking Preservation giữ lại dấu vết suy luận trong các tác vụ đa lượt.
DeepSeek phát hành V4-Pro và V4-Flash với kiến trúc MoE, giá đầu ra chỉ 3,48 USD/triệu token, rẻ hơn đáng kể so với GPT-5.5 và Claude Opus 4.7, đồng thời đạt điểm Codeforces 3206 vượt GPT-5.4.
Qwen3.6-27B, mô hình Dense 27B tham số của Alibaba, đã vượt qua mô hình MoE 397B tham số Qwen3.5-397B-A17B trong các bài kiểm tra lập trình, nhờ kiến trúc Dense ổn định và cơ chế Thinking Preservation mới.
Moonshot AI đã phát hành phiên bản đầy đủ của mô hình Kimi K2.6, đạt điểm 54.0 trên HLE-Full, vượt qua Claude Opus 4.6 và GPT-5.4 để giành vị trí dẫn đầu trong số các mô hình mã nguồn mở. Mô hình 1 nghìn tỷ tham số này sử dụng kiến trúc MoE, chỉ kích hoạt 32 tỷ tham số mỗi lần suy luận, đồng thời hỗ trợ tới 300 tác nhân chạy song song.
Alibaba ra mắt Qwen3.6-Max-Preview, mô hình mạnh nhất từ trước đến nay của dòng Qwen, đạt điểm cao nhất trong 6 bài kiểm tra chuẩn nhưng không công bố trọng số, đánh dấu bước chuyển chiến lược từ mã nguồn mở sang đóng.
Qwen3.6-35B-A3B, mô hình MoE có tổng 35B tham số nhưng chỉ kích hoạt 3B khi suy luận, đạt 73,4% trên SWE-bench Verified, vượt xa Gemma 4-31B của Google. Mô hình có thể chạy trên RTX 4090 và MacBook Pro M4/M5.
MiniMax M2.7 sử dụng khung agent OpenClaw để tự động chạy thí nghiệm, đọc log, phân tích chỉ số và điều chỉnh mã qua hơn 100 vòng lặp không có can thiệp của con người, giúp điểm đánh giá nội bộ tăng 30%. Mô hình có 230B tham số nhưng chỉ kích hoạt 10B mỗi lần suy luận, và đã được mở mã nguồn.
NVIDIA công bố mã nguồn mở toàn bộ dòng mô hình Nemotron 3, bao gồm trọng số, bộ dữ liệu tiền huấn luyện 3 nghìn tỷ token, quy trình học tăng cường và công cụ đánh giá, đánh dấu bước đi chiến lược nhằm khẳng định vị thế trong hệ sinh thái AI nguồn mở.
Z.ai (trước đây là Zhipu AI) phát hành GLM-5.1 với 754B tham số, kiến trúc MoE, mã nguồn mở theo giấy phép MIT. Mô hình đạt 58,4% trên SWE-Bench Pro, vượt GPT-5.4 và Claude Opus 4.6, và được huấn luyện hoàn toàn trên chip Huawei Ascend 910B và framework MindSpore, không sử dụng GPU NVIDIA.
NVIDIA ra mắt bộ mô hình AI lượng tử mã nguồn mở đầu tiên trên thế giới, Ising, bao gồm mô hình hiệu chuẩn 35B tham số và hai mô hình giải mã 3D CNN, giúp giảm thời gian hiệu chuẩn từ nhiều ngày xuống còn vài giờ.
Moonshot AI phát hành bản xem trước K2.6 Code cho người dùng Kimi Code, với giá rẻ hơn đáng kể so với Claude Sonnet và GPT-5.4, cải thiện chuỗi suy luận sâu hơn và khả năng Agent Swarm song song thực sự.
Arcee AI, một công ty chỉ có 26 nhân viên, đã chi 20 triệu USD, một nửa số vốn đầu tư mạo hiểm, để huấn luyện mô hình suy luận mã nguồn mở Trinity-Large-Thinking với 40 tỷ tham số, sử dụng 2048 GPU Nvidia B300 trong 33 ngày.
DeepSeek phát hành phiên bản V3.2 với kiến trúc chú ý thưa mới, giảm độ phức tạp từ O(L²) xuống O(Lk) và cắt giảm đáng kể chi phí suy luận, với giá đầu vào chỉ 0,28 USD/M token, trong khi vẫn duy trì hiệu suất tổng thể tương đương với phiên bản trước.
Mistral ra mắt Voxtral TTS, mô hình chuyển văn bản thành giọng nói đầu tiên với 4B tham số, trọng số mở, được đánh giá tự nhiên hơn ElevenLabs Flash v2.5 và ngang hàng với ElevenLabs v3.
Mistral ra mắt Small 4, mô hình MoE 119B tham số nhưng chỉ kích hoạt 6,5B mỗi lần suy luận, hợp nhất ba mô hình độc lập trước đây thành một, hỗ trợ suy luận văn bản, hiểu ảnh đa phương thức, sinh mã và gọi hàm.
Cursor phát hành Composer 2, mô hình lập trình AI mới, nhưng ban đầu không tiết lộ nó được xây dựng trên nền tảng mã nguồn mở Kimi K2.5 của Moonshot AI, một công ty Trung Quốc, và chỉ thừa nhận sau khi bị chất vấn.
Google DeepMind phát hành Gemma 4 với bốn phiên bản, chuyển sang giấy phép Apache 2.0; phiên bản 31B đứng thứ ba trên bảng xếp hạng mã nguồn mở Arena AI.
Meta đang phát triển hai mô hình AI thế hệ mới là Avocado (LLM văn bản) và Mango (đa phương thức), nhưng các phiên bản mã nguồn mở có thể bị cắt giảm tham số, thiếu cấu trúc MoE hoàn chỉnh và các bước huấn luyện sau, nhằm giữ lợi thế cạnh tranh.