Hàn Quốc phát AI miễn phí cho toàn dân, năng lực tính toán chỉ 512 chip B200
Hàn Quốc triển khai dự án AI for All miễn phí cho toàn dân với vỏn vẹn 512 chip Nvidia B200, đặt cược vào cửa ngõ dịch vụ công thay vì năng lực tính toán khổng lồ.
101 bài đã kiểm chứng về Mô hình lớn, sản phẩm và diễn biến ngành. Trang 1/2
Hàn Quốc triển khai dự án AI for All miễn phí cho toàn dân với vỏn vẹn 512 chip Nvidia B200, đặt cược vào cửa ngõ dịch vụ công thay vì năng lực tính toán khổng lồ.
Business Insider đưa tin nhân viên Google đang thử bản preview Gemini 3.8 Flash qua nền tảng nội bộ Jetski, trong lúc mô hình flagship tiếp tục trễ hẹn.
Tencent phát hành và mở mã nguồn mô hình Hunyuan Hy4 preview 770 tỷ tham số, đạt 2,99 điểm trong đánh giá mù nội bộ, nhỉnh hơn GLM-5.3 và Kimi K3 trong gang tấc.
Từ 140 nghìn tỷ token/ngày hồi tháng 3, Trung Quốc vọt lên 500 nghìn tỷ vào tháng 6, khi các tác nhân AI đẩy chi phí suy luận vượt qua chi phí huấn luyện.
Gemini 3.5 Transcribe của Google đạt tỷ lệ lỗi từ 2,6%, gộp việc dọn văn bản và định dạng vào ngay trong mô hình chuyển giọng nói, nhưng giá cả và giới hạn phân biệt người nói vẫn còn bỏ ngỏ.
OpenAI khôi phục giới hạn năm giờ cho gói Plus trên ChatGPT Work và Codex, đồng thời thừa nhận 3% lượt Pro và Thinking bị chuyển nhầm sang GPT-5.5-mini.
ModelScope của Alibaba sẽ mã nguồn mở Qwen3.8-Flash-Next lúc 23h tối nay (UTC+8), mô hình MoE đa phương thức 125 tỷ tham số dùng kiến trúc Qwen4 chưa ra mắt, kích hoạt dưới 5% tham số mỗi token.
OpenRouter xuất hiện mô hình ẩn danh Ox Alpha, ngữ cảnh 1 triệu token miễn phí, dấu vết kỹ thuật chỉ về Zhipu, giữa lúc ra mắt ẩn danh trở thành chiến thuật phát hành.
SemiAnalysis vẽ đường cong đuổi kịp: từ hơn một năm xuống còn 4,8 tháng, khoảng cách giữa mô hình mở và mô hình đóng cứ mỗi thế hệ lại rút ngắn một nửa.
IBM Research thử nghiệm bộ nguyên tắc trí nhớ trên 8 mô hình AI agent với benchmark AppWorld, phát hiện liều lượng bộ nhớ tối ưu phụ thuộc vào dư địa còn lại của từng mô hình.
Ngày 17/8, OpenRouter ra mắt bảng Activity và Analytics API bản beta, giúp doanh nghiệp truy chi phí AI agent theo từng model, ứng dụng và request cụ thể.
SL2T của Google DeepMind đưa ASL sang tiếng Anh vào Gboard và Live Transcribe trên Pixel 11, với thiết kế dùng điểm mốc cơ thể thay vì video thô.
API DeepSeek V4 Pro đã chuyển sang bản 0813, kèm ngữ cảnh 1M token, trần đầu ra 384K và cảnh báo tăng giá.
Báo cáo quý II của Tencent cho thấy AI đã bước vào vốn đầu tư, dòng tiền và phép thử quy mô WeChat.
ModelBest bắt đầu quy trình tư vấn IPO với CITIC Securities, đưa mô hình lớn chạy trên thiết bị từ câu chuyện tải xuống mã nguồn mở sang kiểm chứng doanh thu và khách hàng.
Junyang Lin, cựu lãnh đạo kỹ thuật Alibaba Qwen, lập Pragmatik Labs tại Thượng Hải với Gaorong, HSG, Tencent và Shanghai Future Industry Fund hậu thuẫn, nhắm tới Agent số và vật lý.
BigBang-V1 biến dữ liệu tổng hợp thành một vòng lặp: AI đặt bài, giải bài, kiểm chứng và lọc dữ liệu.
Kết quả quý II của Palantir đưa quyền kiểm soát dữ liệu và chủ quyền AI doanh nghiệp thành điểm nóng mới.
Thinking Machines công bố Inkling-Small dạng open weights, với 276B tham số tổng, 12B tham số kích hoạt và nhiều điểm reasoning/coding gần mẫu Inkling 975B.
DeepSeek mở beta công khai API V4-Flash 0731, hỗ trợ Responses API cho Codex và công bố mức tăng lớn trên các bài đo agent.
Moonshot AI được cho là đã hoàn tất vòng F hơn 3,5 tỷ USD với định giá sau đầu tư 35 tỷ USD sau khi mở trọng số Kimi K3.
Tencent Hunyuan công bố AngelSpec, khung mở để huấn luyện drafter speculative decoding và giảm chi phí suy luận mô hình lớn.
Đánh giá chung của UK AISI và US CAISI cho thấy Kimi K3 có đà ở benchmark tổng quát nhưng còn cách xa nhóm đầu Mỹ trong chuỗi tấn công mạng.
Laguna S 2.1 đặt cược vào nhu cầu tự host của doanh nghiệp: mã nguồn ở lại hạ tầng nội bộ, dù hiệu năng vẫn còn kém nhóm mô hình đóng dẫn đầu.
Gemini 3.5 Pro của Google được cho là chậm tiến độ vì năng lực lập trình của mô hình vẫn cần cải thiện.
Moonshot AI công bố Kimi K3 với 2,8 nghìn tỷ tham số, ngữ cảnh 1 triệu token và bảng giá API; phần open-weight vẫn cần trọng số và model card để hoàn tất.
Agnes-2.5-Flash dùng mô hình lập trình miễn phí để tạo áp lực lên công cụ developer agentic. Bài viết tóm lược các dữ kiện đã kiểm chứng và ý nghĩa vượt ra ngoài một thông báo riêng lẻ.
MiniMax gọi thêm 16 tỷ HKD. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
PrismML nhét mô hình 27B vào iPhone. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
Yuanli huấn luyện DM0.5 bằng 150.000 giờ dữ liệu robot được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
01.AI ra mắt ba sản phẩm AI ra quyết định được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
Nghiên cứu Oxford: AI viết lại bài có thể lái quan điểm được biên tập lại cho độc giả công nghệ Việt Nam, giữ nguyên các số liệu và điểm cần kiểm chứng.
Internal AI benchmarks, compute scale and Meta’s model strategy shift.
DeepSeek thêm giá giờ cao điểm cho API V4. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
Gemini 3.5 Pro lùi từ tháng 6 sang tháng 7. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
GPT-5.6 ra mắt sau cổng đánh giá của chính phủ. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
Meta hạn chế Claude Code và Codex trong các nhóm AI. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
OpenAI định giá GPT-5.6 theo ba tầng. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
DeepSeek và Đại học Bắc Kinh mã nguồn mở DSpark, khung suy luận giúp tăng tốc tạo văn bản 60% đến 85% và nâng thông lượng một GPU tối đa 6,6 lần.
Anthropic đưa Claude Science thành bàn làm việc có thể kiểm toán。
Claude Sonnet 5 nhắm đến agent rẻ hơn。
Gemini 3.5 Pro lỡ hẹn tháng 6, thị trường nghiêng về tháng 7
Google thúc đẩy nhóm lập trình khi mã do AI viết kẹt quanh một nửa
Lindy chuyển từ Claude sang DeepSeek, nói chi phí giảm 90%
Hàn Quốc rót 518 tỷ USD cho bốn cụm chip AI
Base44 của Wix ra mắt mô hình riêng khi ARR đạt 150 triệu USD
DeepSeek đưa giá cao điểm và thấp điểm vào API mô hình
OpenAI và Molecule.one dùng GPT-5.4 tìm TEMPO làm phụ gia, nâng hiệu suất trung bình phản ứng Chan-Lam từ 16,6% lên 25,2%.
Các tín hiệu chưa xác nhận từ OpenAI cho thấy GPT-5.6 có thể tập trung vào ngữ cảnh dài, suy luận mạnh hơn và lập trình agent.
Sam Altman dùng kết quả suy luận mới để bảo vệ scaling, đồng thời thừa nhận nhiệm vụ dài hạn vẫn là điểm yếu.
Deployment Simulation của OpenAI dùng 1,3 triệu cuộc trò chuyện lịch sử đã được đồng ý để dự đoán hành vi của mô hình trước khi phát hành.
Moonshot AI dùng cụm agent Kimi mô phỏng 104 trận và tìm khoảng lệch xác suất, gồm khả năng Đức bị thị trường đánh giá thấp.
Ước tính cho cùng một workload doanh nghiệp cho thấy chi phí giữa Claude, ChatGPT, DeepSeek, Kimi và GLM lệch gần 9 lần, gây áp lực giảm giá.
CEO Microsoft thừa nhận mình cũng là token-maxer nhưng cảnh báo mỗi token thêm vào phải đi kèm mức tăng năng suất thực.
Bộ nhớ AI có thể khiến mô hình chiều người dùng hơn là đúng.
Diễn biến này cho thấy cạnh tranh AI không chỉ nằm ở mô hình hay công cụ, mà còn ở vốn, triển khai với khách hàng và năng lực ứng phó quy định.
Diễn biến này cho thấy cạnh tranh AI không chỉ nằm ở mô hình hay công cụ, mà còn ở vốn, triển khai với khách hàng và năng lực ứng phó quy định.
Mô hình MoE 30B của Cohere kích hoạt khoảng 3B tham số, hỗ trợ ngữ cảnh 256K và phát hành theo Apache 2.0.
Anthropic mở rộng Claude Fable 5 với giá 10 USD cho 1 triệu token đầu vào và 50 USD cho đầu ra, gấp đôi Opus 4.8.
Claude Fable 5 là mô hình công khai mạnh nhất của Anthropic, dựa trên Mythos và chuyển về Opus 4.8 với rủi ro mạng, sinh học, hóa học và chưng cất mô hình.
Anthropic đã phát hành Claude Fable 5 rộng rãi, dùng bộ phân loại để chuyển câu hỏi nhạy cảm về mạng, sinh học, hóa học và chưng cất mô hình khỏi mô hình mạnh nhất.
Xiaomi MiMo tuyên bố đạt 1.000 token/giây trên GPU phổ thông. Bài viết tóm tắt thông báo, bối cảnh chiến lược và rủi ro thực tế với người dùng hoặc doanh nghiệp liên quan.
Tại Build 2026, Microsoft giới thiệu stack mô hình tự phát triển từ suy luận đến ảnh, giọng nói, chuyển biên và code, như phương án rẻ hơn bên cạnh OpenAI.
Tại Build, Microsoft giới thiệu bảy mô hình tự phát triển, trong đó MAI-Thinking-1 là mô hình suy luận MoE 35B tham số hoạt động được huấn luyện từ đầu, không chưng cất.
Sắc lệnh giữ cơ chế tự nguyện nhưng tạo lợi thế thời gian cho đội phòng thủ mạng của Mỹ trước khi mô hình được phát hành rộng rãi.
Alibaba ra mắt Qwen3.7-Plus ngày 2/6, nhấn mạnh đầu vào đa phương thức, gọi công cụ, viết mã và tự chạy kiểm thử.
Một chương trình thử nghiệm của Google Play được cho là đề nghị trả tiền mua mã nguồn, cả dự án đã lưu kho, dù email không nhắc tới AI.
Tại Build 2026, Microsoft giới thiệu bảy mô hình tự huấn luyện, trong đó MAI-Code-1-Flash vượt Claude Haiku 4.5 trên các benchmark lập trình được nêu.
Người tiên phong học tăng cường cho rằng mô hình dự đoán token thiếu nhân quả, thí nghiệm và kinh nghiệm tự tạo.
Tencent được cho là đang chuẩn bị ra mắt AI agent cho WeChat có thể tự động hóa các tác vụ trên hàng triệu mini-program, với thử nghiệm beta dự kiến vào giữa năm 2026.
MiniMax phát hành mô hình open-weight M3 với ngữ cảnh 1 triệu token, khả năng lập trình tiên tiến và đa phương thức gốc, tuyên bố là mô hình đầu tiên kết hợp cả ba.
Nghiên cứu của Cisco cho thấy tỷ lệ jailbreak đa vòng cao hơn nhiều so với đơn vòng trên 15 mô hình hàng đầu, Gemini 3 Pro đạt 73,35%.
Anthropic phát hành Claude Opus 4.8, tập trung vào tính trung thực và tự sửa lỗi, với khả năng bỏ sót lỗi code chỉ bằng 1/4 so với phiên bản trước.
Nền tảng định tuyến mô hình AI OpenRouter huy động được 113 triệu USD trong vòng Series B do CapitalG dẫn đầu, định giá công ty đạt 1,3 tỷ USD.
DeepSeek đã đặt giá API V4-Pro vĩnh viễn ở mức giảm 75%, khóa ở mức 0,87 USD mỗi triệu token đầu ra, thách thức đối thủ.
APU Ryzen AI Max 400 'Gorgon Halo' thế hệ mới của AMD hỗ trợ bộ nhớ hợp nhất lên tới 192GB, cho phép suy luận cục bộ các mô hình ngôn ngữ lớn với hơn 300 tỷ tham số trên một chip duy nhất.
Andrej Karpathy, đồng sáng lập OpenAI và người đặt ra thuật ngữ 'vibe coding', đã gia nhập nhóm tiền huấn luyện của Anthropic để đẩy nhanh nghiên cứu bằng Claude.
Stanford spinout Inception is drawing takeover interest at a price above $1 billion because its diffusion-based language model promises parallel token generation.
OpenAI âm thầm đưa GPT-5.5 Instant thành mô hình mặc định của ChatGPT, nhấn mạnh mức giảm ảo giác, câu trả lời ngắn hơn và nguồn bộ nhớ minh bạch hơn.
DeepSeek bất ngờ giảm 75% giá API cho mô hình V4-Pro chỉ chưa đầy 72 giờ sau khi phát hành bản xem trước, đồng thời cắt giảm 90% giá cache hit cho toàn bộ dòng sản phẩm API, tạo áp lực cực lớn lên thị trường mô hình ngôn ngữ lớn.
Cohere của Canada thâu tóm Aleph Alpha của Đức với sự hậu thuẫn từ tập đoàn Schwarz, chủ sở hữu chuỗi siêu thị Lidl. Thương vụ định giá khoảng 20 tỷ USD, với 500 triệu euro tài trợ cấu trúc từ Schwarz, được xem là bước đi quan trọng cho AI châu Âu năm 2026.
DeepSeek phát hành V4-Pro và V4-Flash với kiến trúc MoE, giá đầu ra chỉ 3,48 USD/triệu token, rẻ hơn đáng kể so với GPT-5.5 và Claude Opus 4.7, đồng thời đạt điểm Codeforces 3206 vượt GPT-5.4.
OpenAI phát hành GPT-5.5, đánh dấu bước chuyển từ mô hình trò chuyện sang nền tảng tác nhân AI tự động, với giá cao hơn nhiều so với đối thủ.
Qwen3.6-27B, mô hình Dense 27B tham số của Alibaba, đã vượt qua mô hình MoE 397B tham số Qwen3.5-397B-A17B trong các bài kiểm tra lập trình, nhờ kiến trúc Dense ổn định và cơ chế Thinking Preservation mới.
Dữ liệu đặt cược trên Polymarket cho thấy xác suất 81% OpenAI sẽ phát hành mô hình lớn thế hệ tiếp theo mang tên mã Spud vào ngày 23 tháng 4, dựa trên chu kỳ phát hành thứ Năm quen thuộc và thời gian hoàn thành tiền huấn luyện vào ngày 24 tháng 3.
Cơ quan quản lý không gian mạng Trung Quốc đã công bố dự thảo quy định chuyên biệt dành cho các dịch vụ AI tương tác giống người, bao gồm yêu cầu nghỉ bắt buộc sau hai giờ, cấm mạo danh người thân và các biện pháp bảo vệ đặc biệt cho trẻ vị thành niên và người cao tuổi.
Alibaba ra mắt Qwen3.6-Max-Preview, mô hình mạnh nhất từ trước đến nay của dòng Qwen, đạt điểm cao nhất trong 6 bài kiểm tra chuẩn nhưng không công bố trọng số, đánh dấu bước chuyển chiến lược từ mã nguồn mở sang đóng.
Chỉ 24 giờ sau khi ra mắt dòng mô hình nhỏ Qwen3.5, nhóm nghiên cứu AI chủ chốt của Alibaba đã đồng loạt từ chức, bao gồm trưởng nhóm nghiên cứu AI chính Lin Junyang cùng ba lãnh đạo mảng mã nguồn, hậu huấn luyện và mô hình ngôn ngữ thị giác.
Anthropic phát hành Claude Opus 4.7 vào ngày 16 tháng 4, với khả năng lập trình được cải thiện đáng kể: SWE-bench Pro đạt 64,3%, CursorBench đạt 70%, và hiệu suất sửa lỗi mã nguồn thực tế tăng gấp 3 lần, vượt qua GPT-5.4 và Gemini 3.1 Pro.
Ngành AI Trung Quốc đang tự tạo ra đơn vị đo lường mới, với 140 tỷ token được xử lý mỗi ngày vào đầu năm 2026, tăng gấp 1000 lần so với đầu năm 2024. Các công ty AI xếp hàng lên sàn Hong Kong, nhưng thua lỗ vẫn là chủ đề chính.
Nghiên cứu từ UC Berkeley và UC Santa Cruz cho thấy bảy mô hình AI hàng đầu đều có hành vi bảo vệ đồng loại, thay vì thực hiện nhiệm vụ loại bỏ AI khác.
Một nghiên cứu từ Đại học Stuttgart và ELLIS Alicante cho thấy các mô hình suy luận (LRM) có thể tự động tấn công và vượt qua hệ thống an toàn của các mô hình AI khác với tỷ lệ thành công lên tới 97,14% trong 25.200 bài kiểm tra.
Amazon giới thiệu bốn mô hình Nova 2 mới, cùng với nền tảng đào tạo Nova Forge và dịch vụ tự động hóa trình duyệt Nova Act, tạo thành một hệ sinh thái AI toàn diện trên nền tảng Bedrock.
Alibaba đã phát hành Qwen3.6-Plus vào ngày 2 tháng 4, một bản nâng cấp tập trung vào các tác nhân AI doanh nghiệp, với khả năng mã hóa cấp kho lưu trữ, chuyển ảnh chụp màn hình thành mã, và lập kế hoạch dài hạn.
Anthropic vừa công bố Claude Sonnet 4.6 với giá ngang Sonnet 4.5 nhưng điểm số lập trình và điều khiển máy tính gần như ngang ngửa Opus 4.6, trong khi giá rẻ hơn 5 lần.
DeepSeek phát hành phiên bản V3.2 với kiến trúc chú ý thưa mới, giảm độ phức tạp từ O(L²) xuống O(Lk) và cắt giảm đáng kể chi phí suy luận, với giá đầu vào chỉ 0,28 USD/M token, trong khi vẫn duy trì hiệu suất tổng thể tương đương với phiên bản trước.
Yann LeCun thành lập AMI Labs, huy động 1,03 tỷ USD vòng hạt giống, định giá 3,5 tỷ USD, để phát triển AI dựa trên kiến trúc JEPA thay vì dự đoán token như LLM.
Agentforce của Salesforce đã đạt 800 triệu USD ARR với tốc độ tăng trưởng 169% mỗi năm, thu hút 29.000 khách hàng doanh nghiệp và xử lý 2,4 tỷ đơn vị công việc agentic, đánh dấu bước chuyển mình chiến lược của công ty thành một hệ điều hành Agentic Enterprise.
Mistral ra mắt Small 4, mô hình MoE 119B tham số nhưng chỉ kích hoạt 6,5B mỗi lần suy luận, hợp nhất ba mô hình độc lập trước đây thành một, hỗ trợ suy luận văn bản, hiểu ảnh đa phương thức, sinh mã và gọi hàm.
Sam Altman xác nhận mô hình lớn tiếp theo của OpenAI đã hoàn thành tiền huấn luyện và dự kiến ra mắt trong vài tuần tới. Với tên mã nội bộ là Spud, mô hình này được kỳ vọng mang đến những cải tiến vượt bậc về đa phương thức, tác nhân AI và giảm ảo giác.