GLM chuyển sang tính phí, DeepSeek giành lại ngôi đầu OpenCode
Ngày đầu GLM-5.3-Flash bắt đầu thu phí, DeepSeek trở lại vị trí số 1 về lượng sử dụng hằng ngày trên OpenCode, hé lộ độ nhạy cảm về giá của lập trình viên.
41 bài đã kiểm chứng về DeepSeek, sản phẩm và diễn biến ngành.
Ngày đầu GLM-5.3-Flash bắt đầu thu phí, DeepSeek trở lại vị trí số 1 về lượng sử dụng hằng ngày trên OpenCode, hé lộ độ nhạy cảm về giá của lập trình viên.
DeepSeek đạt doanh thu 475 triệu nhân dân tệ trong bảy tháng đầu năm 2026 nhưng lỗ ròng tăng lên 715 triệu, trong khi biên lợi nhuận API cao tới 82,9%.
DeepSeek ra mắt deepseek-v4-flash-vision-exp, mẫu V4 đầu tiên có thị giác, giới hạn 384 token mỗi ảnh, giá giữ nguyên như V4-Flash.
Liquid AI ra mắt mô hình nháp LFM2.5-DSpark, tăng tốc suy luận cục bộ tới 3,18 lần bằng giải mã suy đoán, kế thừa phương pháp của DeepSeek và Đại học Bắc Kinh.
LMSYS công bố loạt tối ưu trên SGLang giúp DeepSeek-V4-Pro chạy trên chip H20 tại Trung Quốc tiệm cận B300, khoảng cách giải mã đơn batch chỉ còn 1,42 lần.
API DeepSeek V4 Pro đã chuyển sang bản 0813, kèm ngữ cảnh 1M token, trần đầu ra 384K và cảnh báo tăng giá.
DeepSeek mở beta công khai API V4-Flash 0731, hỗ trợ Responses API cho Codex và công bố mức tăng lớn trên các bài đo agent.
DeepSeek được cho là tự phát triển chip suy luận được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
Check Point cho biết một mẫu mã do DeepSeek tạo ra có thể được hoàn thiện thành ransomware chỉ chạy trong trình duyệt, lợi dụng File System Access API của Chrome.
DeepSeek thêm giá giờ cao điểm cho API V4. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
DeepSeek và Đại học Bắc Kinh mã nguồn mở DSpark, khung suy luận giúp tăng tốc tạo văn bản 60% đến 85% và nâng thông lượng một GPU tối đa 6,6 lần.
Lindy chuyển từ Claude sang DeepSeek, nói chi phí giảm 90%
DeepSeek đưa giá cao điểm và thấp điểm vào API mô hình
Vụ việc cho thấy kiểm soát xuất khẩu có thể trở thành quân bài thương mại dù cơ quan an ninh đã kết luận.
Cấu trúc này nhận vốn bên ngoài nhưng không trao quyền biểu quyết cho nhà đầu tư thương mại.
DeepSeek hoàn tất vòng vốn ngoài đầu tiên với định giá trên 50 tỷ USD, trong khi nhà đầu tư thương mại không có quyền biểu quyết.
Ước tính cho cùng một workload doanh nghiệp cho thấy chi phí giữa Claude, ChatGPT, DeepSeek, Kimi và GLM lệch gần 9 lần, gây áp lực giảm giá.
Dữ liệu Ramp và OpenRouter cho thấy DeepSeek tăng tốc khi agent lập trình và dữ liệu chạy lâu biến giá token thành chi phí doanh nghiệp cấp một.
Dữ liệu Ramp cho thấy DeepSeek dẫn đầu tốc độ tăng trưởng tương đối trong các nhà cung cấp SaaS ở doanh nghiệp Mỹ, dù điều khoản nói dữ liệu cá nhân có thể được lưu tại Trung Quốc.
Reuters nói vòng gọi vốn lớn đầu tiên của DeepSeek gần khép lại với định giá 350-400 tỷ nhân dân tệ.
Trung Quốc đang thắt chặt kiểm soát xuất cảnh đối với nhân sự AI được coi là 'quan trọng chiến lược' tại các công ty tư nhân như Alibaba và DeepSeek, yêu cầu phải có sự chấp thuận của chính phủ trước khi rời khỏi đất nước.
DeepSeek đã đặt giá API V4-Pro vĩnh viễn ở mức giảm 75%, khóa ở mức 0,87 USD mỗi triệu token đầu ra, thách thức đối thủ.
DeepSeek được cho là đang đàm phán vòng gọi vốn đầu tiên với quỹ chip quốc gia Trung Quốc, đưa mức định giá lên gần 45 tỷ USD và gắn tương lai công ty với hạ tầng tính toán nội địa.
Ngày 24 tháng 4, Bộ Ngoại giao Mỹ đã gửi một bức điện ngoại giao tới các đại sứ quán và lãnh sự quán trên toàn thế giới, yêu cầu họ thông báo với các cơ quan đối tác rằng các công ty AI Trung Quốc đang "trích xuất và chưng cất" mô hình từ các phòng thí nghiệm Mỹ một cách có hệ thống. Ba công ty bị nêu tên là DeepSeek, Moonshot và MiniMax.
DeepSeek phát hành mô hình V4 với 1,6 nghìn tỷ tham số, nhưng thị trường không còn bất ngờ như năm ngoái. Giá rẻ hơn đối thủ, hiệu suất cải thiện, nhưng tác động địa chính trị từ việc tương thích chip Huawei mới đáng chú ý.
DeepSeek bất ngờ giảm 75% giá API cho mô hình V4-Pro chỉ chưa đầy 72 giờ sau khi phát hành bản xem trước, đồng thời cắt giảm 90% giá cache hit cho toàn bộ dòng sản phẩm API, tạo áp lực cực lớn lên thị trường mô hình ngôn ngữ lớn.
DeepSeek phát hành V4 Flash và V4 Pro dưới dạng preview, bản chính thức phải chờ đến nửa cuối năm 2026 vì chip Huawei Ascend 950PR chưa được sản xuất hàng loạt. Việc chuyển đổi toàn bộ hệ thống huấn luyện từ NVIDIA sang Huawei Ascend là nguyên nhân chính.
DeepSeek phát hành V4-Pro và V4-Flash với kiến trúc MoE, giá đầu ra chỉ 3,48 USD/triệu token, rẻ hơn đáng kể so với GPT-5.5 và Claude Opus 4.7, đồng thời đạt điểm Codeforces 3206 vượt GPT-5.4.
DeepSeek đang tìm kiếm vòng gọi vốn bên ngoài đầu tiên, với mục tiêu ít nhất 300 triệu USD và định giá trên 10 tỷ USD, theo bốn nguồn tin giấu tên.
DeepSeek phát hành phiên bản V3.2 với kiến trúc chú ý thưa mới, giảm độ phức tạp từ O(L²) xuống O(Lk) và cắt giảm đáng kể chi phí suy luận, với giá đầu vào chỉ 0,28 USD/M token, trong khi vẫn duy trì hiệu suất tổng thể tương đương với phiên bản trước.
OpenAI, Anthropic và Google hợp tác chia sẻ thông tin tình báo để chống lại các cuộc tấn công "chưng cất" (distillation), cáo buộc DeepSeek, Moonshot AI và MiniMax đã sử dụng khoảng 24.000 tài khoản giả để tương tác hơn 16 triệu lần với mô hình Claude nhằm đào tạo các mô hình của riêng họ.
DeepSeek âm thầm ra mắt hai chế độ trò chuyện mới: Instant Mode và Expert Mode. Chế độ Chuyên gia hứa hẹn chất lượng cao hơn nhưng lại loại bỏ tính năng tải tệp, trong khi chế độ Nhanh vẫn giữ đầy đủ chức năng. Động thái này được cho là nhằm quản lý tải máy chủ và chuẩn bị cho mô hình V4 sắp ra mắt.
DeepSeek sắp phát hành V4, nhưng điểm đáng chú ý nhất lần này không phải tham số mô hình lớn đến đâu, mà là nó chạy trên chip nào. Theo The Information, DeepSeek V4 sẽ chạy trên chip Ascend 950PR của Huawei, đánh dấu mô hình AI tiên tiến đầu tiên được xây dựng riêng cho kiến trúc chip nội địa Trung Quốc.
DeepSeek đã phát hành mô hình chuyên dụng Prover-V2 trong lĩnh vực chứng minh định lý toán học, nhằm tự động chứng minh các định lý trong hệ thống xác minh hình thức Lean 4 bằng AI.
Bài viết so sánh các mô hình suy luận hàng đầu từ OpenAI, DeepSeek, Google và Anthropic, phân tích chiến lược, sự đánh đổi giữa độ sâu suy luận và tốc độ phản hồi, cũng như cuộc cạnh tranh giữa mã nguồn mở và mã nguồn đóng.
DeepSeek V4 với một nghìn tỷ tham số và Qwen 3.6-Plus với giấy phép Apache 2.0 đang định hình lại thị trường AI mã nguồn mở, khi thị phần kết hợp của họ tăng từ dưới 1% lên 15% chỉ trong một năm.
DeepSeek V4 và Qwen 3.5 (hay Qwen 3.6-Plus) đang cạnh tranh trực tiếp trên cùng một thị trường AI mã nguồn mở, với chi phí cực thấp so với các đối thủ đóng. Bài viết so sánh thông số, điểm mạnh và ý nghĩa cho nhà phát triển.
DeepSeek đã trở thành huyền thoại trong ngành về kiểm soát chi phí, với chi phí huấn luyện V3 khoảng 5,5 triệu USD và phí GPU R1 khoảng 294.000 USD, thấp hơn nhiều so với ngân sách từ 100 triệu đến 1 tỷ USD của các công ty Mỹ.
DeepSeek V3.1 là mô hình lai đầu tiên của họ, tích hợp khả năng của V3 (tổng quát) và R1 (suy luận) vào một mô hình duy nhất, với hai chế độ Think và Non-think có thể chuyển đổi linh hoạt.
DeepSeek đã mở mã nguồn mô hình suy luận R1 vào tháng 1 năm 2026, gây bất ngờ khi hiệu suất của nó ngang ngửa OpenAI o1, trong khi phiên bản cô đọng 32B thậm chí vượt qua o1-mini, phá vỡ rào cản về giá của các mô hình đóng.
DeepSeek V3 sử dụng kiến trúc MoE với 671B tham số nhưng chỉ kích hoạt 37B cho mỗi token, đạt hiệu suất ngang GPT-4o với chi phí huấn luyện chỉ 5,5 triệu USD.