Codex đổi cách quản lý ngữ cảnh: mở cửa sổ mới thay vì tóm tắt
Ba pull request đã merge cho thấy Codex sẽ mở cửa sổ ngữ cảnh mới thay vì tóm tắt khi đầy, kèm công cụ tra lịch sử và ghi chú để mô hình tự lấy lại thông tin cần thiết.
119 bài đã kiểm chứng về Lập trình AI, sản phẩm và diễn biến ngành. Trang 1/2
Ba pull request đã merge cho thấy Codex sẽ mở cửa sổ ngữ cảnh mới thay vì tóm tắt khi đầy, kèm công cụ tra lịch sử và ghi chú để mô hình tự lấy lại thông tin cần thiết.
ByteDance lùi lịch ra mắt mô hình Doubao 2.2 để dồn thời gian nâng cấp năng lực lập trình, gọi công cụ và Agent trước khi phát hành.
OpenAI thông báo chấm dứt hợp đồng cung cấp mô hình cho Cursor sau khi SpaceX mua lại công ty này với giá 60 tỷ USD, ngày ngừng dịch vụ dự kiến 12/11/2026.
Ngày đầu GLM-5.3-Flash bắt đầu thu phí, DeepSeek trở lại vị trí số 1 về lượng sử dụng hằng ngày trên OpenCode, hé lộ độ nhạy cảm về giá của lập trình viên.
OpenAI đang thử nghiệm chế độ Persistent mode cho Codex dòng lệnh, cho phép tác nhân AI chạy liên tục đến khi người dùng chủ động tạm dừng, nhưng công ty chưa có kế hoạch ra mắt trong thời gian gần.
Warp chia sẻ cách một agent chỉnh sửa liên tục điều chỉnh kỹ năng của các AI agent dựa trên phản hồi con người, mà không đụng đến trọng số mô hình.
CEO Shopify Tobi Lütke dọa cấm Claude Code nội bộ nếu Anthropic không chịu đọc AGENTS.md, buộc hãng lần đầu giải thích lý do từ chối sau một năm im lặng.
Nội bộ OpenAI gần như ai cũng dùng Codex, nhưng người dùng cá nhân trả phí dùng agent chưa đến 1% — TechCrunch chỉ ra khoảng cách nằm ở đâu.
OpenAI khôi phục giới hạn năm giờ cho gói Plus trên ChatGPT Work và Codex, đồng thời thừa nhận 3% lượt Pro và Thinking bị chuyển nhầm sang GPT-5.5-mini.
GPT-5.6 Sol dựng bộ xử lý RV32IM Codex-R32 từ cổng logic trong game Turing Complete và chạy được DOOM bản PureDOOM, cho thấy khả năng thiết kế nhất quán xuyên nhiều tầng trừu tượng của mô hình.
ByteDance sáp nhập TRAE và Coze vào hệ sinh thái Doubao, dồn năng lực lập trình AI và dựng agent vào một sản phẩm văn phòng mới mang tên Doubao Work.
OpenRouter xuất hiện mô hình ẩn danh Ox Alpha, ngữ cảnh 1 triệu token miễn phí, dấu vết kỹ thuật chỉ về Zhipu, giữa lúc ra mắt ẩn danh trở thành chiến thuật phát hành.
Nvidia trả 6 tỷ USD để license hệ thống huấn luyện Model Factory của Poolside, đầu tư thêm 1 tỷ USD và mời 109 nhân sự về đầu quân, nhưng công ty vẫn hoạt động độc lập.
Anthropic công khai tài liệu về vòng đời phát triển phần mềm AI-native gồm sáu giai đoạn, chuỗi tệp markdown và bốn công cụ quản trị mà công ty dùng nội bộ quanh Claude.
OpenAI cho biết đợt giảm hạn mức Codex gần đây nhắm vào người chuyển gói thuê bao thành API rồi chia sẻ qua sub2api, bị hệ thống chống gian lận đánh dấu.
OpenAI công bố mở mã nguồn "harness" của Codex qua ba cấp độ tích hợp; Cisco, GitHub, JetBrains và một dịch vụ khai thuế đã đưa vào sản phẩm, một thử nghiệm xử lý 7.000 hồ sơ thuế.
Anthropic giao ca trực CI/CD nội bộ cho Claude: trung vị 14 phút có phân tích kèm bằng chứng, nhanh nhất 4 phút chỉ ra nguyên nhân gốc, trong bối cảnh sản lượng code giao mỗi quý tăng gấp 8 lần.
GLM-5.3 đạt 60 điểm trên chỉ số Intelligence Index của Artificial Analysis, xếp thứ 8 trong 182 mô hình; giá API 1,4/4,4 USD nhưng tiêu tốn nhiều token hơn đối thủ cho mỗi tác vụ.
Cursor ra mắt Origin, dịch vụ lưu trữ mã tự xây cho người dùng trả phí, chỉ vài giờ trước khi GitHub gặp sự cố toàn cầu kéo dài gần 7 tiếng, làm dấy lên câu hỏi về tương lai lưu trữ mã thời AI agent.
Modular vừa đưa trình biên dịch và bộ công cụ Mojo lên GitHub theo giấy phép Apache 2.0 kèm ngoại lệ LLVM, chỉ một tháng sau khi Qualcomm hoàn tất thương vụ mua lại công ty.
OpenCode Go nâng hạn mức Flash trong gói Go từ 15 lên 30 USD mỗi tháng, đồng thời thử nghiệm biểu giá theo khung giờ cao điểm cho gói Pro.
OpenAI cho biết gần như mọi cảnh báo an ninh ban đầu nay do AI phân loại trước, con người chỉ xử lý các quyết định tác động lớn.
API DeepSeek V4 Pro đã chuyển sang bản 0813, kèm ngữ cảnh 1M token, trần đầu ra 384K và cảnh báo tăng giá.
Qwen3.8-2.4T-A95B đã xuất hiện trên ModelScope như một kho open-weight, biến lời hứa mở trọng số thành đối tượng có thể kiểm chứng.
InclusionAI mở nguồn Ling-3.0-tiny, mô hình MoE 7,9B tham số, kích hoạt 1,3B tham số mỗi token cho tác vụ agent cục bộ.
Thinking Machines công bố Inkling-Small dạng open weights, với 276B tham số tổng, 12B tham số kích hoạt và nhiều điểm reasoning/coding gần mẫu Inkling 975B.
DeepSeek mở beta công khai API V4-Flash 0731, hỗ trợ Responses API cho Codex và công bố mức tăng lớn trên các bài đo agent.
Unity Trung Quốc ra mắt Tuanjie Engine 2.0 và Codely, đưa game agent vào quy trình kỹ thuật có thể kiểm chứng.
Laguna S 2.1 đặt cược vào nhu cầu tự host của doanh nghiệp: mã nguồn ở lại hạ tầng nội bộ, dù hiệu năng vẫn còn kém nhóm mô hình đóng dẫn đầu.
Qwen3.8-Max-Preview có 2,4T tham số, tích hợp Qoder và mức giảm Credits lớn trước khi có model card đầy đủ và benchmark độc lập.
Gemini 3.5 Pro của Google được cho là chậm tiến độ vì năng lực lập trình của mô hình vẫn cần cải thiện.
Moonshot AI công bố Kimi K3 với 2,8 nghìn tỷ tham số, ngữ cảnh 1 triệu token và bảng giá API; phần open-weight vẫn cần trọng số và model card để hoàn tất.
Agnes-2.5-Flash dùng mô hình lập trình miễn phí để tạo áp lực lên công cụ developer agentic. Bài viết tóm lược các dữ kiện đã kiểm chứng và ý nghĩa vượt ra ngoài một thông báo riêng lẻ.
Grok Build bị cáo buộc tải lên bundle kho mã vượt ngoài các tệp đã mở. Bài viết tóm lược các dữ kiện đã kiểm chứng và ý nghĩa vượt ra ngoài một thông báo riêng lẻ.
Claude viết lại Bun sang Rust, cộng đồng Zig phản ứng. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
Grok 4.5 dùng giá thấp để giành chỗ trong lập trình. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
GhostApproval phơi bày rủi ro symlink trong công cụ lập trình AI. Bản địa hóa ngắn gọn các dữ kiện đã kiểm chứng và tín hiệu ngành phía sau.
Meta định giá Muse Spark 1.1 cho tác vụ agent được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
MoonBit đặt cược vào ngôn ngữ lập trình gốc AI được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
Claude Code bị NVDB Trung Quốc cảnh báo rủi ro được viết lại cho độc giả công nghệ Việt Nam, giữ nguyên các con số, tuyên bố sản phẩm và điểm cần kiểm chứng.
Software factories, enterprise agents and investor-operators.
Model choice, Azure hosting and coding-model price pressure.
AI coding agents, ACP protocol support and editor strategy.
Meta hạn chế Claude Code và Codex trong các nhóm AI. Bài viết tóm lược các điểm chính, số liệu quan trọng, phản hồi doanh nghiệp và ý nghĩa với thị trường hoặc quản lý.
Claude Sonnet 5 nhắm đến agent rẻ hơn。
Cursor đưa agent lập trình lên điện thoại。
Chamath trở lại ghế CEO sau vòng gọi vốn 135 triệu USD của 8090 Labs
Google thúc đẩy nhóm lập trình khi mã do AI viết kẹt quanh một nửa
Base44 của Wix ra mắt mô hình riêng khi ARR đạt 150 triệu USD
Tenet Security mô tả Agentjacking, nơi kẻ tấn công chèn báo lỗi giả khiến coding agent coi đó là hướng dẫn sửa lỗi đáng tin cậy.
GLM-5.2 mở trọng số của Z.ai đạt 74,4 trên FrontierSWE, gần Claude Opus và vượt GPT-5.5 ở vài benchmark coding trong khi giá token thấp hơn nhiều.
Các tín hiệu chưa xác nhận từ OpenAI cho thấy GPT-5.6 có thể tập trung vào ngữ cảnh dài, suy luận mạnh hơn và lập trình agent.
Nghiên cứu Agentjacking của Tenet cho thấy telemetry đáng tin có thể biến thành lệnh thực thi cho trợ lý lập trình.
Tải từ các agent lập trình chạy liên tục đang thử thách hạ tầng GitHub thời con người và kế hoạch chuyển sang Azure.
Chỉ vài ngày sau IPO, SpaceX thực hiện quyền chọn mua Anysphere, công ty đứng sau Cursor, bằng cổ phiếu.
Moonshot AI tung Kimi K2.7-Code cùng chế độ HighSpeed. Một vài điểm benchmark tự công bố vượt Claude Opus 4.8, nhưng lợi thế lớn hơn nằm ở giá đầu ra thấp.
xAI thêm Agent Dashboard vào Grok Build và hạ ngưỡng truy cập từ gói Heavy 300 USD xuống các gói rẻ hơn.
Benchmark do Đại học Giao thông Thượng Hải dẫn dắt cho thấy agent thường tìm đúng file nhưng chỉ định đúng dòng liên quan bug khoảng 14% đến 19%.
GLM-5.2 của Zhipu kết hợp kiến trúc MoE 744B tham số, cửa sổ 1 triệu token và kế hoạch mở trọng số kiểu MIT cho agent lập trình.
Mô hình MoE mở của Moonshot rẻ hơn đáng kể ở cả input lẫn output token, đồng thời cải thiện benchmark lập trình kiểu agent so với K2.6.
Bộ phân loại của Cursor cho phép thao tác rủi ro thấp đi tiếp và chỉ dừng ở bước nhạy cảm, giảm mệt mỏi phê duyệt cho lập trình viên.
Lệnh mới của Anthropic sao chép phiên lập trình đang chạy để nhà phát triển thử hướng rủi ro mà không mất ngữ cảnh gốc.
Moonshot mở Kimi K2.7-Code cho lập trình AI.
Diễn biến này cho thấy cạnh tranh AI không chỉ nằm ở mô hình hay công cụ, mà còn ở vốn, triển khai với khách hàng và năng lực ứng phó quy định.
Diễn biến này cho thấy cạnh tranh AI không chỉ nằm ở mô hình hay công cụ, mà còn ở vốn, triển khai với khách hàng và năng lực ứng phó quy định.
Mô hình MoE 30B của Cohere kích hoạt khoảng 3B tham số, hỗ trợ ngữ cảnh 256K và phát hành theo Apache 2.0.
Cursor dự định đặt trụ sở châu Âu tại London và tăng đội ngũ khu vực lên khoảng 200 người cuối năm nay.
Nền tảng backend dựa trên Postgres nói người dùng hơn gấp đôi từ vòng trước và agent hiện triển khai đa số cơ sở dữ liệu.
Copilot’s AI Credits make agentic sessions and frontier models usage-based, exposing developers to bills far above the old flat subscription.
Plugin theo vai trò, Sites và annotations biến Codex thành công cụ workflow cho nhân viên tri thức không viết mã.
Một chương trình thử nghiệm của Google Play được cho là đề nghị trả tiền mua mã nguồn, cả dự án đã lưu kho, dù email không nhắc tới AI.
Tại Build 2026, Microsoft giới thiệu bảy mô hình tự huấn luyện, trong đó MAI-Code-1-Flash vượt Claude Haiku 4.5 trên các benchmark lập trình được nêu.
GitHub thay premium request của Copilot bằng AI Credits, khiến các phiên agent coding dài phải trả sát chi phí token hơn.
Tại Build 2026, Microsoft định vị Windows như nền tảng agent và cho biết Project Polaris sẽ trở thành engine suy luận mặc định của GitHub Copilot.
Sekai huy động Series A 20 triệu USD sau khi người dùng tạo 15 triệu mini app và dành hơn một giờ mỗi ngày trên nền tảng.
Copilot chuyển từ premium request sang AI Credits, phơi bày chi phí token thật của lập trình kiểu agent.
Startup lập trình AI Cognition huy động hơn 1 tỷ USD với định giá 26 tỷ USD, tuyên bố 90% mã nội bộ do AI Devin tạo ra.
Tại sự kiện nhà phát triển châu Âu đầu tiên của Anthropic, một cuộc giơ tay cho thấy gần một nửa số người tham dự đã merge pull request do Claude viết hoàn toàn mà không đọc code.
Bản cập nhật Cursor 3.5 đưa tính năng Automations từ trang web độc lập vào Agents Window trong IDE, hỗ trợ đa kho lưu trữ và quy trình làm việc ngoài viết code.
Google đã ra mắt Antigravity 2.0 tại I/O 2026, một nền tảng tác tử độc lập có thể điều phối 93 tác tử con để xây dựng hệ điều hành trong 12 giờ.
Cursor phát hành mô hình lập trình thế hệ thứ ba Composer 2.5, đạt điểm chuẩn ngang với Opus 4.7 và GPT-5.5 với chi phí chỉ bằng một phần mười mỗi tác vụ.
Gemini 3.5 Flash của Google vượt qua GPT-5.5 trong các bài kiểm tra tác tử với giá rẻ bất ngờ, và trở thành mô hình mặc định trên ứng dụng Gemini và Tìm kiếm.
OpenAI added Codex controls to ChatGPT on iPhone, iPad and Android, letting users monitor and approve coding tasks away from the desktop.
Cursor’s cloud agents now support multi-repository environments, faster builds and enterprise controls for teams with microservice codebases.
Coder Agents đưa agent lập trình AI vào hạ tầng riêng của doanh nghiệp, cho phép chọn mô hình linh hoạt mà không phải gửi mã nguồn hay prompt ra ngoài mạng nội bộ.
Cognition AI, công ty tạo ra Devin – "kỹ sư phần mềm AI tự động đầu tiên trên thế giới", đang đàm phán vòng gọi vốn mới với mức định giá 25 tỷ USD, tăng gấp 6 lần chỉ trong 13 tháng.
Sundar Pichai tiết lộ tại cuộc họp báo cáo thu nhập rằng 75% mã nguồn mới của Google hiện do AI tạo ra, tăng từ 25% cách đây 18 tháng, đồng thời cho thấy tốc độ di chuyển mã nhanh gấp 6 lần. Một số nhân viên DeepMind thậm chí dùng Claude Code của đối thủ thay vì Gemini.
DeepSeek phát hành V4-Pro và V4-Flash với kiến trúc MoE, giá đầu ra chỉ 3,48 USD/triệu token, rẻ hơn đáng kể so với GPT-5.5 và Claude Opus 4.7, đồng thời đạt điểm Codeforces 3206 vượt GPT-5.4.
Khảo sát tháng 1/2026 của JetBrains với hơn 10.000 nhà phát triển chuyên nghiệp cho thấy 90% đã sử dụng công cụ AI, trong đó Claude Code tăng từ 3% lên 18% chỉ sau sáu tháng, trong khi GitHub Copilot không tăng trưởng đáng kể ở mức 29%.
Anthropic thiết kế lại hoàn toàn ứng dụng desktop Claude Code và ra mắt tính năng Routines, cho phép lập trình viên quản lý nhiều phiên làm việc song song và tự động hóa quy trình thông qua sự kiện GitHub.
Sau hai năm phổ biến công cụ lập trình AI, một số nhóm chứng kiến số lượng commit code tăng gấp đôi nhưng giao sản phẩm không nhanh hơn và lỗi lại nhiều hơn. Hiện tượng "Tokenmaxxing" – coi hạn mức token AI như thước đo năng suất – đang bị dữ liệu phản bác.
Qwen3.6-35B-A3B, mô hình MoE có tổng 35B tham số nhưng chỉ kích hoạt 3B khi suy luận, đạt 73,4% trên SWE-bench Verified, vượt xa Gemma 4-31B của Google. Mô hình có thể chạy trên RTX 4090 và MacBook Pro M4/M5.
Cursor, công cụ lập trình AI, đang đàm phán vòng gọi vốn 2 tỷ USD với định giá trước đầu tư hơn 50 tỷ USD, do a16z và Thrive Capital dẫn đầu, có sự tham gia của Nvidia.
Nhóm kỹ thuật của Agoda nhận thấy năng suất cá nhân tăng nhờ AI, nhưng tốc độ bàn giao dự án tổng thể không thay đổi, khiến điểm nghẽn chuyển từ viết code sang review code và đặc tả yêu cầu.
Mọi người đều nghĩ các công cụ lập trình AI cuối cùng sẽ hợp nhất thành một – kết quả lại ngược lại.
Apple đang gửi hàng loạt kỹ sư của nhóm Siri tham gia trại huấn luyện lập trình AI, tập trung vào việc sử dụng Claude Code, trong bối cảnh chuẩn bị cho WWDC và nỗ lực cải thiện trợ lý ảo sau nhiều thất bại.
Factory huy động 150 triệu USD vòng B, định giá 1,5 tỷ USD, do Khosla Ventures dẫn đầu. Startup xây dựng tác nhân AI lập trình cấp doanh nghiệp, phục vụ các đội ngũ kỹ thuật lớn với quy trình tuân thủ và bảo mật phức tạp.
Z.ai (trước đây là Zhipu AI) phát hành GLM-5.1 với 754B tham số, kiến trúc MoE, mã nguồn mở theo giấy phép MIT. Mô hình đạt 58,4% trên SWE-Bench Pro, vượt GPT-5.4 và Claude Opus 4.6, và được huấn luyện hoàn toàn trên chip Huawei Ascend 910B và framework MindSpore, không sử dụng GPU NVIDIA.
OpenAI đã triển khai mô hình GPT-5.3-Codex-Spark trên chip Cerebras WSE-3 thay vì GPU Nvidia, đạt tốc độ hơn 1000 token/giây, nhanh gấp khoảng 15 lần so với phiên bản tiêu chuẩn, đánh dấu lần đầu tiên hãng đưa mô hình sản xuất lên phần cứng không phải của Nvidia.
OpenAI cập nhật lớn cho Codex, biến nó từ công cụ trò chuyện viết mã thành một agent có thể hoạt động thầm lặng trên nền desktop. Bản cập nhật giới thiệu tính năng "background computer use" cho phép Codex điều khiển các ứng dụng khác trên macOS mà không chiếm toàn bộ màn hình, cùng với trình duyệt tích hợp, tạo hình ảnh, hơn 90 plugin mới và khả năng tự lập lịch.