Trận chiến cuối cùng của Altman! Sau 4 tháng, bàn giao AGI

Báo cáo từ Zhixin Yuan
Báo cáo từ Zhixin Yuan

AGI đã có người công bố đã đạt được.
Ngay trong cuộc họp báo cáo tài chính vào thứ Tư tuần này, “Lão Hoàng” đã tuyên bố:
Đối với rất nhiều nhiệm vụ, chúng ta có thể nói rằng AGI đã được hiện thực hóa.

Ngày hôm đó, một cuộc phỏng vấn dài hơn hai tiếng rưỡi với Altman cũng được phát hành. Ngày mà ông ấy đưa ra là cuối năm 2026.
Với Altman, 4 tháng này không chỉ là cuộc đua công nghệ. Trước khi niêm yết vào năm sau, ông ấy bắt buộc phải đánh lá bài AGI này.
Nếu không đánh ra được, khi ông ấy gõ chuông, trước mặt đã có một đối thủ niêm yết trước, giá trị vốn hóa gấp đôi và còn đang sinh lời.
Trận này, OpenAI đã không còn đường lùi.


Trong cuộc điện thoại đó, có người hỏi ông ấy, cách nhìn nhận khi các công ty như OpenAI dốc toàn lực chạy đua AGI.
Lão Hoàng trả lời rằng, bây giờ không có gì để tranh cãi, cả ngành thậm chí còn chưa thống nhất được “trí thông minh” là gì, huống chi là dùng thước đo nào để đo AGI.
Trong tay ông ấy đang cầm một điều khác.
Kiến trúc AVO của Nvidia đã giành được 100% điểm trong bài kiểm tra ARC-AGI-3 chuyên đánh giá “agent có thể tự thực hiện công việc lâu dài hay không”.
Theo đà thành tích này, ông đưa ra một dự đoán đầy tham vọng:
Trong tương lai gần, Nvidia có thể chỉ cần duy trì khoảng 40.000 nhân viên con người, nhưng họ sẽ sở hữu 400.000 hoặc thậm chí 4 triệu nhân viên số.


Ai cũng biết, cách vận hành của ARC-AGI-3 khá là “phi truyền thống”.
Ném agent vào một trò chơi hoàn toàn lạ, không cung cấp luật chơi và mục tiêu, hoàn toàn phải tự thử, tự quan sát, tự đoán. Những gì nhận được chỉ là một lưới 64×64 và vài nút bấm, mỗi môi trường ít nhất sáu màn, màn đầu tiên đi năm bước đã qua, thì màn thứ sáu phải bước năm mươi bước.
Người chơi còn thấy khó, mô hình cũng không khá hơn là mấy.

Điểm mấu chốt ở đây: Mô hình AVO sử dụng là Claude Opus 5.
Rồi Nvidia chỉ đơn thuần bọc lên nó một lớp. Trọng số không đổi một tham số nào mà chạy từ 30,16% lên thẳng mức tuyệt đối.
Thực tế, có hai điều thực sự phát huy tác dụng ở đây.
Một là bộ nhớ lâu dài, khi context đầy cũng không reset lại, agent tiếp tục từ trạng thái hiện tại, không cần mắc lại cùng một lỗi lặp lại.
Hai là bộ giám sát, nó không tự làm việc, chỉ quan sát toàn bộ vết tìm kiếm, phát hiện agent “dậm chân tại chỗ” thì kéo hướng agent sang chiến lược khác.

Tuy nhiên, nghiêm khắc mà nói, bài thi điểm tuyệt đối này không thực sự hợp lệ.
Chỉ hơn ba giờ sau khi Nvidia công bố, cha đẻ ARC-AGI là François Chollet đã đăng tweet cho biết:
Đạt 100% trên tập demo công khai không có nghĩa là đạt 100% trên chuẩn ARC-AGI-3. Điều đó giống như bạn vượt qua một trò chơi điện tử, thực ra bạn chỉ qua phần hướng dẫn cho người mới mà thôi.
Theo chính mô tả của ARC Prize, tập public vốn không dùng để chấm điểm, thực sự có giá trị kiểm chứng là tập bán riêng tư và tập riêng tư mà kết quả trên AVO lại không có hai chỉ số này.

Tinh tế hơn, đây đã là “tờ bài thi điểm tuyệt đối” thứ ba trong sáu tuần qua.
Tycho là người đầu tiên đạt được vào cuối tháng 7, VISTA đạt tiếp vào ngày 5/8, AVO là thứ ba. Giải pháp hoàn toàn khác nhau, nhưng mô hình “lái” đều là Claude Opus 5.

Ngày càng nhiều người tuyên bố AGI nhưng dường như chỉ có hai bên thực sự chế tạo được AGI.
Và lá bài này, chưa có ai thực sự đánh ra.

Trong cuộc phỏng vấn đặc biệt, Altman đầy tự tin:
Đến cuối năm nay, nội bộ OpenAI sẽ xuất hiện một hệ thống mà ông ấy sẵn sàng gọi là AGI.
Giám đốc nghiên cứu Mark Chen thì dè dặt hơn. Theo ông, khoảng cách giữa OpenAI và AGI còn 20% nữa.
Nghe vẫn “ngông” nhưng thực sự trong tay họ cũng không ít thứ.

Năm nay OpenAI đặt ra mục tiêu rất rõ ràng bên trong: chế tạo ra một thực tập sinh AI có thể tự động làm việc thực sự.
Và “thực tập sinh AI tự động” này chính là Astra.
Chỉ cần đưa cho Astra một ý tưởng thực nghiệm, nó có thể tự viết code trong kho mã của OpenAI, thực hiện thí nghiệm, nộp kết quả.
Vứt cho nó một bài báo khoa học, Astra có thể hoàn thành lượng công việc mà một nhà nghiên cứu hàng đầu cần khoảng một tuần.


Trong một buổi trình diễn nội bộ gần đây, các lãnh đạo khách hàng lớn đã trực tiếp chứng kiến.
Trên màn hình lớn, 16 agent AI chia nhỏ một bài toán toán học nghiên cứu thành các vấn đề con.
Chúng chia mỗi người một việc, phối hợp kiểm tra lẫn nhau, cuối cùng ghép lại thành một bản chứng minh hoàn chỉnh.
Nhìn như một nhóm đội ngũ phối hợp siêu ăn ý đang hội ý riêng tư với nhau.
Trình diễn thứ hai còn ấn tượng hơn.
Astra mở các phần mềm desktop phổ biến, chuyển đổi qua lại giữa các ứng dụng, tạo file, sửa nội dung, điều phối tác vụ, tốc độ nhanh đến nỗi không giống người gõ bàn phím.
Ai chứng kiến đều cảm thán, lần này Astra thực sự đã chinh phục “agent bền vững”.
Và Altman thậm chí còn dự đoán: “Tôi đoán đây sẽ là mô hình lần đầu tiên thực sự phát minh ra điều gì đó quan trọng mới. Đây là điểm rất AGI.”
Hãy chú ý đến cụm từ “phát minh mới”, ý là tạo ra từ con số không những thứ toàn nhân loại chưa biết tới.


Gần đây, chip cây nhà lá vườn đầu tiên của OpenAI có tên “Jalapeño” đã trực tiếp “chà xát” flagship GPU của Lão Hoàng.
Đầu tàu lớn nhất phía sau là GPT-Astra.
Nó trực tiếp nhúng tay vào từ thiết kế mạch đến phần mềm.
Về phía chip, trực tiếp tối ưu hóa mạch cơ sở. Phía phần mềm, viết và tối ưu kernel lõi và thuận tay “tune” cả ba mô hình mã nguồn mở lớn.
Kết quả, hiệu suất BF16 Multipler tăng vọt 56% mà diện tích phần tử ma trận lại giảm 10%.
Hai module “Cơ chế attention” và “MoE” còn chạy nhanh hơn bản viết tay thủ công bởi chuyên gia con người tận 1,5 đến 1,8 lần.
Các bạn thấy đấy, AI giờ đang chỉnh sửa mạch điện ở tầng phần cứng cơ mà.

Thú vị là, phía Nvidia cũng đang làm chuyện tương tự.
AVO vốn không phải để “chơi game”, chiến trường chính của nó là viết code tầng thấp cho GPU.
Tháng 3 năm nay, Nvidia từng công bố bài báo mà ý tưởng cốt lõi là giao toàn bộ bước “sửa code” cho một agent làm việc tự chủ.
Kết quả thực nghiệm, nó vận hành liên tiếp 7 ngày, hoàn toàn không ai can thiệp, khám phá hơn 500 phương án tối ưu, cuối cùng nộp 40 phiên bản kernel hiệu quả.
Code lõi sinh ra nhanh hơn bản đóng nguồn của chính Nvidia 3,5%, nhanh hơn bản mã nguồn mở hàng đầu ngành tận 10,5%.


Bây giờ, nối hai chuyện đó lại thì câu nói của Altman có căn cứ.
Mỗi một vòng lặp mô hình cần tiêu tốn rất nhiều thời gian nghiên cứu của con người. Nhưng nếu Astra bắt đầu đảm nhiệm khâu này, tốc độ R&D sẽ có bước ngoặt hoàn toàn.
Một khi vòng xoay này đã hoạt động, còn lại chỉ là vấn đề tốc độ.

Thực tế, GPT-5.6 và Fable 5 mà người ngoài dùng được đều là thành quả của vòng trước.
Và leak tiết lộ, thế hệ tiếp theo thực sự của hai bên đều đã huấn luyện xong.

Spud (Sol): hoàn thành pre-training vào tháng 3, tương ứng với series GPT-5.5, 5.6 đã công bố;
Doug: hoàn thành tháng 4-5, tiếp tục fine-tune reinforcement learning các kiểu, chính là Astra sắp ra mắt, hay còn gọi bên ngoài là GPT-6;
Bel: vừa kết thúc pre-training tháng 8, số tham số vượt 10 nghìn tỷ, quy mô gần bằng GPT-4.5 thời đó.
Theo leak, nội bộ OpenAI đã xem Bel như “mô hình nền tảng sau GPT-6”, thậm chí có thể trở thành nền móng cho một mô hình vượt ngưỡng AGI.


Bên Anthropic, ngày 18/8 có người phát hiện, một số tài khoản chọn Fable 5 trên web Claude đã âm thầm được chuyển sang mô hình mới.
Đây là “luật bất thành văn” trước khi Anthropic phát hành, chính Fable 5 trước kia cũng từng được thử nội bộ như vậy.
Kế đó, mã hiệu bị “đào” ra.
claude-melon-eap, nghi là Fable 5.1;
claude-marshmallow-eap, nghi là Opus 5.1.
Và nghe đồn hai mô hình mới đều đã thử nghiệm quy mô nhỏ, bất kỳ lúc nào cũng có thể public rộng rãi.

Lý do đều không phát hành, phân tích của netizen là ai ra trước sẽ bị đối thủ “đè lên” ngay sau vài ngày.
Đặc biệt Anthropic còn bị tiết lộ sẽ vươn lên vị trí dẫn đầu ngay vào đầu 2027.

Điều này cũng vẽ rõ khung thời gian của chiến tranh hiện nay.
4 tháng còn lại của năm 2026.
Có tổ chức từng tính toán, Anthropic có 88% cơ hội niêm yết trước OpenAI, ngày khả dĩ nhất là 26/10 năm nay, còn OpenAI có thể nhất là 15/7 năm sau.
Giá trị vốn hóa dự đoán phiên mở màn niêm yết là, Anthropic 1,82 nghìn tỷ USD, OpenAI 1,06 nghìn tỷ USD.
CFO của OpenAI phát biểu tại họp toàn công ty tháng 8 nói rằng, công ty sẽ IPO vào 2027 hoặc sớm hơn, với điều kiện doanh nghiệp tiếp tục “tăng trưởng trở lại”.
Vậy nên AGI vào cuối năm không chỉ là cột mốc kỹ thuật.
Nó chính là trang quan trọng nhất trong prospectus gọi vốn.
Nộp được, câu chuyện của OpenAI sẽ chuyển thành “chúng tôi đã về đích”, thay đổi hoàn toàn logic định giá. Nộp không nổi, đến tháng 7 năm sau khi chuông gõ, câu chuyện vẫn là “đốt tiền chạy mô hình”.
Và lý do trận này không thể không đánh, nằm ở bốn chữ “tự cải tiến lặp lại”.
Câu nói “40 nghìn người chỉ huy 4 triệu AI Agent” của Lão Hoàng, câu “AI đã giúp tạo ra thế hệ AI tiếp theo” của OpenAI, đều nói về một việc: Khi AI có thể nắm quyền tạo ra AI thế hệ tiếp theo, tiến bộ sẽ không còn là tuyến tính nữa.
Đó là lý do vì sao tất cả mọi người đều đặt cược: cuộc đua trí tuệ siêu việt (ASI), người thắng là người ăn tất.
Người khởi động được vòng lặp này trước sẽ lấy hết tất cả về sau, còn á quân thậm chí có thể chẳng còn cơ hội bám đuổi.
Sau lưng Altman, đã không còn đường lùi nào nữa.
Biên tập: Moses Đào


Tuyên bố miễn trừ trách nhiệm: Mọi thông tin trong bài viết đều thể hiện quan điểm của tác giả và không liên quan đến nền tảng. Bài viết này không nhằm mục đích tham khảo để đưa ra quyết định đầu tư.
Bạn cũng có thể thích

Một chiếc nhẫn AI, tại sao lại có giá trị tới 16 tỷ USD?

Cục Dự trữ Liên bang sẽ làm gì? Walsh đã đưa ra câu trả lời!

GTA 6 mang lại cơ hội đầu tư!?

