Chuyển tới nội dung chính

Đánh giá GPT-6 Astra: Giá, tính năng, phản hồi cộng đồng và so sánh với Claude, Gemini

· 11 phút để đọc
Claude Dev
Claude Dev

OpenAI đã phát hành GPT-6 Astra, mô hình flagship mới cho reasoning phức tạp, kỹ thuật phần mềm, điều khiển máy tính, nghiên cứu và tạo tài liệu. Điểm đáng chú ý không chỉ là “thông minh hơn”: Astra được thiết kế để thực hiện một workflow hoàn chỉnh qua code, trình duyệt và phần mềm chuyên nghiệp, đồng thời hỏi lại khi một quyết định chưa rõ có thể làm thay đổi kết quả.

Trong API, model có ID gpt-6-astra. OpenAI cho biết rollout bắt đầu với một số tổ chức giới hạn rồi mở rộng tới ChatGPT Plus, Pro, Business, Enterprise, Azure và Amazon Bedrock. Giá API Standard là 10 USD cho mỗi triệu input token và 50 USD cho mỗi triệu output token. Cache và Fast mode được tính riêng; Fast có giá gấp đôi Standard.

Mức giá này đưa Astra vào cùng phân khúc cao cấp với Claude Fable 5.1, trong khi Gemini 3.8 Flash vẫn rẻ hơn rất nhiều theo token. Phản hồi sớm của cộng đồng khiến bài toán so sánh phức tạp hơn: người dùng khen coding và research, nhưng cũng phản ánh token usage cao, initiative không ổn định, rollout gây nhầm lẫn và trải nghiệm viết sáng tạo chưa thuyết phục.

Kết luận thực tế: GPT-6 Astra là một model để escalation cho việc khó, không phải lựa chọn thay thế tự động cho mọi lời gọi Claude hay Gemini.

OpenAI đã phát hành gì

OpenAI mô tả GPT-6 Astra là model mạnh nhất được triển khai rộng rãi của hãng. Nó hướng tới các tác vụ có nhiều bước reasoning, gọi tool, kiểm tra và theo dõi liên tục.

Thông số API hiện tại:

  • Model ID: gpt-6-astra
  • Context window: 1.050.000 token
  • Output tối đa: 128.000 token
  • Reasoning effort: low, medium, high, xhigh, max
  • Input: text và image
  • Output: text
  • Knowledge cutoff: 30/04/2026
  • Endpoint: Responses, Chat Completions, Realtime, Batch và các endpoint liên quan
  • Khả năng: computer use, structured outputs, streaming, programmatic tool calling, prompt caching, persisted reasoning, compaction và multi-agent orchestration

Model guide còn bổ sung các tính năng cho agent: Astra có thể tiếp tục reasoning trong khi tool bất đồng bộ đang chạy, nhận hướng dẫn giữa chừng qua WebSocket và thay đổi reasoning effort mà vẫn giữ lại phần prompt đã cache.

Khi migrate, tool calling nên dùng Responses API. Cần bỏ các parameter không được hỗ trợ như temperature, top_p, top_logprobs, đồng thời đánh giá lại những cấu hình cũ như none hoặc minimal bằng mức thấp nhất Astra hỗ trợ là low.

Benchmark GPT-6 Astra: ấn tượng nhưng cần đọc phần chú thích

Tài liệu ra mắt của OpenAI báo cáo kết quả mạnh trong computer use và các tác vụ chuyên môn:

Đánh giáGPT-6 AstraGPT-5.6 SolClaude Opus 5Ghi chú
Agents’ Last Exam59,3%53,6%55,5%So sánh do OpenAI công bố
OSWorld 2.0 partial score72,6%65,7%70,2%Bộ offline do OpenAI chỉ định
BrowseComp91,5%90,4%90,8%Research và browsing
AutomationBench41,4%18,1%26,9%Tự động hóa chuyên nghiệp
BenchCAD95,9%83,3%82,1%Thiết kế hỗ trợ bằng máy tính

Đây là tín hiệu hữu ích, nhưng chưa phải bài test độc lập giữa GPT-6, Claude và Gemini. Kết quả đến từ bảng so sánh ra mắt của OpenAI, một số model không có số liệu, và cấu hình tool có thể ảnh hưởng mạnh tới benchmark agent. Gemini 3.8 Flash không xuất hiện trong bảng trên.

Cách đọc hợp lý là Astra có vẻ đặc biệt mạnh trong computer use, browsing và tác vụ chuyên môn end-to-end. Không nên suy ra rằng nó là model tốt nhất cho mọi cuộc trò chuyện, codebase hay công việc viết.

GPT-6 Astra so với Claude Fable 5.1 và Gemini 3.8 Flash

ModelContextOutput tối đaGiá input / outputĐiều khiển reasoningThế mạnh
GPT-6 Astra1,05M128K$10 / $50low đến maxAgent end-to-end, computer use và coding
Claude Fable 5.11M128K$10 / $50Adaptive effortReasoning dài, research và engineering khó
Gemini 3.8 Flash1M64K$0,75 / $3,75 đến hết 2026low / medium / highAgent đa phương thức, Google grounding, tốc độ và chi phí

Giá tính theo một triệu token và chưa bao gồm tool call, lưu cache, search hoặc grounding, retry và human review. Giá giới thiệu của Gemini dự kiến thay đổi từ ngày 01/01/2027.

GPT-6 Astra và Claude Fable 5.1

Astra và Fable 5.1 là hai đối thủ gần nhất về giá và định vị: khoảng một triệu token context, output tối đa 128K và reasoning nâng cao.

Điểm khác biệt của Astra là độ rộng của workflow: OpenAI nhấn mạnh browser control, computer use, phần mềm chuyên nghiệp, tool bất đồng bộ và mid-turn steering. Nó phù hợp khi agent phải chuyển qua lại giữa repository, browser, trình soạn thảo tài liệu và tool bên ngoài.

Fable 5.1 là tầng escalation của Anthropic cho những tác vụ dài và khó nhất. Sonnet 5 dành cho công việc hằng ngày, Opus 5 cho engineering phức tạp, còn Fable dành cho các trường hợp Opus vẫn chưa giải quyết được. Đây là một hệ thống dễ vận hành với team Claude Code.

GPT-6 Astra và Gemini 3.8 Flash

Gemini khác biệt về giá và modality. API nhận text, image, video, audio và PDF, đồng thời cung cấp Google Search grounding, Maps grounding, URL Context, File Search, Code Execution, Function Calling và Computer Use dạng preview. Astra được tài liệu hóa với input text và image, nhưng có output 128K thay vì 64K và thêm các mức xhigh, max.

Với extraction số lượng lớn, input đa phương thức, bản nháp và các bước agent đơn giản, Gemini có thể rẻ hơn đáng kể. Astra có thể đáng tiền khi một lỗi trong migration, điều tra hoặc computer use gây thiệt hại lớn hơn chi phí inference.

chi phí cho mỗi kết quả được chấp nhận
= token + tool call + grounding + retry + thời gian review

Cộng đồng nói gì về GPT-6 Astra

Làn sóng phản hồi đầu tiên rất hào hứng nhưng chưa thống nhất.

Tín hiệu tích cực: coding và research tốt hơn

Developer mô tả Astra đưa ra những quyết định thông minh trong coding và reverse engineering phức tạp. Một số người cho rằng Astra rõ ràng mạnh hơn GPT-5.6 Sol, đồng thời đánh giá cao việc hoàn thiện tài liệu, kiểm tra research và xử lý dự án dùng nhiều tool.

Tín hiệu tiêu cực: token burn và quota

Phàn nàn phổ biến nhất là mức tiêu thụ. Một số người dùng Plus và Pro cho biết Astra dùng nhiều quota ngay trong giai đoạn reasoning, đôi khi trước khi trả về câu trả lời nhìn thấy được. Planning và verification nhiều hơn có thể nâng chất lượng, nhưng khiến “một request” trở thành đơn vị chi phí không chính xác.

Nên đặt reasoning budget, checkpoint, yêu cầu model lập kế hoạch trước khi implement, và chuyển các subtask thường ngày sang model rẻ hơn.

Tín hiệu trái chiều: initiative và phạm vi

Một developer dùng cả Claude và Codex đánh giá cao năng lực Astra nhưng phê bình model đề xuất hạ tầng mới và bắt đầu implement trước khi thống nhất hướng đi. Trí thông minh cao không đồng nghĩa với trải nghiệm cộng tác tốt; prompt, workspace instruction và cấu hình tool vẫn rất quan trọng.

Khả năng viết sáng tạo cần được đánh giá riêng

Một số người khen Astra khi coding nhưng thấy writing flow kém hơn, nhiều refusal hơn hoặc model áp đặt cách hiểu riêng lên writing workspace. Không nên xem “frontier model” là nhãn chất lượng cho mọi việc. Team viết cần test riêng voice, continuity, constraint following, sự tiết chế khi biên tập và refusal behavior.

Safety và quyền truy cập là một phần của sản phẩm

OpenAI cho biết GPT-6 Astra đạt mức Critical về năng lực cybersecurity trong Preparedness Framework. Hãng báo cáo đã tăng cường bảo vệ trước hành động cyber gây hại, prompt injection và hành động vượt quá phạm vi được cấp quyền, cùng với misalignment monitoring rộng hơn khi dùng tool.

Quyền truy cập có thể khác nhau theo gói dịch vụ, workspace administrator, API account, khu vực và cấu hình tool. Enterprise administrator có thể bật Astra, nhưng OpenAI cho biết Enterprise workspace mặc định tắt model này khi ra mắt. Hãy kiểm tra model picker thực tế và danh sách model của API, thay vì chỉ dựa vào ảnh chụp màn hình cộng đồng.

Chiến lược routing thực tế

Tác vụModel nên thử trướcEscalation hoặc fallback
Workflow computer use phức tạpGPT-6 AstraCon người phê duyệt trước hành động không thể hoàn tác
Migration lớn hoặc debug nguyên nhân gốcGPT-6 Astra hoặc Fable 5.1So sánh patch được chấp nhận và tổng chi phí
Coding thường ngày và sửa testSonnet 5 hoặc Gemini 3.8 FlashDùng Astra khi lỗi lặp lại hoặc phạm vi mơ hồ
Tài liệu, audio, video hoặc bản đồ đa phương thứcGemini 3.8 FlashClaude hoặc Astra cho phần tổng hợp khó
Extraction và classification số lượng lớnGemini 3.8 Flash low / mediumSonnet 5 cho mẫu nhạy cảm về chất lượng
Sinh code hoặc tài liệu dàiGPT-6 Astra hoặc Fable 5.1Con người kiểm tra convention và sự thật

Hãy bắt đầu bằng một replay set nhỏ, ghi lại model, reasoning setting, tool call, latency, số token và đánh giá cuối cùng của con người. Chỉ thay đổi routing khi tính kinh tế của kết quả được chấp nhận được cải thiện.

Kết luận: GPT-6 Astra có đáng dùng không?

GPT-6 Astra là một nâng cấp đáng chú ý cho agent phải làm việc qua code, browser, tài liệu và phần mềm chuyên nghiệp. Context cỡ một triệu token, output 128K, reasoning có thể cấu hình, tool bất đồng bộ và mid-turn steering khiến nó trở thành nhiều hơn một chat model lớn.

Tuy nhiên, giá của nó thuộc phân khúc premium, reasoning sâu có thể nhanh chóng tiêu quota, rollout vẫn gây nhầm lẫn và cộng đồng chưa thống nhất rằng khả năng viết tốt hơn. So với Claude Fable 5.1, Astra nổi bật ở workflow computer use native của OpenAI; Fable vẫn mạnh ở long-horizon reasoning và escalation trong Claude Code. So với Gemini 3.8 Flash, Astra có output lớn hơn và định vị agent cao cấp hơn, còn Gemini thắng về token economics và tích hợp đa phương thức của Google.

Phần lớn team không cần thay Claude hay Gemini ngay lập tức. Hãy đặt Astra ở tầng escalation có đo lường, giao tác vụ đa phương thức số lượng lớn cho Gemini, và giữ Claude ở những workflow codebase-aware planning hoặc tạo artifact dài đã được kiểm chứng.

Trong năm 2026, đơn vị cạnh tranh không phải model có biểu đồ ra mắt ấn tượng nhất, mà là con đường có chi phí thấp nhất để đạt một kết quả được chấp nhận và kiểm chứng.

Nguồn tham khảo