- GPT-5 hợp nhất tốc độ và lý luận với tính năng định tuyến tự động, mở rộng đa phương thức và cải thiện bộ nhớ và ngữ cảnh.
- Có sẵn trong ChatGPT (Miễn phí, Plus, Pro, Team, Enterprise) và API với các biến thể gpt-5, gpt-5-mini và gpt-5-nano.
- Các gói cao hơn bao gồm Thinking Pro, kiểm soát mô hình và các công cụ nâng cao; chúng tập trung vào độ tin cậy và bảo mật.
GPT-5 là bước tiến lớn tiếp theo của OpenAI, được thiết kế để hợp nhất những gì trước đây nằm rải rác trên nhiều biến thể nhanh và công cụ suy luận khác nhau thành một mô hình duy nhất. Sau nhiều tháng đồn đoán, cập nhật gián đoạn và rò rỉ thông tin, mô hình này hiện đóng vai trò là bộ não thống nhất cho ChatGPT và API, sử dụng phương pháp định tuyến để xác định khi nào cần phản hồi ngay lập tức và khi nào cần "suy nghĩ sâu sắc".
Nếu bạn đang thắc mắc GPT-5 là gì, khi nào ra mắt, có gì mới và cách truy cập , bạn đã đến đúng nơi. Chúng tôi đã thu thập và kết nối tất cả thông tin công khai: từ lịch trình và tên mã đến khả năng đa phương thức, bộ nhớ, gói giá, quyền truy cập API và tích hợp với các tác nhân và công cụ trong hệ sinh thái.
GPT-5 là gì và trạng thái phát hành của nó như thế nào?
OpenAI đã có một bước ngoặt bất ngờ với GPT-4 và từ đó, đẩy nhanh lộ trình phát triển: ChatGPT (3.5) ra mắt vào cuối năm 2022, GPT-4 vào tháng 3 năm 2023, và, trong hậu trường, nhãn hiệu “GPT-5” đã được đăng ký vào ngày 18 tháng 7 năm 2023 tại văn phòng cấp bằng sáng chế của Mỹ. Trong những tháng đó, Sam Altman khẳng định rằng “họ không huấn luyện GPT-5”, nhưng dự án đang “trong giai đoạn chuẩn bị” và đang trải qua các cuộc kiểm tra an ninh trước khi chính thức ra mắt.
Trong năm 2024, tên mã Orion xuất hiện : ban đầu người ta dự đoán nó sẽ ra mắt vào tháng 12 (và cuối cùng nó phù hợp với tên gọi GPT-4.5, mô hình chính mới nhất "không có chuỗi tư duy nội bộ"), trong khi các bản demo riêng tư và các dự án thí điểm của khách hàng bị rò rỉ. Vào cuối tháng 3, người ta biết được rằng một số công ty đã nhận được các mẫu thử nghiệm dựa trên nền tảng mới này, một dấu hiệu cho thấy OpenAI đã "tăng tốc".
Chính Altman, trong podcast của OpenAI, đã dự đoán GPT-5 sẽ được phát hành vào mùa hè năm 2025. Một số ấn phẩm chỉ ra thời điểm đầu tháng 8, và OpenAI đã xác nhận việc triển khai: vào ngày 7 tháng 8 năm 2025, GPT-5 bắt đầu được tích hợp vào ChatGPT, API và model playground. Theo công ty, đây là " mô hình mặc định " cho cả người dùng miễn phí và trả phí, thay thế các phiên bản trước đó nếu có thể.
Tuy nhiên, điều quan trọng là cách sử dụng nó: trong các gói miễn phí và Plus, bộ chọn mô hình hầu như biến mất, và hệ thống tự động quyết định xem nên ưu tiên tốc độ hay kích hoạt chế độ suy luận. Các gói Pro, Team và Enterprise vẫn giữ quyền điều khiển thủ công để chuyển đổi giữa GPT-5 , GPT-5 Thinking và GPT-5 Thinking Pro , và thậm chí duy trì quyền truy cập tạm thời vào các mô hình cũ để đảm bảo tính tương thích.
Bên cạnh mô hình chính, còn có các biến thể với mức giá và độ trễ khác nhau: gpt-5 (khả năng suy luận đầy đủ), gpt-5-mini (nhẹ hơn và nhanh hơn), và gpt-5-nano (độ trễ cực thấp), cộng thêm phiên bản “Thinking Pro” hiệu năng cao dành riêng cho người dùng cao cấp. Trong môi trường doanh nghiệp, các gói Team, Enterprise và Edu sẽ được trải nghiệm công nghệ mới trước tiên, trong khi trải nghiệm ChatGPT thống nhất sẽ được triển khai cho tất cả mọi người.
Có gì mới: Lý luận sâu sắc hơn, đa phương thức thực sự, trí nhớ và tác nhân
Điểm khác biệt chính của GPT-5 không chỉ nằm ở "nhiều tham số hơn". Sự đổi mới nằm ở hệ thống thích ứng định tuyến theo thời gian thực: nếu nhiệm vụ đơn giản, nó sẽ phản hồi nhanh chóng; nếu phát hiện sự phức tạp, nó sẽ xâu chuỗi các bước suy luận trước khi phản hồi. Cách tiếp cận này thống nhất những gì trước đây đòi hỏi phải chuyển đổi thủ công giữa các mô hình hoặc chế độ.
Trong môi trường đa phương thức, GPT-5 hoạt động với văn bản, hình ảnh, giọng nói và video trong một luồng duy nhất, với khả năng chuyển đổi liền mạch giữa các kênh. Phản hồi bằng giọng nói nghe tự nhiên hơn và thích ứng với giọng điệu, và các bản dịch mở rộng duy trì ngữ cảnh tốt hơn. Altman đã tóm tắt như sau: “Nó sẽ thông minh hơn, hỗ trợ tương tác đa phương thức và phản hồi nhanh hơn.”
Một cải tiến quan trọng khác là bộ nhớ . Altman tuyên bố rằng GPT-5 sẽ "ghi nhớ tốt hơn những thông tin quan trọng về mỗi người" nếu người dùng cho phép. Hiện tại, bộ nhớ của ChatGPT được xóa mặc định sau mỗi 30 ngày, nhưng công việc đang được tiến hành để thiết lập các chính sách chi tiết hơn nhằm lựa chọn những gì được lưu và khi nào bị xóa, từ đó tăng cường quyền riêng tư và khả năng kiểm soát dữ liệu chi tiết hơn.
Về mặt lập luận, GPT-5 tích hợp những tiến bộ từ dòng o1/o3 vào chính mô hình: “Thinking” và “Thinking Pro” áp dụng nhiều phép tính hơn để so sánh các đường dẫn giải pháp, xác minh các bước trung gian và giảm thiểu lỗi. OpenAI đề cập đến “tư duy có cấu trúc”, khả năng xử lý tốt hơn các trường hợp mơ hồ và yêu cầu làm rõ khi thiếu thông tin chi tiết.
Trên thực tế, tất cả những điều này thúc đẩy quá trình chuyển đổi từ chatbot sang agent . GPT-5 kết nối với các công cụ bên ngoài (CRM, cơ sở dữ liệu, bộ ứng dụng năng suất) thông qua các trình kết nối gốc, thực hiện các hành động và điều phối các tác vụ một cách dễ dàng hơn. Microsoft đã công bố tích hợp với Gmail và Lịch cho người dùng Pro, Plus và Enterprise, giúp tăng cường bộ nhớ với thông tin người dùng hiện tại, và Microsoft đang chuẩn bị Copilot với chế độ thông minh tự động điều chỉnh mức độ phân tích.
Cửa sổ ngữ cảnh cũng tăng lên đáng kể. Các nguồn công khai đưa ra con số khác nhau tùy thuộc vào môi trường: lên đến 256.000 token trong ChatGPT , lên đến 400.000 token cho mỗi API , và thậm chí "hơn một triệu" trong một số trường hợp sử dụng doanh nghiệp nhất định. Trên lý thuyết, mô hình sử dụng ít token hơn để tạo ra đầu ra có độ dài tương đương và duy trì tính nhất quán cao hơn trong các phiên dài.
Về mặt kỹ thuật, OpenAI đã xác nhận các kỹ thuật SFT (tinh chỉnh có giám sát) và RLHF (học tăng cường phản hồi của con người), cùng với phương pháp giám sát định hướng suy luận mới. Cơ sở hạ tầng hoạt động trên siêu máy tính Microsoft Azure và GPU NVIDIA: H200 sẽ ra mắt vào năm 2024, và B100/B200 dự kiến sẽ được triển khai trong suốt năm 2025, trong khi quá trình huấn luyện đang được tối ưu hóa trên phần cứng hiện có.
Vẫn còn nhiều mảnh ghép nữa của bức tranh. Reuters và Bloomberg đã đưa tin về tên mã Strawberry , được cho là đã chứng minh khả năng duyệt web và lập kế hoạch tự động, đồng thời đạt điểm số trên 90% trong các bài kiểm tra hiệu năng như MATH. Trong khi đó, có nhiều đồn đoán về việc tích hợp Sora vào xử lý video, và OpenAI khẳng định rằng độ tin cậy là nguyên tắc cốt lõi: giảm thiểu ảo tưởng, thừa nhận khi không thể hoàn thành yêu cầu và từ chối khi đối mặt với rủi ro.
Về vấn đề định vị thương hiệu nội bộ, Tadao Nagasiki thậm chí còn tuyên bố rằng " Orion sẽ mạnh hơn GPT-4 tới 100 lần" nhờ kiến trúc và hiệu quả của nó, mặc dù tên thương mại được sử dụng như các phiên bản trung gian (GPT-4.5) trên con đường hướng tới GPT-5. Và đúng vậy, Altman đã nói rằng "GPT-4 chỉ có những hạn chế rất nhỏ" và giờ đây chúng ta sẽ chứng kiến một bước nhảy vọt về chất lượng trong lĩnh vực đó.

Quyền truy cập, giá cả, API và cách đưa nó vào sản phẩm
OpenAI duy trì mô hình freemium (miễn phí có trả phí cho các tính năng nâng cao). Trong ChatGPT, mô hình mặc định là GPT-5 cho tất cả người dùng, nhưng có một số hạn chế: gói miễn phí bắt đầu với GPT-5 tiêu chuẩn, cho phép gửi 10 tin nhắn mỗi 5 giờ , và khi vượt quá ngưỡng đó, phiên sẽ chuyển sang GPT-5-mini . Hơn nữa, chế độ tư duy sâu ( GPT-5 Thinking ) chỉ giới hạn ở một tin nhắn mỗi ngày.
ChatGPT Plus mở rộng giới hạn, duy trì các phiên trong mô hình đầy đủ lâu hơn và mở khóa các công cụ nâng cao; bạn có thể buộc chế độ suy luận trong hạn mức hàng tuần. Gói Pro còn tiến xa hơn nữa: truy cập gần như không giới hạn, ưu tiên tài nguyên, cửa sổ ngữ cảnh mở rộng và trên hết là phiên bản GPT-5 Thinking Pro , áp dụng nhiều sức mạnh tính toán hơn để "suy nghĩ" và giảm lỗi.
Ở cấp độ doanh nghiệp, các gói Team , Enterprise và Edu đang nhận được GPT-5 với triển khai theo từng giai đoạn, kiểm soát mô hình và các tùy chọn tích hợp và bộ nhớ nâng cao hơn. OpenAI cũng đã xác nhận rằng tính năng trò chuyện tiêu chuẩn sẽ cung cấp " quyền truy cập không giới hạn " trong phạm vi các quy định chống lạm dụng hợp lý khi được mở hoàn toàn cho công chúng, và người đăng ký gói Plus sẽ có thể tăng "mức độ thông minh" khi cần thiết.
Nếu bạn muốn tích hợp GPT-5 vào sản phẩm của mình, bạn cần API . Có hai cách chính: nền tảng OpenAI (platform.openai.com) để lựa chọn giữa gpt-5 , gpt-5-mini , gpt-5-nano hoặc hồ sơ "chat", và SDK Python chính thức (thông qua GitHub) cho các tập lệnh và dịch vụ. GitHub Models Playground cũng có sẵn để thử nghiệm nhanh mà không cần xây dựng một ứng dụng hoàn chỉnh.
Trong việc điều phối tác nhân, các công cụ xây dựng trực quan như Botpress cho phép bạn tạo ra các trợ lý GPT-5 mượt mà: bạn xác định vai trò (ví dụ: cố vấn tài chính), đưa ra hướng dẫn rõ ràng, cung cấp tài liệu cần thiết (giá cả, bảng dữ liệu, quy trình), chọn biến thể mô hình dựa trên chi phí/độ trễ/chất lượng và triển khai nó trên WhatsApp, Slack hoặc web . Điều quan trọng là phải xác định rõ vai trò của tác nhân: hướng dẫn và tài nguyên càng cụ thể, kết quả càng tốt.
Về khả năng làm việc, GPT-5 vượt trội trong lập trình (tạo ra các ứng dụng hoàn chỉnh từ một vài lệnh; một trang web hoạt động với khoảng 250 dòng mã đã được hiển thị trong một phút), khả năng viết văn bản cá nhân và cẩn thận hơn, dịch thuật hội thoại tự nhiên và thực hiện các tác vụ (gửi email, lên lịch hẹn, cập nhật lịch) nhờ các trình kết nối và quyền người dùng.
Về quảng cáo , OpenAI cho biết hiện tại họ chưa tích hợp quảng cáo vào trải nghiệm người dùng (họ không loại trừ khả năng này trong tương lai, nhưng sẽ không trực tiếp như trên các công cụ tìm kiếm hoặc mạng xã hội). Về bảo mật , họ áp dụng RLHF, kiểm thử đối kháng, tinh chỉnh và "thẻ hệ thống" để minh bạch về các hạn chế, ngoài ra còn có giám sát thời gian thực các hành vi lạm dụng.
So với GPT-4 (Turbo), GPT-5 hứa hẹn độ chính xác và độ tin cậy cao hơn, khả năng hiểu đa phương thức được cải thiện, giao tiếp bằng giọng nói đầu vào/đầu ra , tích hợp video và cửa sổ ngữ cảnh giúp mở rộng đáng kể khả năng của nó. Một số nguồn thậm chí còn tuyên bố nó sẽ "thông minh hơn con người" trong một số lĩnh vực nhất định, mặc dù OpenAI không trình bày nó như một giải pháp IAG (Intelligent Agile Generation) khép kín: Altman mô tả nó là " một bước tiến đáng kể ", nhưng vẫn thiếu khả năng học hỏi liên tục sau khi triển khai.
Cộng đồng đã phản ứng với nhiều cảm xúc trái chiều. Có người hào hứng với lý luận sâu sắc hơn, nhưng cũng có người phàn nàn về việc mất kiểm soát khi hệ thống tự quyết định chế độ phản hồi. Một người dùng thậm chí còn diễn đạt lại rằng "phiên bản 4 giống như một người bạn " và cảm thấy việc loại bỏ nó là một mất mát, trong khi các nhà phát triển lại tiếc nuối sự biến mất của "lựa chọn mô hình đơn giản". OpenAI đã và đang điều chỉnh các giới hạn, khả năng tương thích và bộ chọn trong các kế hoạch nâng cao khi lắng nghe phản hồi.
Về chi phí API, OpenAI định giá theo triệu token đầu vào/đầu ra cho các phiên bản gpt-5, gpt-5-mini và gpt-5-nano, cho phép bạn cân bằng giữa độ sâu suy luận, độ trễ và hiệu quả chi phí. Đối với doanh nghiệp, lợi ích thu được đến từ hiệu quả, giảm thiểu lỗi và giảm bớt công việc thủ công trong hỗ trợ, tài liệu và phân tích.
Xét về cơ sở hạ tầng, OpenAI đang thúc đẩy các sáng kiến như Dự án Stargate để mở rộng sức mạnh tính toán và làm cho AI "phổ biến và rẻ nhất có thể", phù hợp với tầm nhìn của Altman. Với 700 triệu người dùng hàng tuần trên ChatGPT và hàng triệu người đăng ký trả phí, quy mô sử dụng đòi hỏi một hệ thống phụ trợ tương xứng.

Cuối cùng, một lưu ý về kỳ vọng. Theo lời của Altman, " chúng ta sẽ có một đường cong cải tiến mạnh mẽ trong 5 đến 10 năm tới; đây là thời điểm 'thô sơ' nhất mà các mô hình này từng đạt được." Nói cách khác, GPT-5 không phải là đích đến: nó là sự khởi đầu của một giai đoạn mà AI chuyển từ một công cụ phụ trợ dễ thương trở thành xương sống của các sản phẩm, quy trình làm việc và quyết định.
Tóm lại, GPT-5 tập trung khả năng suy luận và đa phương thức vào một hệ thống thích ứng duy nhất, tăng cường bộ nhớ và ngữ cảnh, đưa việc thực thi nhiệm vụ tự động đến gần hơn và mở ra cánh cửa cho các tác nhân ngày càng hữu ích; nếu kết hợp với việc triển khai có trách nhiệm (quyền riêng tư, bảo mật và kiểm soát rõ ràng), bước nhảy vọt về chất lượng không còn chỉ là lý thuyết mà có thể nhận thấy rõ trong sử dụng hàng ngày.
