OpenAI đã tự thiết kế chip AI đầu tiên mang tên Jalapeño, nhưng không trực tiếp sản xuất. Con chip này được phát triển để phục vụ hạ tầng AI của OpenAI, giúp công ty giảm chi phí và bớt phụ thuộc vào GPU Nvidia.
Ông Hock Tan, Chủ tịch kiêm CEO Broadcom (bên phải), trao chip Jalapeño cho CEO OpenAI Sam Altman - Ảnh: OpenAI
Những ngày gần đây, thông tin OpenAI ra mắt chip AI mang tên Jalapeño thu hút sự chú ý trên mạng xã hội. Một số bài đăng cho rằng OpenAI đã chuyển sang làm chip như Intel hay AMD, thậm chí trở thành đối thủ trực tiếp của Nvidia.
Thực tế, nhận định này chỉ đúng một phần. OpenAI đã tự thiết kế chip AI đầu tiên của mình, nhưng việc sản xuất và tích hợp do các đối tác đảm nhiệm. Đây là bước đi nhằm chủ động hơn về hạ tầng tính toán phục vụ các mô hình AI, thay vì chuyển sang kinh doanh bán dẫn theo mô hình truyền thống.
Tự thiết kế chip để phục vụ AI
Ngày 24-6-2026, OpenAI cùng Broadcom công bố Jalapeño, bộ xử lý AI đầu tiên do OpenAI thiết kế riêng cho các mô hình ngôn ngữ lớn (LLM).
OpenAI tập trung vào thiết kế kiến trúc và tối ưu chip cho các mô hình AI của mình, thay vì tự xây dựng nhà máy sản xuất. Broadcom tham gia phát triển phần cứng, TSMC đảm nhiệm sản xuất trên tiến trình tiên tiến, còn Celestica tham gia tích hợp hệ thống máy chủ.
Cách làm này tương tự Google với TPU hay Amazon với Trainium và Inferentia: tự thiết kế chip chuyên dụng để phục vụ hệ sinh thái AI của mình.
Một điểm dễ gây nhầm lẫn là Jalapeño không phải GPU mới. Đây là ASIC - loại chip được thiết kế cho một nhiệm vụ chuyên biệt, trong trường hợp này là AI inference, tức quá trình mô hình AI tạo câu trả lời sau khi đã được huấn luyện.
Mỗi khi người dùng đặt câu hỏi cho ChatGPT, hệ thống phải thực hiện quá trình inference để tạo câu trả lời. Với lượng truy vấn rất lớn mỗi ngày, đây là công đoạn tiêu tốn nhiều tài nguyên tính toán và điện năng.
Jalapeño được thiết kế để xử lý phần việc này hiệu quả hơn.
Theo các thử nghiệm nội bộ được OpenAI công bố, Jalapeño hướng tới hai mục tiêu là độ trễ thấp và thông lượng cao.
Trong các phép đo được công bố, con chip đạt hiệu suất trên mỗi watt điện cao hơn khoảng 1,5-1,9 lần so với các chip hiện nay, và giảm đáng kể độ trễ khi chạy những mô hình như GPT-OSS 120B, DeepSeek R1 và Kimi K2.5.
Với các dịch vụ AI phải xử lý lượng truy vấn khổng lồ, hiệu suất trên mỗi watt có ý nghĩa lớn. Nếu xử lý được nhiều tác vụ hơn với cùng lượng điện năng, chi phí vận hành trung tâm dữ liệu có thể giảm.
Đây cũng là lý do OpenAI muốn tự thiết kế phần cứng. ChatGPT ngày càng mở rộng khiến nhu cầu tính toán tăng mạnh, trong khi GPU hiệu năng cao có giá đắt và nguồn cung từng nhiều lần trở thành vấn đề đối với các công ty AI.
Chip riêng cho phép OpenAI tối ưu phần cứng theo những tác vụ cụ thể, đồng thời giảm sự phụ thuộc vào một nguồn cung duy nhất.
Tuy nhiên, Jalapeño không có nghĩa OpenAI sẽ thay thế hoàn toàn GPU Nvidia.
Việc huấn luyện các mô hình AI lớn vẫn đòi hỏi năng lực tính toán rất cao và GPU vẫn giữ vai trò quan trọng. OpenAI cũng tiếp tục sử dụng nhiều nguồn phần cứng khác nhau.
Do đó, Jalapeño hiện phù hợp hơn với vai trò một phần trong chiến lược xây dựng hạ tầng AI riêng của OpenAI, thay vì được xem là sản phẩm cạnh tranh trực tiếp với các GPU của Nvidia trên thị trường.
Chưa bán ra thị trường
Jalapeño hiện không phải sản phẩm thương mại để OpenAI bán cho người dùng hoặc các doanh nghiệp khác.
Theo OpenAI, chip này trước mắt phục vụ hạ tầng nội bộ. Việc triển khai dự kiến bắt đầu từ cuối năm 2026, sau đó mở rộng trong năm 2027 để phục vụ ChatGPT và các dịch vụ AI khác của công ty.
Như vậy, nói OpenAI "làm chip" là đúng nếu hiểu theo nghĩa tự thiết kế chip. Nhưng nói OpenAI đã trở thành hãng sản xuất chip như Intel, AMD hay đối thủ trực tiếp của Nvidia thì chưa chính xác.
Jalapeño cho thấy OpenAI đang muốn kiểm soát nhiều hơn phần hạ tầng phía sau các dịch vụ AI của mình, từ đó tối ưu chi phí và năng lực phục vụ khi nhu cầu tính toán tiếp tục tăng.
Thị trường công nghệ Việt Nam vừa ghi nhận dấu mốc mới, khi EON Tech chính thức trở thành doanh nghiệp thứ hai trong nước đạt chuẩn đối tác toàn cầu của OpenAI.
Thông tin OpenAI ra mắt chip trí tuệ nhân tạo Jalapeño đang gây chú ý trên mạng xã hội, kéo theo nhiều nhận định rằng công ty đã bước vào cuộc đua bán dẫn. Một số bài đăng thậm chí xem OpenAI như doanh nghiệp sản xuất chip tương tự Intel, AMD hoặc đối thủ trực tiếp của Nvidia trên thị trường. Tuy nhiên, theo thông tin Tuổi Trẻ dẫn lại, cách hiểu chính xác hơn là OpenAI tự thiết kế chip, còn khâu sản xuất và tích hợp do những đối tác chuyên môn đảm nhiệm.
Ngày 24-6-2026, OpenAI cùng Broadcom công bố Jalapeño, bộ xử lý trí tuệ nhân tạo đầu tiên được OpenAI thiết kế riêng cho các mô hình ngôn ngữ lớn. OpenAI chịu trách nhiệm xây dựng kiến trúc, đồng thời tối ưu chip theo nhu cầu vận hành các mô hình AI của mình, thay vì đầu tư nhà máy sản xuất bán dẫn. Broadcom tham gia phát triển phần cứng, TSMC đảm nhiệm sản xuất trên tiến trình tiên tiến, còn Celestica hỗ trợ tích hợp chip vào hệ thống máy chủ.
Cách tiếp cận này không hoàn toàn mới trong ngành công nghệ, bởi Google từng phát triển TPU, trong khi Amazon có các dòng Trainium và Inferentia phục vụ hệ sinh thái AI. Điểm chung của những doanh nghiệp này là tự thiết kế phần cứng chuyên dụng, nhằm kiểm soát tốt hơn hiệu năng, chi phí và cách vận hành dịch vụ. Vì vậy, Jalapeño phản ánh tham vọng chủ động về hạ tầng tính toán của OpenAI nhiều hơn là dấu hiệu công ty chuyển sang kinh doanh chip truyền thống.
Một nhầm lẫn đáng chú ý nằm ở việc Jalapeño không phải một mẫu GPU mới, mà là ASIC, loại chip được thiết kế cho một nhiệm vụ chuyên biệt. Trong trường hợp này, nhiệm vụ trọng tâm là AI inference, quá trình mô hình đã huấn luyện tạo câu trả lời sau khi tiếp nhận yêu cầu từ người dùng. Mỗi câu hỏi gửi đến ChatGPT đều cần năng lực tính toán để xử lý inference, khiến công đoạn này trở thành phần tiêu tốn đáng kể tài nguyên và điện năng khi lượng truy vấn tăng cao.
OpenAI cho biết Jalapeño hướng tới hai mục tiêu chính là độ trễ thấp và thông lượng cao, tức phản hồi nhanh hơn đồng thời xử lý được nhiều tác vụ hơn. Trong các thử nghiệm nội bộ được công bố, chip đạt hiệu suất trên mỗi watt điện cao hơn khoảng 1,5 đến 1,9 lần so với một số chip hiện nay. Jalapeño cũng được cho là giúp giảm đáng kể độ trễ khi chạy những mô hình như GPT-OSS 120B, DeepSeek R1 và Kimi K2.5.
Hiệu suất trên mỗi watt đặc biệt quan trọng với các dịch vụ AI phải xử lý khối lượng yêu cầu khổng lồ mỗi ngày, bởi điện năng là một phần lớn trong chi phí vận hành trung tâm dữ liệu. Nếu cùng một lượng điện có thể phục vụ nhiều tác vụ hơn, OpenAI sẽ có thêm dư địa giảm chi phí khi ChatGPT tiếp tục mở rộng. Chip riêng cũng cho phép công ty điều chỉnh phần cứng theo những tác vụ cụ thể, thay vì phụ thuộc hoàn toàn vào thiết kế chung trên thị trường.
Nhu cầu tính toán của OpenAI tăng mạnh, trong khi GPU hiệu năng cao có giá đắt và nguồn cung từng nhiều lần trở thành vấn đề với các công ty phát triển AI. Dù vậy, Jalapeño chưa thể thay thế hoàn toàn GPU Nvidia, bởi quá trình huấn luyện những mô hình AI lớn vẫn cần năng lực tính toán rất cao và GPU vẫn giữ vai trò quan trọng. OpenAI cũng tiếp tục sử dụng nhiều nguồn phần cứng khác nhau, nên Jalapeño hiện phù hợp hơn với vai trò một mảnh ghép trong chiến lược hạ tầng riêng.
Hiện Jalapeño chưa phải sản phẩm thương mại để OpenAI bán cho người dùng hoặc các doanh nghiệp khác, mà trước mắt chỉ phục vụ hệ thống nội bộ của công ty. Theo kế hoạch được nêu, việc triển khai dự kiến bắt đầu từ cuối năm 2026, sau đó mở rộng trong năm 2027 để phục vụ ChatGPT cùng những dịch vụ AI khác. Nói OpenAI làm chip là đúng nếu hiểu công ty tự thiết kế, nhưng gọi đây là hãng sản xuất chip như Intel, AMD hoặc đối thủ trực tiếp của Nvidia thì chưa chính xác; thông tin về EON Tech trong phần cuối bài gốc hiện chưa đầy đủ để kết luận thêm.