OLIX vừa hoàn tất vòng gọi vốn Series B trị giá 312 triệu USD, đẩy mức định giá của công ty lên 3,3 tỷ USD. Số tiền này sẽ được dùng để tài trợ cho những lô hàng đầu tiên của chip suy luận (inference chip) của hãng, loại bỏ Bộ nhớ băng thông cao (HBM) và có thể thay đổi hoàn toàn bài toán kinh tế của phần cứng AI.

Tại sao con chip này lại quan trọng

Các chip suy luận vận hành các mô hình đứng sau chatbot, công cụ gợi ý và phân tích video. Hầu hết các con chip hiện nay đều phụ thuộc vào HBM—một cấu trúc bộ nhớ nhanh nhưng đắt đỏ và tiêu tốn nhiều năng lượng, được đặt ngay cạnh bộ vi xử lý. Thiết kế của OLIX loại bỏ HBM, thay vào đó điều hướng dữ liệu thông qua các tài nguyên trên chip và các loại bộ nhớ rẻ hơn. Nếu kiến trúc này đáp ứng được các tuyên bố của hãng, các nhà cung cấp dịch vụ AI có thể cắt giảm cả chi phí đầu tư vốn lẫn hóa đơn tiền điện trong khi vẫn giữ nguyên thông lượng ổn định.

Bối cảnh huy động vốn

  • Nhà đầu tư dẫn dắt: Fundomo (New York)
  • Các nhà đầu tư khác: Arm, Hudson River Trading, quỹ đầu tư mạo hiểm AI của chính phủ Anh
  • Người tham gia đáng chú ý: Reed Hastings, đồng sáng lập Netflix
  • Thành viên mới của Hội đồng quản trị: Giáo sư Stanford Nick McKeown

Vòng gọi vốn này nằm trong số những đợt huy động vốn bán dẫn lớn nhất tại Châu Âu và diễn ra sau khi OLIX ra mắt tại London vào năm 2024. Công ty đặt mục tiêu giao những đơn vị sản phẩm đầu tiên cho khách hàng vào nửa cuối năm 2027.

Các bên liên quan trong thị trường phần cứng AI

  • Những bên có khả năng hưởng lợi: Các nhà cung cấp dịch vụ đám mây và các đơn vị vận hành thiết bị biên (edge) có thể thay thế các bộ tăng tốc tích hợp HBM bằng một giải pháp thay thế rẻ hơn và tiêu thụ ít điện năng hơn.
  • Rủi ro: HBM vẫn đang thống trị các khối lượng công việc có thông lượng cao nhất. Việc bỏ qua HBM có thể làm giới hạn hiệu suất, buộc OLIX phải tập trung vào một nhóm các trường hợp sử dụng hẹp hơn.
  • Hệ quả về chi phí: Việc loại bỏ HBM có thể cắt giảm đáng kể chi phí vật tư (BOM) và nhu cầu làm mát, từ đó giảm tổng chi phí sở hữu (TCO) cho các khối lượng công việc AI.

Những điều vẫn chưa rõ ràng

Chưa có dữ liệu điểm chuẩn (benchmark) nào được công bố, vì vậy các con số về tốc độ trên mỗi watt và độ trễ trong thế giới thực vẫn chỉ dừng lại ở mức suy đoán. Các đối thủ cạnh tranh có thể tung ra các kiến trúc ít phụ thuộc bộ nhớ của riêng họ, và những hạn chế về chuỗi cung ứng có thể làm trì hoãn việc sản xuất hàng loạt.

Những điều cần theo dõi

  • Xác thực hiệu suất: Các thử nghiệm độc lập về tốc độ suy luận và mức tiêu thụ điện năng của con chip.
  • Sự đón nhận của khách hàng: Những nhà cung cấp dịch vụ AI nào sẽ đăng ký trước thời điểm bàn giao vào năm 2027.
  • Sự hỗ trợ của hệ sinh thái: Khả năng tương thích của các bộ công cụ và ngăn xếp phần mềm (software stacks) với các khung làm việc (frameworks) AI hiện có.

Nếu OLIX chứng minh được rằng một con chip không cần HBM vẫn có thể đáp ứng các yêu cầu về hiệu suất mô hình hiện đại, nó có thể buộc ngành công nghiệp phải tư duy lại về thiết kế bộ tăng tốc AI và tái định hình cấu trúc chi phí trên toàn ngành. Những dữ liệu trong vài tháng tới sẽ cho thấy liệu lời hứa này có xứng đáng với mức định giá khổng lồ đang hậu thuẫn cho nó hay không.