ai industryDoc trong 18 phut

NVIDIA không bỏ 12,93 tỷ USD để mua một kho mô hình. Họ mua giá trị mặc định

Ngày 3 tháng 9 năm 2026, NVIDIA đồng ý mua lại Hugging Face với giá 12.930.300.000 USD, thương vụ lớn thứ hai trong lịch sử công ty, chỉ sau 20 tỷ USD chi cho tài sản của Groq. Hugging Face khởi đầu năm 2016 như một ứng dụng chatbot cho thiếu niên và kết thúc bằng việc lưu trữ 3 triệu mô hình cho 18 triệu lập trình viên. Bài này đọc kỹ chặng đường đó, lý do hai canh bạc nền tảng trước đây của NVIDIA kết thúc trái ngược nhau, và nơi lời hứa trung lập thực sự được định đoạt: không phải trong một bài blog, mà trong các kernel, các định dạng lượng tử hóa và đích triển khai mặc định.

K
Ken Jo
#nvidia#hugging-face#open-source-ai#open-weights#acquisition#ai-infrastructure#transformers#antitrust

NVIDIA mua lại Hugging Face với giá 12.930.300.000 USD, công bố ngày 3 tháng 9 năm 2026, dự kiến hoàn tất trong nửa đầu năm 2027

Biểu trưng thương hiệu lấy từ Simple Icons (CC0). Các con số lấy từ thông báo ngày 3 tháng 9 năm 2026 của NVIDIA.

Ngày 3 tháng 9 năm 2026, Jensen Huang đăng một bài blog ngắn thông báo NVIDIA đã đồng ý mua lại Hugging Face với giá 12.930.300.000 USD. Không phải "khoảng 13 tỷ USD" mà là con số chính xác, tới hàng trăm đô la cuối cùng.

Phần lớn bài viết sau đó đều hỏi liệu "GitHub của giới AI" có giữ được sự trung lập dưới trướng một công ty chip hay không. Đó là câu hỏi đúng. Chỉ có điều nó gần như luôn được đặt ở sai chỗ.

Tính trung lập của Hugging Face sẽ không được định đoạt bằng một lời hứa trong bài blog. Nó được định đoạt bởi kernel nào nằm trên đường đi nhanh, định dạng lượng tử hóa nào được hỗ trợ hạng nhất, và nút Deploy làm gì theo mặc định. Đó đều là quyết định kỹ thuật, chúng diễn ra hằng tuần, và không quyết định nào được công bố.

Tóm tắt:

  • Chính cái giá mới là câu chuyện. 12,93 tỷ USD cho một công ty huy động tổng cộng 395 triệu USD trong cả đời và ba năm trước được định giá 4,5 tỷ USD. Đây là thương vụ lớn thứ hai của NVIDIA, sau 20 tỷ USD cho tài sản của Groq hồi cuối năm 2025.
  • NVIDIA từng mua nền tảng trung lập hai lần, và kết cục trái ngược nhau. Mellanox chốt được và vận hành tốt. Arm sụp đổ trước các cơ quan quản lý, những người gọi nó là "Thụy Sĩ của phần cứng". Hugging Face gần Arm hơn là gần Mellanox.
  • Rủi ro kỹ thuật không phải là khu vườn có tường rào. Không ai đi chặn AMD cả. Rủi ro nằm ở các giá trị mặc định, và giá trị mặc định chính là cách một hệ sinh thái nghiêng đi mà không ai từng quyết định làm nó nghiêng.

Từ chatbot cho thiếu niên tới lớp mà mọi thứ đều import

Hugging Face được ba kỹ sư người Pháp là Clément Delangue, Julien Chaumond và Thomas Wolf thành lập năm 2016 tại New York, để làm một ứng dụng chatbot cho thiếu niên. Không phải sản phẩm đó khiến người ta biết đến cái tên này.

Khoảnh khắc khai sinh thực sự của công ty đến hai năm sau, và nó gói gọn trong một cuối tuần. Khi Google phát hành BERT vào cuối năm 2018, đội Hugging Face giao bản chuyển sang PyTorch trong vòng một tuần. Thư viện họ mở mã nguồn để phục vụ chính con chatbot của mình, ban đầu là pytorch-pretrained-bert, rồi pytorch-transformers, rồi chỉ còn là transformers, trở thành hiện tượng trong giới lập trình viên học thuật, những người chẳng mảy may quan tâm tới một chatbot cho thiếu niên.

Đến năm 2019, công ty làm điều mà phần lớn startup không nỡ làm: khai tử sản phẩm và giữ lại công cụ.

Những gì diễn ra sau đó là ví dụ sách giáo khoa về một cỗ máy phân phối khoác áo dự án nguồn mở. transformers chuẩn hóa cách nạp một mô hình. Hub chuẩn hóa nơi các trọng số cư trú. safetensors chuẩn hóa định dạng tệp, sau nhiều năm cả ngành phát hành mạng nơ-ron dưới dạng đối tượng Python được pickle, thứ có thể chạy mã tùy ý ngay khi nạp. Mỗi thứ trong đó trông như hạ tầng cộng đồng. Và mỗi thứ đồng thời cũng là một vị thế.

Định giá đi theo vị thế, không đi theo doanh thu. Hugging Face chạm mốc 2 tỷ USD vào tháng 5 năm 2022, rồi huy động vòng series D 235 triệu USD vào tháng 8 năm 2023 ở mức định giá sau đầu tư 4,5 tỷ USD, do Salesforce Ventures dẫn dắt. Danh sách nhà đầu tư của vòng đó đáng đọc hai lần: Google, Amazon, NVIDIA, Intel, AMD, Qualcomm, IBM và Salesforce. Toàn đối thủ trực tiếp, và tất cả cùng mua cổ phần trong đúng một vùng đất trung lập.

Tổng vốn huy động trong cả vòng đời công ty là khoảng 395 triệu USD, với quy mô nhân sự chừng 300 người. Thương vụ này còn là gì đi nữa, nó vẫn là một trong những kết cục hiệu quả vốn bậc nhất trong lịch sử hạ tầng AI.

Hugging Face từ năm 2016 đến thương vụ 2026: ứng dụng chatbot, bản chuyển BERT, Hub, vòng series D ở mức 4,5 tỷ USD và thương vụ 12,93 tỷ USD

Mười năm từ một chatbot cho thiếu niên đến thương vụ mua lại 12,93 tỷ USD. Mức định giá lấy từ các thông báo gọi vốn của công ty; con số thương vụ lấy từ thông báo ngày 3 tháng 9 năm 2026 của NVIDIA.

12,93 tỷ USD thực sự mua được gì

Chính thông báo của NVIDIA đưa ra quy mô mà họ trả tiền: hơn 18 triệu lập trình viên, nhà nghiên cứu và người sáng tạo; hơn 3 triệu mô hình; 500.000 bộ dữ liệu; 1 triệu ứng dụng; và hơn 200.000 công ty dùng nền tảng này để khám phá, đánh giá, tùy biến và triển khai AI.

Hãy để ý thứ thiếu vắng trong danh sách đó. Không có con số doanh thu. Không ARR, không tốc độ tăng trưởng, không biên lợi nhuận. Với một giao dịch 12,93 tỷ USD do một công ty đại chúng công bố, sự vắng mặt ấy rất dễ thấy, và nó cho biết thứ đã được mua là gì. NVIDIA không mua một doanh nghiệp SaaS có hệ số định giá đẹp. Họ mua một vị thế trong chuỗi cung ứng.

Cơ chế nằm ở đây, và nó chỉ là một dòng mã:

from transformers import AutoModel
model = AutoModel.from_pretrained("org/model-name")

Lời gọi đó chính là nơi chuỗi cung ứng AI thu hẹp lại thành một điểm duy nhất. Nó phân giải một cái tên thành một kho mã, tải trọng số về, chọn định dạng, chọn backend, rồi trao cho bạn một đối tượng. Mỗi bước trong đó đều có một giá trị mặc định. Phần lớn lập trình viên không bao giờ đổi bước nào, bởi toàn bộ giá trị của thư viện này nằm ở chỗ bạn không cần phải đổi.

NVIDIA không mua một kho mô hình. Họ mua giá trị mặc định. Với một công ty mà hào phòng thủ xưa nay là việc mọi thứ vốn đã nhắm tới CUDA, mua chính cái lớp quyết định "mọi thứ vốn đã nhắm tới cái gì" không phải là đa dạng hóa. Đó vẫn là nước cờ cũ, chỉ dịch lên một tầng trong ngăn xếp.

Cách kể của chính Delangue củng cố lối đọc này. Ngày 3 tháng 9, ông nói với CNBC rằng ông đã chủ động liên hệ Huang trong mùa hè, "và vài tuần sau thì chúng tôi ở đây", vì Hugging Face và AI nguồn mở đang ở "một bước ngoặt" và cần "nhiều nguồn lực hơn, quy mô lớn hơn, độ hiện diện cao hơn". Đó là một công ty phân phối kết luận rằng mình không thể tự tài trợ cho việc phân phối ở quy mô mà thời điểm này đòi hỏi.

NVIDIA đã hai lần mua nền tảng trung lập. Kết quả trái ngược nhau

Ở đây lịch sử hữu ích hơn suy đoán, bởi NVIDIA đã chạy đúng thí nghiệm này rồi, hai lần, với cả hai kết cục có thể xảy ra.

Thương vụCông bốGiáĐó là gìKết cục
MellanoxTháng 3/20196,9 tỷ USDNhà cung cấp interconnect, bổ trợ cho mảng kinh doanh của NVIDIAHoàn tất tháng 4/2020; trở thành mảng mạng của NVIDIA
ArmTháng 9/202040 tỷ USDSở hữu trí tuệ CPU trung lập, cấp phép cho mọi đối thủ của NVIDIABỏ dở tháng 2/2022 vì bị cơ quan quản lý phản đối
Run:ai2024~700 triệu USDPhần mềm điều phối GPUHoàn tất sau khi EU chấp thuận; sau đó mở mã nguồn
Groq (tài sản)Cuối 202520 tỷ USDChip cho suy luậnThương vụ lớn nhất của NVIDIA tới nay
Hugging FaceTháng 9/202612,93 tỷ USDKênh phân phối mô hình trung lập mà mọi đối thủ đều dùngĐang chờ; phải nộp hồ sơ HSR

Jensen Huang trên sân khấu Computex Taipei năm 2010, mặc áo polo trắng trước phông nền xanh lá

Vẫn vị CEO ấy, mười sáu năm trước: Huang tại Computex Taipei ngày 31 tháng 5 năm 2010, khi NVIDIA còn là một công ty card đồ họa dự hội chợ PC và Hugging Face chưa tồn tại. Ảnh của Masaru Kamikura, CC BY 2.0 qua Wikimedia Commons.

Thương vụ Mellanox thành công vì Mellanox bán thứ mà khách hàng của NVIDIA cũng muốn, và vì các đối thủ của NVIDIA không phụ thuộc vào việc nó tồn tại một cách trung lập.

Arm thất bại vì lý do ngược lại. Toàn bộ giá trị của Arm nằm ở chỗ ai cũng có thể cấp phép trên điều kiện ngang nhau: cơ quan quản lý và đối thủ mô tả nó là "Thụy Sĩ của phần cứng", và lập luận giết chết thương vụ không phải là NVIDIA chắc chắn sẽ lạm dụng quyền sở hữu. Lập luận đó là khách hàng sẽ phải giao lộ trình của mình cho một đối thủ, và bản thân việc tồn tại lựa chọn lạm dụng đã là thiệt hại.

Về cấu trúc, Hugging Face gần Arm hơn nhiều. Nó là Thụy Sĩ của phần mềm AI, và tính trung lập của nó là kết cấu chịu lực cho AMD, Intel, Qualcomm và mọi đám mây cạnh tranh với NVIDIA, mà vài cái tên trong số đó, xin nhắc lại, đang có mặt trong danh sách cổ đông của chính nó.

Có một khác biệt đáng kể, và NVIDIA đang tựa vào đó rất mạnh. Một phó chủ tịch đã công khai lập luận rằng cơ quan quản lý nên xem Hugging Face là một "nền tảng phi tập trung hóa": một trung tâm phân phối mô hình trọng số mở của hàng nghìn nhà phát triển là đang lan tỏa năng lực AI ra bên ngoài, đối trọng với sự tập trung ở một nhúm phòng thí nghiệm đóng hàng đầu. Huang đưa ra đúng lập luận đó trong thông báo, viện dẫn một lá thư ngỏ về trọng số mở mà ông đồng ký tên, cùng thành tích của NVIDIA với tư cách bên đóng góp đơn lẻ lớn nhất cho Hub: hơn 500 mô hình và hơn 250 bộ dữ liệu mở.

Đó là một lập luận thực sự mạnh. Nó cũng, rất tiện, là lập luận rằng thứ NVIDIA đang mua tốt cho hệ sinh thái đến mức không nên bị lấy đi khỏi tay họ.

Con đường pháp lý là có thật theo cả hai hướng. Ở mức 12,93 tỷ USD, thương vụ phải nộp hồ sơ HSR, nghĩa là FTC và DOJ nhận thông báo chính thức và có thời gian chờ. Đây là bài kiểm tra chống độc quyền thật sự đầu tiên trong chuỗi thâu tóm hiện nay của NVIDIA, sau một loạt thương vụ mua tài sản và đầu tư được cấu trúc để né đúng điều này. FTC và DOJ mở cuộc điều tra chung về các hợp tác mang tính cạnh tranh trong AI vào tháng 2 năm 2026. Thương vụ dự kiến hoàn tất trong nửa đầu năm 2027, một khoảng thời gian đủ dài để các đối thủ viết thư.

Lời hứa trung lập mang tính kỹ thuật, và có thể kiểm chứng

Các cam kết của NVIDIA trong thông báo cụ thể một cách bất thường so với loại văn bản này. Hugging Face vẫn mở với toàn bộ hệ sinh thái. Lập trình viên tự chọn mô hình, framework, đám mây và nhà cung cấp suy luận của mình. Phát triển đa đám mây và đa bộ tăng tốc vẫn được hỗ trợ. Và đây là câu mà các đối thủ sẽ bắt họ giữ lời: "Sẽ không bắt buộc phải dùng năng lực tính toán của NVIDIA để xây dựng trên Hugging Face hay triển khai qua Hugging Face."

Hãy tin đúng nghĩa đen. Gần như chắc chắn nó chân thành, và cũng gần như chắc chắn nó không phải cơ chế mà ai đó nên theo dõi, bởi chẳng ai làm nghiêng một nền tảng bằng cách chặn đối thủ. Cách đó lộ liễu, dễ bị kiện và ngu ngốc. Nền tảng nghiêng đi qua các giá trị mặc định, và giá trị mặc định thì trông giống công việc kỹ thuật.

Đây mới là nơi mọi thứ được định đoạt:

Kernel và đường đi nhanh. Khi transformers chọn một cách cài đặt attention, một đường được tối ưu và kiểm thử, các đường còn lại đúng nhưng chậm hơn. Phần cứng nào có được đường đi nhanh được bảo trì là quyết định phân bổ nguồn lực, diễn ra trong các pull request chứ không phải trong thông cáo báo chí.

Định dạng lượng tử hóa. GGUF, AWQ, GPTQ, FP8, NVFP4, mỗi định dạng ứng với thứ mà một loại chip cụ thể làm tốt. Định dạng nào được công cụ hạng nhất trên Hub, định dạng nào có widget tải lên, định dạng nào được chuyển đổi tự động, và định dạng nào bị bỏ mặc cho script cộng đồng, sẽ quyết định thứ mà phần lớn mọi người thực sự chạy.

Mặc định khi phục vụ mô hình. Hugging Face vận hành ngăn xếp suy luận của riêng mình và định tuyến từ Hub tới các nhà cung cấp suy luận. Nút Deploy đưa ra lựa chọn nào trước, theo thứ tự nào, là một quyết định giao diện có hệ quả kinh tế.

Xếp hạng trong khám phá. Tìm kiếm, bảng xu hướng và gợi ý trên một hub có 3 triệu mô hình quyết định mô hình nào tồn tại trên thực tế. Thẻ mô hình mang tín hiệu tương thích phần cứng ảnh hưởng tới lựa chọn từ rất lâu trước khi có ai chạy benchmark.

Không điều nào trong số này đòi hỏi ác ý. Một đội thật lòng muốn trung lập, nhưng được cấp nguồn lực bởi một công ty mà các kỹ sư hiểu rõ nhất một kiến trúc, sẽ tạo ra hỗ trợ tốt hơn cho kiến trúc đó, không phải vì ai đó chọn thế, mà vì chuyên môn nằm ở đấy. Cứ gọi đó là lực hấp dẫn của người bảo trì: nền tảng luôn trôi về phía những người sửa lỗi.

Nơi tính trung lập của nền tảng thực sự được định đoạt: kernel, định dạng lượng tử hóa, mặc định khi phục vụ mô hình và xếp hạng trong khám phá, nằm bên dưới lớp đưa ra các cam kết chính sách

Các cam kết trong thông báo của NVIDIA hoạt động ở lớp chính sách. Hành vi mà lập trình viên thực sự trải nghiệm được thiết lập thấp hơn ba lớp.

Cần theo dõi những gì, một cách cụ thể

Nếu bạn muốn biết chuyện này có còn trung lập hay không, đừng đọc thông báo tiếp theo. Hãy đưa vào lịch và kiểm tra những mục sau:

  1. Đích mặc định của nút Deploy, trước và sau khi thương vụ hoàn tất. Mỗi quý một ảnh chụp màn hình là đã đủ cho một cuộc kiểm toán trọn vẹn.
  2. Thời gian tới khi các định dạng ngoài NVIDIA được hỗ trợ. Khi một kiểu lượng tử hóa mới của AMD hay Apple Silicon xuất hiện, Hub mất bao nhiêu tuần để xử lý nó tốt ngang với NVFP4?
  3. Ai là người merge kernel. Cơ cấu người bảo trì ở các backend attention và lượng tử hóa của transformers là công khai. Hãy nhìn tỷ lệ, đừng nhìn lời lẽ.
  4. Đối thủ có tiếp tục phát hành ở đó không. Việc Meta, Alibaba, Mistral và AI2 công bố trọng số lên Hub như kênh chính mới là thước đo trung lập thật sự. Nếu bất kỳ ai trong số đó bắt đầu đẩy kênh phân phối riêng lên trước, đó chính là dấu hiệu.
  5. Các biện pháp khắc phục, nếu có. Nếu FTC hay DOJ buộc được các cam kết quản trị, chẳng hạn một ghế hội đồng độc lập, một chính sách trung lập được công bố, một quy trình tiếp nhận khiếu nại, thì chúng đáng giá hơn mọi tuyên bố tự nguyện.

Chốt lại: trọng số mở vừa có chủ

Ngành AI đã dành ba năm tranh cãi mô hình mở hay đóng như thể đó là câu chuyện giấy phép. Nó luôn có một phần là câu chuyện phân phối, và phân phối vừa được gom về một chủ sở hữu duy nhất, người có lợi ích lớn nhất có thể ở một trong hai câu trả lời.

Điều đó không khiến thương vụ này sai. Hugging Face thực sự cần lượng vốn mà khoảng 395 triệu USD huy động trong cả đời không bao giờ cung cấp nổi; hệ sinh thái trọng số mở thực sự hưởng lợi từ một hub được cấp vốn; và thành tích đóng góp của NVIDIA cho Hub thực sự là lớn nhất trong tất cả. Cả ba điều có thể cùng đúng một lúc, và chúng đang đúng.

Nhưng có gì đó đã thay đổi vào ngày 3 tháng 9, và điều đó đáng được gọi tên chính xác. Nơi các mô hình mở được tìm thấy, được đánh giá và được nạp không còn thuộc về một công ty mà lợi ích duy nhất là giữ cho nơi ấy vẫn là nơi ấy. Nó thuộc về một công ty có lợi ích lớn hơn nhiều nằm thấp hơn một lớp.

Từ giờ, trung lập là thứ NVIDIA phải chủ động duy trì, chứ không còn là thứ mà cấu trúc tự sinh ra miễn phí. Đó là bài toán khó hơn vẻ ngoài của nó, và những người phát hiện đầu tiên sẽ không phải cơ quan quản lý. Họ là các lập trình viên nhận ra, quý này qua quý khác, đường nào mới là đường nhanh.


Telli.sh đứng ở đâu: chúng tôi nằm đúng ở đầu tiêu thụ của chính hệ sinh thái này. Telli.sh ghi lại cuộc họp, tách người nói, dịch trực tiếp giữa 15 ngôn ngữ và tạo bản tóm tắt, còn các mô hình phía sau đều đến từ hệ sinh thái mở mà thương vụ này đang sắp xếp lại. Tiện ích mở rộng trình duyệt của chúng tôi có chín engine dịch, trong đó có một lựa chọn chạy hoàn toàn trên thiết bị, chính là để việc chọn mô hình và việc chọn nhà cung cấp luôn tách rời nhau. Nguyên tắc đó là lý do thương vụ này đáng được theo dõi sát sao chứ không phải hờ hững.

Ghi lại cuộc họp tiếp theo và giữ luôn bản gốc

Nguồn


Quay lai blog