Lớp tính toán · tăng tốc bằng NVIDIA

Năng lực tính toán NVIDIA kèm điện, đã bàn giao

Một khuôn viên ưu tiên năng lượng mới chỉ là một nửa câu trả lời. Greco mang nửa còn lại vào bên trong: năng lực tính toán AI chìa khóa trao tay, tăng tốc bằng NVIDIA, dựng trên Dell AI Factory — đã lắp rack, làm mát bằng chất lỏng và lấy điện từ chính khuôn viên chứa nó. Công suất đã đóng điện và đã lắp sẵn các bộ tăng tốc thế hệ hiện tại.

Blackwell
NVIDIA HGX B300 (Ultra)
400G
NVIDIA ConnectX-7
Liquid
Làm mát trực tiếp tới chip
Turnkey
Đã cấp điện + đã triển khai

Điện và tính toán như một tài sản duy nhất

Phần lớn nhà vận hành trao cho quý vị những rack trống và nhiều năm chờ điện. Greco giao cả hai. Chúng tôi xây khuôn viên, phát điện sau công tơ, thiết kế hệ làm mát bằng chất lỏng, và đưa năng lực tính toán tăng tốc bằng NVIDIA lên trên — tích hợp thành một tài sản duy nhất.

Chúng tôi mua sắm và triển khai qua Dell AI Factory. Nghĩa là chính những nền tảng Dell PowerEdge dòng XE và NVIDIA đã được kiểm định mà các hyperscaler đang chạy, được lập cấu hình theo khối lượng công việc và lắp đặt trong một tòa nhà đã có điện và làm mát của riêng nó — thay vì xếp hàng chờ đấu nối một trạm biến áp còn chưa được xây.

AI infrastructure and managed IT services

GRECO Energy delivers next-generation AI infrastructure and managed IT solutions for enterprise and high-performance computing environments. Our services integrate advanced compute, servers, networking, data centre infrastructure and energy-efficient technologies through leading technology partners. From system integration and deployment to managed infrastructure and ongoing support, GRECO provides scalable solutions designed for the future of AI.

GRECO Energy is an AI infrastructure developer, managed service provider and systems integrator developing high-density AI data centre infrastructure in Canada and the United States. GRECO integrates advanced compute infrastructure with power generation, liquid cooling, energy storage and thermal waste-heat recovery for district energy and other beneficial uses.

Nền tảng chúng tôi triển khai

Dựng trên Dell AI Factory cùng NVIDIA — chuỗi công cụ đã được chứng minh và kiểm định, lập cấu hình theo từng khuôn viên.

Dell PowerEdge XE9785 / XE9785L

Máy chủ GPU mật độ cao ở cấu hình làm mát bằng không khí (XE9785) và làm mát bằng chất lỏng trực tiếp tới chip (XE9785L) — cỗ máy chủ lực của Dell AI Factory.

Dell Integrated Rack IR7000

Các hệ thống làm mát bằng chất lỏng đến dưới dạng giải pháp quy mô rack — điện, ống góp làm mát và phần tính toán được tích hợp và kiểm định tại nhà máy.

NVIDIA HGX B300 — Blackwell Ultra

Node NVL8 tám GPU dựng trên các bộ tăng tốc thế hệ hiện tại của NVIDIA, ghép với CPU AMD EPYC nhiều nhân, DDR5 cỡ terabyte và NVMe.

Hạ tầng mạng NVIDIA ConnectX-7 400G

Mạng bốn trăm gigabit để các cụm mở rộng như một cỗ máy duy nhất — đúng loại hạ tầng đông-tây mà huấn luyện và suy luận AI đòi hỏi.

Cấu hình bám theo dòng PowerEdge XE mà Dell đã công bố và các thiết kế tham chiếu của NVIDIA; mỗi lần triển khai được lập cấu hình theo khối lượng công việc và mật độ của khách thuê.

Xem toàn bộ dòng Dell PowerEdge chúng tôi cung cấp

Thiết kế cho làm mát bằng chất lỏng — và nhiệt quý vị bán được

Dòng XE9785L / IR7000 làm mát bằng chất lỏng là nơi mô hình ưu tiên năng lượng của Greco cộng hưởng. Nhiệt mà các bộ tăng tốc này sinh ra được thu ở 50 °C và xuất sang một đơn vị năng lượng khu dân cư. Phần lớn trung tâm dữ liệu phải trả tiền để thải bỏ lượng nhiệt đó; một khuôn viên Greco biến nó thành một nguồn thu và một lợi ích cho cộng đồng.

Xem cách chúng tôi mô phỏng vòng xuất nhiệt

Colocation GPU, không còn bài toán về điện

Nếu quý vị đang đi tìm colocation GPU, hẳn quý vị đã biết ràng buộc không nằm ở chỗ đặt rack.

Colocation thông thường được xây cho rack 5–10 kW. Một node Blackwell Ultra tám GPU tự nó đã ngốn khoảng 10 kW, nên một rack AI hiện đại có thể cần nhiều điện hơn mức mà một cơ sở truyền thống phân bổ cho cả một dãy. Đó là lý do các nhà vận hành đi tìm colocation GPU cứ nghe mãi một câu trả lời: diện tích thì có, điện thì không, và chính đấu nối điện lực của cơ sở đó mới là thứ cản đường.

Khuôn viên GRECO phát điện sau công tơ, nên công suất được chào không phụ thuộc vào việc nâng cấp trạm biến áp hay một vị trí trong hàng chờ đấu nối. Các gian máy được thiết kế cho làm mát bằng chất lỏng trực tiếp tới chip ngay từ đầu chứ không cải tạo quanh những giả định làm mát bằng không khí, ở lớp rack 600 kW đến 1 MW.

Khác biệt thương mại đáng nói thẳng: phần lớn nhà cung cấp colocation bán lại điện lưới và chuyển phí công suất sang khách. Ở đây điện được phát tại chỗ và nhiệt thải được bán vào nhiệt khu vực, đó là một cấu trúc chi phí khác hẳn về bản chất — và là lý do công suất có thể được chào theo một tiến độ thay vì theo một vị trí xếp hàng.

Deployments run from single racks of Dell PowerEdge XE-series hardware through to multi-megawatt halls, either as colocation you populate yourself or as fully managed capacity where GRECO specifies, racks, commissions and operates the fleet. If you would rather take the building and fit out the interior yourself, that is a vỏ công trình đã cấp điện.

Từ lưới điện đến token, một chủ sở hữu

Mọi nhà cung cấp khác chỉ sở hữu một lát cắt. Greco sở hữu cả cột.

01

Điện sau công tơ

Phát điện tại chỗ + lưu trữ đóng điện cho khuôn viên sớm hơn nhiều năm so với một đấu nối lưới.

02

Làm mát bằng chất lỏng trực tiếp tới chip

Các rack IR7000 làm mát bằng chất lỏng được thiết kế vào trong nhà máy năng lượng, không phải lắp thêm sau.

03

Tính toán tăng tốc bằng NVIDIA

Dell PowerEdge dòng XE với NVIDIA HGX B300 — đã lắp rack, đã đấu mạng và sẵn sàng chạy.

04

Nhiệt được xuất đi, không thải bỏ

Nhiệt mà các GPU đó sinh ra được thu ở 50 °C và bán vào nhiệt khu vực.

Giảm rủi ro trong bản sao số trước khi lắp lên rack

Chúng tôi mô phỏng bố trí rack, phân phối điện và làm mát cho đúng những hệ thống này trong một bản sao số dựa trên vật lý trước khi lắp bất cứ thứ gì — nên mật độ, diễn biến nhiệt và tải trọng sàn được kiểm chứng ở giai đoạn thiết kế, chứ không phát hiện ra tại công trường.

Technology partners

GRECO specifies, procures, integrates and manages infrastructure from the vendors below. Hardware is chosen for the workload and for the power and cooling envelope of the site, not the other way round.

Năng lực tính toán AI: những câu hỏi thường gặp

Chất lỏng mang lượng nhiệt trên mỗi đơn vị thể tích lớn gấp khoảng một nghìn lần không khí, đó là lý do rack trên khoảng 50 kW không thể làm mát bằng không khí với chi phí hợp lý. Làm mát trực tiếp tới chip dẫn chất tải lạnh đến các tấm lạnh áp trên bộ xử lý; làm mát ngâm chìm nhấn cả bo mạch vào chất lỏng cách điện. Rack AI hiện đại chạy 600 kW đến 1 MW không để lại lựa chọn thực tế nào khác.

Các cơ sở được thiết kế cho lớp 600 kW đến 1 MW ngay từ đầu chứ không cải tạo dần lên mức đó, với làm mát trực tiếp tới chip, làm mát ngâm chìm và phân phối điện 800 VDC đưa vào thiết kế từ ngày đầu. Xây theo phạm vi đó ngay từ đầu tránh được vấn đề công suất mắc kẹt vốn hành hạ các gian máy làm mát bằng không khí được hoán cải muộn.

Vỏ công trình đã cấp điện là tòa nhà được bàn giao đã có điện, đã có làm mát và sẵn sàng, còn khách thuê mang rack và phần cứng của mình vào. Thuê công suất nghĩa là GRECO hoàn thiện bên trong và khách thuê bao tiêu theo kilowatt. Vỏ công trình đã cấp điện hợp với nhà vận hành có tiêu chuẩn phần cứng riêng; thuê công suất hợp với những ai muốn bỏ qua hoàn toàn việc xây dựng.

Vì nó giữ nhiệt tập trung và ở nhiệt độ hữu ích. Chất lỏng hồi về từ chip ở 45–48 °C, đủ cao để bộ trao đổi nhiệt dạng tấm nâng lên 50 °C cho nhiệt khu vực. Làm mát bằng không khí phân tán cùng lượng năng lượng đó vào một thể tích lớn không khí ấm không đáng thu hồi, và đó là lý do xuất nhiệt và làm mát bằng chất lỏng thực chất là một quyết định duy nhất.

Đó chính là điểm cốt lõi của mô hình. Vì GRECO phát điện tại chỗ sau công tơ, công suất của khuôn viên không phụ thuộc vào một đấu nối mới với điện lực, nên bên bao tiêu thuê được công suất đã hoàn thiện, đã có điện trong vài tháng thay vì ôm một cái vỏ suốt một hàng chờ năm đến bảy năm.

Colocation GPU là chỗ đặt rack và điện bán riêng cho tính toán tăng tốc, và khác biệt hoàn toàn nằm ở mật độ. Colocation thông thường được thiết kế quanh rack 5–10 kW làm mát bằng không khí. Riêng một node Blackwell Ultra tám GPU đã ngốn khoảng 10 kW, nên rack AI rơi vào khoảng 40 kW đến 1 MW và cần làm mát bằng chất lỏng, phân phối công suất lớn hơn và một cơ sở mà nguồn điện của nó thực sự có thể lớn lên. Phần lớn nhà cung cấp có thể chào diện tích từ rất lâu trước khi họ chào được điện.

Cách nào cũng được. Quý vị có thể mang phần cứng của mình vào công suất đã có điện, làm mát bằng chất lỏng, hoặc GRECO lập cấu hình, mua sắm, lắp rack, nghiệm thu và vận hành đội máy như một dịch vụ được quản trị — bao gồm dòng Dell PowerEdge XE với tư cách nhà cung cấp dịch vụ quản trị của Dell. Khác biệt quan trọng hơn cả phần cứng là điện được phát tại chỗ chứ không phải mua đi bán lại từ lưới.

Trao đổi với chúng tôi về công suất NVIDIA đã có điện

Cho chúng tôi biết bộ tăng tốc, mật độ và yêu cầu điện của quý vị, chúng tôi sẽ ánh xạ chúng vào một khuôn viên Greco.