NVIDIA Mellanox MCX4121A-ACAT Server Adapter ในกิจกรรม

July 22, 2026

ข่าว บริษัท ล่าสุดเกี่ยวกับ NVIDIA Mellanox MCX4121A-ACAT Server Adapter ในกิจกรรม

NVIDIA Mellanox MCX4121A-ACAT Server Adapter ในกิจกรรม

สถานการณ์และความท้าทาย: เมื่อ 25GbE ตอบโจทย์ผนังความช้า

ผู้ให้บริการบริการเมฆขนาดกลาง ครับ เรียกพวกเขาว่า CloudNova ครับ กําลังเผชิญกับปัญหาที่คุ้นเคย แต่เจ็บปวดแต่ผลงานของแอพพลิเคชั่นบอกเรื่องที่แตกต่างกันการจําลองฐานข้อมูลช้า งานการเรียนรู้เครื่องจักรจําหน่ายหยุดทํางานในการปรับสynchronization และระบบเก็บข้อมูล NVMe ไม่เคยส่ง IOPS ที่สัญญาไว้การใช้งานทั่วไปของ TCP/IP ที่ใช้งานมากกว่า 25% ของ CPU คอร์ในคอมพิวเตอร์, และ NICs ที่มีอยู่ขาดการลดภาระของฮาร์ดแวร์สําหรับ RDMA สิ่งที่พวกเขาต้องการไม่ได้เพียงแค่ความกว้างแบนด์เวทมากขึ้นใช้ได้ความกว้างแบนด์วิทที่มีการกําหนดระดับไมโครวินาที การค้นหาของพวกเขานําพวกเขาไปยังNVIDIA Mellanox MCX4121A-ACATการ์ดที่ออกแบบมาอย่างแม่นยํา สําหรับความเจ็บปวดของศูนย์ข้อมูลที่ทันสมัย

การแก้ไข: ใช้บัตร MCX4121A-ACAT Ethernet Adapter

ทีมงานสถาปัตยกรรม CloudNova เปลี่ยน NICs 10GbE ของพวกเขาการ์ด MCX4121A-ACAT Ethernetผ่าน 120 หน่วยคอมพิวเตอร์ ซึ่งแต่ละหน่วยมีพอร์ต SFP28 สองตัว การจัดจําหน่ายใช้การสนับสนุน RoCE v2 ของตัวปรับเพื่อทําให้การขนส่ง Ethernet ไม่มีการสูญเสียกําจัดความจําเป็นของผ้า InfiniBand ที่แยกแยกคีย์ของทางออกคือMCX4121A-ACAT ConnectX-4 Lx ท่าสอง 25GbE SFP28การออกแบบที่ทําให้การเชื่อมโยงแบบ Active-Active Link เป็น 50Gb/s โดยรวมต่อเซอร์เวอร์ทีมงานตั้งค่า PFC ( Priority Flow Control) และ ECN (Explicit Congestion Notification) ในระดับสวิตช์, การันตีว่าการจราจร RoCE ยังคงขาดทุนแม้กระทั่งในช่วงยอดแรงสูงสุดองค์ประกอบการเก็บข้อมูลและการคํานวณทั้งหมดทํางานบน RDMA การเปลี่ยนแปลงที่ทําให้เรียบร้อยโดยความสอดคล้องภายนอกกล่องของตัวปรับกับสายไฟ SFP28 และสวิตช์ Mellanox Spectrum ที่มีอยู่.

จากมุมมองการดําเนินงานสอดคล้องกับ MCX4121A-ACATการ์ดบูรณาการได้อย่างดีกับเซอร์เวอร์ที่ใช้ Ubuntu และคลาสเตอร์ Kubernetes ของ CloudNova โดยต้องการการติดตั้ง Driver มาตรฐานเท่านั้นใบข้อมูล MCX4121A-ACATเพื่อปรับปรุงการจัดหาพัฟเฟอร์และหยุดการตั้งค่าการรวมกัน เพื่อบรรลุผลการทํางานที่ดีที่สุดสําหรับสภาพแวดล้อมภาระงานผสมผสานของพวกเขาและงานฝึกอบรม TensorFlow.

ผลลัพธ์ที่สามารถวัดได้: ความสามารถในการทํางาน, ความช้า, และประสิทธิภาพของ CPU

การปรับปรุงผลงานได้ทันทีและสามารถปรับปริมาณได้NVIDIA Mellanox MCX4121A-ACAT, ระบบการเก็บข้อมูลเห็น NVMe-oF อ่านความช้าลดลงจาก 85μs เป็นเพียง 12μs เพิ่มขึ้น 7 เท่า ความช้าในการจําลองฐานข้อมูลระหว่างโน้ดหลักและรอคอยลดลงจาก 320ms เป็นต่ํากว่า 2msทําให้การเปลี่ยนแบบล้มเหลวเกือบสมองได้สําหรับภาระการทํางานการเรียนรู้เครื่องจักร, เวลาการปรับสynchronization ทั้งหมดสําหรับการฝึก ResNet-50 ลดลง 62%, ลดเวลาการฝึก EPOC จาก 4.2 ชั่วโมงเป็น 1.6 ชั่วโมง

นอกเหนือจากความช้า การเพิ่มความสามารถในการทํางานของเซอร์เวอร์ก็น่าสนใจเท่ากัน เครื่องยนต์การลดอัตราการทํางานของฮาร์ดแวร์และ VLAN tagging ลดการใช้งาน CPU ในการประมวลผลเครือข่ายจาก 28% เป็นต่ํากว่า 5% ในทุกหน่วย. นี้ได้ปลดปล่อยมากกว่า 20 CPU คอร์ต่อเซอร์เวอร์สําหรับการใช้งานโลจิก, เพิ่มความหนาแน่นของถังโดยตรงโดย 40%รายละเอียด MCX4121A-ACAT, การ์ดส่งอัตราการเชื่อมต่อสาย 25GbE ต่อพอร์ตด้วยความช้าต่ํากว่า 1μs และมาตรฐานภายใน CloudNova ยืนยันตัวเลขเหล่านี้ในการผลิต

เมทริก ก่อน (Legacy NIC) หลังจาก (MCX4121A-ACAT) การปรับปรุง
NVMe-oF อ่านความช้า 85 μs 12 μs 7. 1 เท่าเร็วขึ้น
DB Replication Lag (ความช้าในการจําลอง) 320 ms < 2 ms การลด 160 เท่า
CPU Network Overhead ค่าใช้จ่าย 28% 40.8% 83% ลดลง
เวลาฝึก ML (ResNet-50) 4.2 ชั่วโมง 1.6 ชั่วโมง 62% เร็วขึ้น

ประโยชน์ทางการดําเนินงาน: TCO และความพร้อมในอนาคต

ขณะที่ตัวเลขผลการดําเนินงานสดบอกเรื่องราวที่น่าเชื่อถือ, ผลประโยชน์ในการดําเนินงานMCX4121A-ACAT Ethernet adapter card solution การแก้ไขการ์ดลดต้นทุนการครอบครองโดยการกําจัดความต้องการของผ้า RDMA ที่แยกแยก (ประหยัดมากกว่า 180K ดอลลาร์ในพื้นฐานสวิตช์)การใช้พลังงานต่อเซอร์เวอร์ลดลง 8W เมื่อเทียบกับ NICs ก่อนหน้านี้, แปลว่าการประหยัดการเย็นรายปีประมาณ 15% นอกจากนี้การออกแบบสายพานสองสายของตัวปรับยังให้ความหลากหลายพื้นบ้านการจราจรอัตโนมัติล้มเหลวไปยังพอร์ตรอง โดยไม่มีการสูญเสียแพ็คเก็ตตามที่ตรวจสอบจากบันทึกโทรทัศน์ของตัวปรับ

สําหรับผู้บริหาร IT การประเมินราคา MCX4121A-ACATเมื่อเทียบกับทางเลือกอื่น CFO ของ CloudNova ระบุว่าระยะเวลาในการคืนเงินน้อยกว่า 10 เดือน ซึ่งเป็นผลที่มากที่สุดจากการใช้งานเซอร์เวอร์ที่เพิ่มขึ้นและการลดเวลาในการเสร็จสิ้นงานทีมงานยังชื่นชมสถาปัตยกรรมที่มองไปข้างหน้าMCX4121A-ACAT สําหรับขายในปัจจุบันรองรับ 25GbE ในปัจจุบัน แต่สามารถนําไปใช้ใหม่สําหรับสภาพแวดล้อม 10GbE หรือ 40GbE ด้วยออปติกที่เหมาะสม เพื่อให้การป้องกันการลงทุนสําหรับการปรับปรุงในอนาคต

สรุปและมุมมอง: แผนผังสําหรับศูนย์ข้อมูล RDMA-Ready

การเดินทางของ CloudNova กับNVIDIA Mellanox MCX4121A-ACATแสดงแบบแผนที่ชัดเจนสําหรับองค์กรที่ต้องการที่จะปลดปล่อยศักยภาพเต็มของพื้นฐาน 25GbE โดยการรวมการผ่าน 25GbE ที่มีสองท่าทางและการบูรณาการอย่างต่อเนื่องกับระบบนิเวศ, การการ์ด MCX4121A-ACAT Ethernetเปลี่ยนแปลง I/O ของเครือข่ายจากปัญหาการขัดขวาง เป็นเครื่องช่วยให้การทํางานได้ ผลลัพธ์คือ ความช้าในการเก็บข้อมูลลดลง 7 เท่า ลดค่าใช้จ่าย CPU 83%และการฝึก ML รวดเร็วขึ้น 62%.

มองไปข้างหน้า เมื่อภาระงาน AI และการวิเคราะห์ในเวลาจริงยังคงขับเคลื่อนความต้องการต่อเครือข่ายที่กําหนดMCX4121A-ACAT ConnectX-4 Lx ท่าสอง 25GbE SFP28สร้างพื้นฐานที่แข็งแกร่งสําหรับการนํา RDMA มาใช้งานโดยไม่ต้องปรับปรุงรถยกแต่เป็นสินทรัพย์ทางกลยุทธ์ปริมาตรการปรับปรุงรายละเอียดและวิธีปฏิบัติที่ดีที่สุดในการใช้งานใบข้อมูล MCX4121A-ACAT✅อ้างอิงที่จําเป็นสําหรับการใช้งานอย่างจริงจัง