NVIDIA Mellanox MCX4121A-ACAT Server Adapter หนังสือขาวเทคนิค

July 22, 2026

NVIDIA Mellanox MCX4121A-ACAT Server Adapter หนังสือขาวเทคนิค

NVIDIA Mellanox MCX4121A-ACAT Server Adapter หนังสือขาวเทคนิค

1. สถานการณ์โครงการและการวิเคราะห์ความต้องการ

ศูนย์ข้อมูลที่ทันสมัยถูกกดดันอย่างต่อเนื่องเพื่อรองรับภาระงานที่ต้องการมากขึ้น จากการฝึกอบรม AI / ML และการค้าความถี่สูงไปยังฐานข้อมูลจําหน่ายและ NVMe-over-Fabrics storageขณะที่ 25GbE Ethernet กลายเป็นมาตรฐานชั้นการเข้าถึงหลัก, องค์กรหลายรายพบว่าความกว้างแบนด์วิทสดเพียงลําพังไม่ได้แปลให้กับการทํางานของแอพลิเคชัน.ความช้าที่ไม่คาดเดาได้, และการประมวลผลแพ็คเก็ตที่ไม่มีประสิทธิภาพที่สามารถบริโภค 20 ~ 30% ของ CPU คอร์ของเซอร์เวอร์ สําหรับแอพลิเคชั่นที่มีความรู้สึกต่อความอ่อนแอและความหิวโหยของความผ่าน, ระบบย่อยเครือข่ายมักกลายเป็นสายที่อ่อนแอที่สุด.

หนังสือขาวนี้ตอบโจทย์กับปัญหาเหล่านี้NVIDIA Mellanox MCX4121A-ACATแอดป์เตอร์เซอร์เวอร์ ออกแบบให้กับบริษัทที่ต้องการที่จะปลดปล่อยศักยภาพเต็มของพื้นฐาน 25GbEการ์ด MCX4121A-ACAT Ethernetผสมผสานการเชื่อมต่อ 25GbE ช่องสองกับ RDMA ที่เร่งเร็วด้วยฮาร์ดแวร์ผ่าน Ethernet Converged (RoCE)(2) ลดค่าใช้จ่ายในการประมวลผลเน็ตพีซีโดยมากกว่า 80%, และ (3) ทําให้สามารถปรับขนาดได้อย่างต่อเนื่องจาก Node น้อย ๆ เป็นร้อยๆ โดยไม่ต้องปรับปรุงสถาปัตยกรรม

2. การออกแบบระบบระบบและเครือข่ายโดยรวม

สถาปัตยกรรมที่แนะนําใช้ทอปโลยีใบ-กระดูกสันหลังที่มี 25GbE เป็นชั้นการเข้าถึงเซอร์เวอร์และ 100GbE uplinks ไปยังกระดูกสันหลังMCX4121A-ACAT ConnectX-4 Lx ท่าสอง 25GbE SFP28แอดป์เทอร์, ใช้ในทุกคอมพิวเตอร์และสตอเรชั่นโน๊ด อาร์คิทคัตช์ถูกสร้างขึ้นรอบสามหลักการหลัก:

  • ผ้าอีเทอร์เน็ตไร้การสูญเสีย:การนํา RoCE v2 มาใช้กับ PFC (Priority Flow Control) และ ECN (Explicit Congestion Notification) เพื่อกําจัดการลดแพ็คเก็ตและรับประกันความช้าที่กําหนดได้
  • อัดฮาร์ดแวร์ทุกที่การอํานวยความสะดวกในการประมวลผลชั้นขนส่ง รวมทั้ง checksum, segmentation และ RDMA ไปยังตัวปรับ, ปลดปล่อยวงจร CPU สําหรับการใช้งานธุรกิจ
  • อัตราการรีดันต์ที่ทํางานการใช้ Port SFP28 ทั้งสองในรูปแบบการรวมลิงค์ (LACP) สําหรับความกว้างแบนด์เบดรวม 50Gb/s และ failover อัตโนมัติ

คําตอบคืออย่างเต็มที่สอดคล้องกับ MCX4121A-ACATด้วยแพลตฟอร์มเซอร์เวอร์ชั้นนํา (Dell PowerEdge, HPE ProLiant, Supermicro) และสวิตช์จาก NVIDIA Spectrum และ Arista สําหรับการเก็บข้อมูลทําให้การเก็บข้อมูลแบบแบ่งปันได้ด้วยความช้าที่ใกล้กับ NVMe drive ท้องถิ่น.

3บทบาทและคุณสมบัติสําคัญของ NVIDIA Mellanox MCX4121A-ACAT

ในฐานะองค์ประกอบพื้นฐานของคําตอบนี้NVIDIA Mellanox MCX4121A-ACATมีหน้าที่สําคัญ 3 อย่าง

หน้าที่ รายละเอียดการดําเนินการ ประโยชน์ทางธุรกิจ
เครื่อง RDMA/RoCE RoCE v2 ที่ใช้ฮาร์ดแวร์พร้อมการสนับสนุน ECN/PFC ความช้าต่ํากว่า 1μs การมีส่วนร่วมของ CPU เกือบศูนย์สําหรับการเคลื่อนไหวข้อมูล
โพร์ตสองสาย 25GbE สองพอร์ต SFP28 ที่เป็นอิสระ ความเร็วรวม 50Gb/s การเชื่อมต่อแบบทํางาน-ทํางาน หรือการรีดดันแบบทํางาน-รอ
การเวอร์ชูเอล & การอัพโหลดออฟเลย์ SR-IOV ที่มีความเร็วสูงสุด 128 VF ต่อท่า; VXLAN/NVGRE โครงการเช่าหลายรายการความหนาแน่นสูงที่มีประสิทธิภาพในอัตราการเช่า

ข้อจําแนกหลักที่นํามาจากใบข้อมูล MCX4121A-ACATประกอบด้วย PCIe 3.0 x8 host interface, offloads ที่ครบวงจร (checksum, LSO/LRO, VLAN stripping/insertion) และเทเลเมตรีที่ก้าวหน้าต่อพอร์ตประสิทธิภาพพลังงานของตัวปรับ (< 10W แบบ) และการสนับสนุนระบบปฏิบัติการที่กว้าง (Linux, Windows, VMware ESXi) ทําให้มันเป็นก้อนก่อสร้างที่หลากหลายสําหรับสภาพแวดล้อมที่แตกต่างกัน

4. แนะนําการใช้งานและการปรับขนาด

สําหรับการใช้งานในกรีนฟิลด์ เราแนะนําให้ใช้ทอปโลยีกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานกระดานการ์ด MCX4121A-ACAT Ethernetโดยมีทั้งสองพอร์ตเชื่อมต่อกับสวิทช์ใบแยกเพื่อการผ่อนผัน RoCE fabric ต้องการการตั้งค่า QoS ที่สอดคล้องในสวิทช์ทั้งหมดPFC บนความสําคัญที่ 3 และเครื่องหมาย ECN บนประเภทการจราจรเดียวกันเราแนะนําการจัดสรร VLAN ที่มอบหมายสําหรับการจราจร RoCE เพื่อทําให้การติดตามและแก้ปัญหาง่ายขึ้น

สําหรับสภาพแวดล้อมแบนฟิลด์MCX4121A-ACAT Ethernet adapter card solution การแก้ไขการ์ดโปรแกรมการปรับปรุงอัตราการใช้งานของอัตราการปรับปรุงอัตราการใช้งานของอัตราการปรับปรุงอัตราการใช้งานตัวปรับสัญญาณยังรองรับการสวิตช์ Ethernet มาตรฐานโดยไม่ต้องเปิด RoCE, ทําให้ทีมงานสามารถใช้ฮาร์ดแวร์ได้ก่อน และเปิดใช้ความสามารถ RDMA ในระยะเวลาที่ผ้ามีอายุ

การปรับขนาดของคําตอบนั้นเรียบง่าย: ค้อนของหน่วยเพิ่มเติมMCX4121A-ACAT สําหรับขายSKU และเนื้อเยื่ออัตโนมัติรองรับจุดสิ้นใหม่ผ่าน LLDP และ DCBx การเจรจาเราแนะนําการใช้ RoCE ที่มุ่งเน้นในการควบคุมความจุกจุก (e.g., NVIDIA Spectrum Switches with built-in telemetry) เพื่อรักษาพฤติกรรมที่ขาดทุนในขนาด

5การดําเนินงาน ติดตาม ตรวจสอบปัญหา และปรับปรุง

การทํางานอย่างมีประสิทธิภาพของ RoCE fabric ต้องการกลยุทธ์การติดตามหลายชั้น:

  • เทเลเมทรีระดับตัวปรับรายการรายละเอียด MCX4121A-ACATประกอบด้วยคอนเตอร์ต่อพอร์ตสําหรับเฟรม PFC, แพ็คเก็ตที่มีเครื่องหมาย ECN และเฟรมที่ตกmlx5cmdหรือ NVIDIA firmware Tools เพื่อส่งออกไปยัง Prometheus/Grafana
  • การติดตามระดับสวิทช์:ติดตามการครอบครองพัฟเฟอร์, จํานวนเฟรมหยุด, และความลึกของคิวบนสวิทช์กระดูกสันหลังและใบ. การเพิ่มขึ้นอย่างฉับพลันในเฟรมหยุดแสดงให้เห็นถึงการอับอัดขนาดเล็กที่อาจต้องการการปรับขอบ ECN.
  • เมทริกระดับการใช้งาน:สําหรับแอพลิเคชั่น RDMA ติดตาม WR (Work Request) ความช้าในการเสร็จสิ้น และ CQ (Completion Queue) เหตุการณ์การไหลเวียน โดยใช้ห้องสมุดที่ให้บริการโดยผู้ขาย

สถานการณ์การแก้ไขปัญหาทั่วไปประกอบด้วย:

  • ความเสื่อมของ RoCEยืนยันว่า PFC ได้เปิดในพอร์ตสวิตช์ทั้งหมด และการระบุ DSCP ตรงกับการตั้งค่าสวิตช์ใบข้อมูล MCX4121A-ACATเพื่อยืนยันการตั้งค่าการจัดสรรพัสดุพัสดุ
  • ความผิดพลาดการลดลิงค์หรือ CRC:ตรวจสอบคุณภาพเคเบิล SFP28 และให้แน่ใจว่า แฟร์มแวร์ตัวปรับปรุงถูกอัพเดทเป็นรีลีสล่าสุด
  • CPU ยังคงสูง แม้ว่าจะลดอัตราการทํางานยืนยันว่า RDMA กําลังถูกใช้จริง (ไม่กลับไปยัง TCP) โดยการตรวจสอบตัวนับ Driver และบันทึกการใช้งาน

สําหรับการปรับปรุง, เราแนะนําปริมาตรการปรับปรุงต่อไปนี้ (มาจากการรับรองห้องปฏิบัติการที่กว้างขวาง): - Set interrupt coalescing (moderation) to 4 µs for mixed workloads - Enable hardware timestamping for precise latency measurement - Configure RSS (Receive Side Scaling) across multiple CPU cores for non-RDMA traffic - For storage workloads, เพิ่ม RDMA MTU สูงสุดเป็น 4096 ไบท์ เพื่อลดค่าใช้จ่ายโปรต็อกอล

6. สรุปและการประเมินค่า

รายการNVIDIA Mellanox MCX4121A-ACATโดยการแทน TCP/IP ด้วย RDMA/RoCE องค์กรสามารถบรรลุการลดความช้าระดับการใช้งานถึง 5 รายการลดค่าใช้จ่ายต่อเครือข่าย CPU มากกว่า 80%, และเพิ่มความหนาแน่นของคอนเทนเนอร์เซอร์โดย 30~50%การ์ด MCX4121A-ACAT Ethernetให้ทางที่คุ้มค่าในการใช้งาน 25GbE ด้วยการคุ้มครองการลงทุนผ่านความเข้ากันได้ในอดีต และความสามารถในการลดภาระในอนาคต

เมื่อประเมินค่าบริหารสินค้าทั้งหมดราคา MCX4121A-ACATได้รับการชดเชยจากการประหยัดการใช้งานที่สําคัญ: จํานวนเซอร์เวอร์ที่ลดลง (เนื่องจากการใช้งานที่สูงขึ้น) ค่าเย็นที่ต่ําลง (เนื่องจากการใช้พลังงาน < 10W)และการกําจัดของ InfiniBand หรือผ้าพิเศษคําตอบคืออย่างเต็มที่สอดคล้องกับ MCX4121A-ACATกับระบบนิเวศแหล่งเปิดหลัก รวมถึง Kubernetes, Apache Spark และ TensorFlow, รับประกันความสามารถในการใช้งานได้อย่างกว้างขวางในบริษัทและการจัดจําหน่ายในเมฆ

สําหรับสคริปต์การใช้งานรายละเอียด แมปเล็ตการตั้งค่า และรายงานการเปรียบเทียบผลงาน กรุณาดูรายงานการใช้งานทางการใบข้อมูล MCX4121A-ACATและโปตัลเอกสารเครือข่าย NVIDIA หนังสือขาวนี้เป็นจุดเริ่มต้น ภาพสถาปัตยกรรมถูกยืนยัน ส่วนประกอบพร้อมการผลิต และประโยชน์สามารถวัดได้MCX4121A-ACAT ConnectX-4 Lx ท่าสอง 25GbE SFP28มันไม่ใช่แค่ตัวปรับ แต่เป็นตัวช่วยทางกลยุทธ์ สําหรับศูนย์ข้อมูล RDMA พร้อมและดีที่สุดในอนาคต