RDMA ── CPU 処理なしで通信させる (zero copy と kernel bypass)
「そもそも RDMA ってなんやねん? 普通の通信や DMA と何が違う?」から始め、『普通の通信かてデータは最後メモリに入るやろ、なら何が違うんや』で詰まった所までほどく。両方ともデータは最後にメモリへ着く ── 違うのは『途中のコピー』と『CPU が指揮するか』だけ、と立て直した学習ログ。
タグ
3 件
「そもそも RDMA ってなんやねん? 普通の通信や DMA と何が違う?」から始め、『普通の通信かてデータは最後メモリに入るやろ、なら何が違うんや』で詰まった所までほどく。両方ともデータは最後にメモリへ着く ── 違うのは『途中のコピー』と『CPU が指揮するか』だけ、と立て直した学習ログ。
「オンにすると速くなる」AccelNet の中で何が起きてるか。VF・DMA・eSwitch・FPGA を開けて、ホスト CPU をバイパスしつつ SDN を効かせる仕掛けを追った学習ログ。
「AI の発展でネットワークがボトルネック」を、どこが詰まるかまで物理で特定した学習ログ。詰まるのは GPU の中でもユーザーへの配信でもなく、サーバとサーバのあいだ (NVLink → InfiniBand の 15 倍の崖)。学習の all-reduce が崖からはみ出して GPU が待つ時間こそが本体で、その先には IB vs Ethernet の思想戦争があった、と腹落ちするまでの記録。