データセンターネットワークでの輻輳対策どうしてる?
- 悩みの共有
- ECN とか PCF とかしきい値とかメーカによって違うとか、ECN だとホスト側に委ねられていると思う
- しきい値の設定根拠の調査とかから難しい
- deep buffer のバッファサイズを変更とかできるかについて
- それがやれるかもわからない
- トラフィックのありなしの差は?
- nc コマンドをランダムで実行
- Hadoop の通信は全部 TCP なので再送、再送すると Hadoop でログが出る
- Discards と Queue Drop の違いについて
- Discards は インタフェースとかから落ちた、Queue Drop は明示的に Queue から落ちたという理由が明確
- サーバが変わったとか、NIC が変わったとかでも変わる
- NW 機器だけでなく、サーバとか、アプリケーションの知識も必要になるのが大変だと思っている
- 前みたいに ToR から上は NW チームで、下がサーバみたいな区分けでいける感じではない
- 組織的にアプリケーションチームと連携するのが必要そう
- バッファブロードが起きていると確信できる方法はあるか
- 知りたい