再現可能な性能試験

最速結果を選別せず VPS をベンチマークする

有用な VPS ベンチマークは明確なワークロードの問いに答え、他者が再現できる環境情報、コマンド、生出力、時刻情報を示します。説明のない 1 スコアで全アプリや共有基盤上の将来性能は表せません。

重要情報

最低公開単位
問い、環境、コマンド、時間、反復、日付、生出力
比較原則
同じ VPS 構成、イメージ、ツール版、試験時間帯を使う
正直な要約
遅い・失敗した実行も残し、中央値と変動を報告する
安全境界
資源使用を制限し、事業者とネットワークの制限を守る

ワークロードの問いから始める

結果で何を選ぶか決めます。CPU コンパイル、遅延重視 API、取引 DB、順次バックアップ、複数利用者ファイルサービスでは負荷資源が異なります。実処理に近いアクセスパターンを選び、結果を見る前に合格基準を定め、最大に見える数値だけを推す誘惑を減らします。

プラン、リージョン、時間、並列数、データ量、読み書き比、ブロック量、プロトコル、遠隔端点、時間帯を明記します。共有ホストと経路は変動するため、試験は条件を示した日付付きサンプルで、永久保証ではありません。

  • 開始前に判断と基準を書く。
  • 可能ならアプリ層の処理を試す。
  • 無関係なスコアを不透明な 1 評価にまとめない。

再現に足る状況を記録する

プラン、リージョン、開通時刻、OS イメージ、カーネル、CPU 表示、メモリ、スワップ、保存装置、ファイルシステム、マウント設定、IP 族、ツール版を記録します。lscpufree -hlsblkuname -r が役立ちます。公開前に顧客秘密と固有 ID を削除します。

新規開通、ウォームアップ、直近のサイズ変更、他負荷の有無を記します。明確な時区で開始時刻と保守を記録します。ネットワーク試験は両端、ネットワーク、方向、プロトコル、速度制限を特定します。都市名だけでは再現できません。

  • ツール版を固定するかパッケージ情報を保存する。
  • 比較時の OS 状態をそろえる。
  • 重要な例外を隠して再実行せず公開する。

範囲を限定した CPU、保存、ネットワーク試験を行う

CPU は sysbench などでスレッド数と時間を示します。fio は順次・ランダム、キュー深度、ブロック量、直接 I/O、ファイル量、読み書き比をモデル化でき、--output-format=json で機械可読出力を保存します。問いに十分なファイルを使い、キャッシュ効果を説明し、1 方式が常に正しいと装いません。

容量試験の iperf3 は管理する遠隔端点が必要で、速度と時間を制限します。必要なら両方向を試します。ping は往復時間と損失を測れますが、送信元、宛先、間隔、回数、IP 族、経路条件を明示します。強い試験は隣接利用者や制限に影響するため許可を得て、サービス低下時は停止します。

  • 顧客負荷のない専用 VPS を使う。
  • 公開比較では同じ手順を最低 5 回繰り返す。
  • 各実行の出力、エラー、終了状態を保存する。

変動を隠さず要約する

各実行のエラー、抑制、メモリ圧迫、容量不足、背景処理、端点飽和を調べます。不都合だからと遅い結果を削除しません。無効なら保持して除外規則を説明し、都合よい代替値を選ばず予定手順全体を再実行します。

反復の中心には中央値を、変動には範囲またはパーセンタイルを示します。保存結果は帯域・IOPS に加え遅延を、ネットワークは損失と端点制約を含めます。実質的に同等な構成だけを比較し、同等でない場合を明記します。

  • 無効な実行と有効だが遅い実行を分ける。
  • 各値の横に単位と集計方法を示す。
  • 比較不能な環境で割合を主張しない。

手法、生データ、制約を一緒に公開する

信頼できる証拠ページは、版管理した手法、環境一覧、正確なコマンド、個別生ファイル、要約表、試験日、責任者をリンクします。可能なら安定名とチェックサムを使います。結果は対象サンプルの説明であり、割当、競合、経路、ソフトウェア、方針で変化すると説明します。

重要な基盤・イメージ変更後に再試験し、以前の結果を元の日付で残します。訂正は見える状態を保ちます。VPSEverywhere.com の透明性テンプレートは例示値の間は索引対象外で、所定の検証を通った実測だけを運用証拠として示します。

  • 失敗・低速実行も生記録で公開する。
  • 手法改訂ごとに日付と版を付ける。
  • 実施していない測定を後付けしない。

出典

  1. fio 文書
  2. ESnet — iperf3 文書
  3. IETF RFC 2681 — IPPM の往復遅延指標
よくある質問

よくある質問

最良の VPS ベンチマークは?

唯一の最良試験はありません。ワークロードに近い試験を選び設定を公開します。アプリ層測定は 1 つの合成スコアより購入判断に役立ちます。

何回の結果を公開すべきですか?

本手法では同一試験を最低 5 回実施し、有効結果をすべて残します。変動が大きい、または重要な判断なら追加サンプルが必要です。

最速でなく中央値を出す理由は?

最速値は選別を促します。中央値は反復観測の中心、範囲やパーセンタイルは変動を示します。どちらも将来性能を保証しません。

本番で `fio` や `iperf3` を実行できますか?

顧客負荷への破壊的試験は避けます。専用環境を使い、時間と速度を制限し、事業者規則を守り、遠隔端点の許可と非ボトルネックを確認します。