サーバーは将軍澳にある。では、誰がケージへ行くのか
短い答え: 香港のコロケーションが買えるのは電力・空調・接続性・物理セキュリティです。手も、目も、予備部品も、変更記録も、午前三時のエスカレーション経路も買えません。ケージの中にあるこれら五つの仕事は誰かのものであるはずですが、多くの中小トレーディング会社では、それが本当に必要になる夜まで「特定の誰か」のものではありません。
ある香港の証券会社が将軍澳(ツェンクワンオー)でコロケーション契約を結び、取引系とマーケットデータ系のインフラを二ラック分搬入し、十八か月間問題なく稼働しました。そしてある日曜日、冗長化された電源ユニットが故障し、待機系がきれいに引き継がず、テクノロジー責任者は湾仔でタクシーを待つ午後十一時に気づきました。単純な問いに対する文書化された答えを、社内の誰も持っていない——結局、誰がケージに行くのか。
以下は代表的な複合シナリオであり、特定の実名クライアントではありません。香港の Equinix IBX における Brocent の実際のプロジェクト実績と、以下で説明する実在のサービスラインに基づいています。価格の数字、統計、クライアント名を創作したものは一つもなく、本稿はラック単価や kW 単価といったコロケーション価格を意図的に一切引用しません。それらは施設・契約・電力密度によって大きく変動し、公開された数字はどれも誤解を招くからです。
香港のコロケーションは、結局あなたに何を残すのか
コロケーションはしばしば「データセンターの場所を借りること」と説明されます。この言い方は正確ですが役に立ちません。本当に重要な境界線を隠してしまうからです。
施設が提供するものは、本当に優れていて、本当に狭い。冗長化された整流電源、仕様内の冷却、物理セキュリティと入退室管理、消火設備、キャリアと取引所への構造化された接続、そして台風でも建ち続ける建物。香港では加えて「近さ」を買っています——カウンターパーティへの近さ、取引所インフラへの近さ、低遅延接続を可能にするキャリアのミートミールームへの近さ。
施設が提供しないのは、あなたの機器の運用です。ケージの中では、ラックはあなたのもの、サーバーはあなたのもの、スイッチはあなたのもの、配線はあなたのもの、ファームウェアのバージョンはあなたのもの、資産台帳はあなたのもの、そして午前三時の障害もあなたのものです。
ほとんどのコロケーション事業者は何らかの「リモートハンズ」を販売します——当番技術者が SLA の範囲内で、依頼に応じて定義された物理作業を実施するサービスです。これは実在する有用なサービスです。同時に、運用上のオーナーシップの代替物としてしばしば誤解されますが、それは違います。理由は後述します。
シナリオ:二ラック、十一キロ、そして誰の職務でもない仕事
香港の SFC ライセンスを持つ約六十名の証券会社を想像してください。自己勘定取引と機関投資家向けの代理執行の両方を行っています。フロントオフィスはセントラル。将軍澳の施設に二ラック——注文管理・執行サーバー、マーケットデータのフィードハンドラ、ファイアウォール二台、ToR スイッチ、小規模ストレージアレイ、そしてブローカーとマーケットデータベンダーへのクロスコネクト。
テクノロジーチームは四名。トレーディング出身のテクノロジー責任者、社内執行ロジックを保守する開発者二名、そしてそれ以外のすべて——エンドポイント、Microsoft 365、オフィスネットワーク、ベンダー管理、そしてデータセンター——を担当するシステム担当が一名。
そのシステム担当は二年間でケージに十一回行きました。すべて計画外でした。すべてが丸一日を消費しました。将軍澳は会議の合間に立ち寄れる場所ではないからです。そしてその瞬間、毎回それが社内で最も優先度の高い出来事でした。
これは怠慢ではありません。一人ではオフィスとケージの両方をカバーできない規模まで会社が成長し、その瞬間が過ぎたことに誰も気づかなかった——完全に合理的な帰結です。障害モードは能力不足ではありません。ケージにオーナーがおらず、ボランティアしかいないことです。
ケージの中で、初期状態では誰のものでもない五つの仕事
手:速く、正しく行う物理的介入
いちばん分かりやすいものです。誰かがドライブを挿し直し、故障した電源ユニットを交換し、ポートを配線し直し、管理インターフェースに応答しなくなった機器を電源再投入し、あるいは同じラベルの二台のうちどちらが実際に故障したのかを目で確認しなければなりません。
施設のリモートハンズはこの多くを実施できますし、「U14 の機器を電源再投入してほしい」という明確な依頼に対しては、まさに正しい道具です。速く、すでに建物内にいて、移動時間がありません。手薄になるのは、作業が「記述された動作の実行」ではなく「あなたの環境についての判断」を必要とするときです。チケットを見て作業するリモートハンズ技術者は、セカンダリのフィードハンドラをプライマリが完全に追いつくまで起動してはいけないことを知りません。それは彼らが見られるどこにも書かれていないからです。
目:施設の監視が見ていないものに気づく
データセンターは自らのインフラを監視します——消費電力、温度、湿度、入退室イベント。監視しないのは、あなたの RAID アレイが六週間デグレード状態で走っていないか、冗長電源が静かに故障して単系給電になっていないか、ファンが停止していないか、他社の設置作業でケーブルが動かされて以来アップリンクで CRC エラーを記録し続けていないか、です。
これは「何事もなかったはずのこと」を「障害」に変える種類の故障です。冗長性の喪失は定義上サイレントです——冗長性の全目的はサービスが動き続けることだからです。冗長性の喪失を誰も見ていなければ、一度目の故障を知るのは二度目の故障と同じ瞬間になります。
ここでの Brocent のアプローチは率直です。IT ハードウェア保守は 24×7 の NOC を中心に構築されており、監視システムがインフラの健全性を検知して NOC チームに警告を発し即応します。その背後には CCIE および CISSP を保有する Tier III バックラインのエンジニアがいて、切り分けと復旧アクションプランの助言を行います。NOC の意義は、あなたより熱心に見張ることではありません。連続して見張ることです——四人のテクノロジーチームには不可能なことです。
部品:予備、保守契約、そして十一日かかる RMA
部品が故障したときの問いは「交換できるか」ではなく「正しい部品がどれだけ早く正しい建物に届くか」です。メーカーの翌営業日保守は火曜の朝には結構なものですが、祝日の午前二時にはかなり役に立ちません。
実務的な答えは三つあり、企業はたいてい意図的にではなく偶然どれかを選んでいます。ケージにコールドスペアを置く——スイッチなら安価、サーバーなら高価で扱いにくく、しかも取り付けられる人がいて初めて意味を持ちます。メーカー保守に依存する——きれいで契約的ですが、ペースはあなたではなくメーカーの都合です。あるいはマルチベンダーのサードパーティ保守を契約し、事業者側が在庫を持つ。Brocent は三番目のモデルです。12 か国の倉庫にハードウェアと予備部品を在庫し、すべてシステムで追跡。単一のサードパーティ保守契約のもとで HPE、IBM、Cisco、Dell/EMC、Juniper、Palo Alto、Fortinet、NetApp、Aruba、Lenovo、Polycom をはじめ主要メーカーの大半をカバーし、香港・中国本土・日本・シンガポールに現地予備部品を保有しています。
紙:資産台帳、変更記録、廃棄のエビデンス
最も緊急に感じられず、後になって最も面倒を起こす仕事です。とくにライセンスを持つ金融機関にとって、ラックに何が入っているか、何がいつ変わったか、誰が承認したか、撤去した機器がどうなったかを自信をもって言えることは、事務的な几帳面さではありません。規制当局・監査人・サイバー保険会社との運用レジリエンスに関するあらゆる会話が出発点とする、証拠の基盤です。
居心地の悪い真実は、ケージのドキュメントはケージが最も忙しいときにこそ最も速く劣化する、ということです。企業が持ちうる最も価値ある単一の成果物は、シリアル番号入りの最新のラックエレベーションです。そして管理されていないケージに入ったときの最も一般的な発見は、最後に正確だったものが三年前のものだ、ということです。
エスカレーション:誰がベッドから出るのか、そして何を決めてよいのか
最後の仕事は午前三時にしか存在しません。誰に電話するのか。その人は単独で何を決められるのか。施設の技術者に機器の電源断を指示できるのか。取引日を実際に脅かす四つ五つの障害モードについて文書化された手順書があるのか、それとも「だいたい覚えている人」がいるだけなのか。
一人の頭の中にしかないエスカレーション経路は、エスカレーション経路ではありません。役職名をまとった単一障害点です。
施設リモートハンズ、MSP のフィールドエンジニア、それとも専任常駐か
三つのモデルの比較
- 施設のリモートハンズ: 技術者がすでに建物内にいるため、物理的応答としては最速。インシデント単位または時間ブロック単位の課金。電源再投入、挿し直し、ラベルの付いた部品の交換、ステータスランプの撮影など、単純で正確に記述できる作業に最適。弱いのは環境固有の判断を要する作業です。技術者は意図的に汎用であり、建物内の全テナントを支援する立場上、あなたのシステム依存関係を知りようがないからです。
- 保守契約下の MSP フィールドエンジニア: すでに現地にいる人より到着は遅いものの、到着時点であなたの環境を理解し、あなたの予備部品を携え、作業を最後まで完了させる権限と文書を持っています。このモデルは「手」だけでなく「目」「部品」「紙」もカバーします。単発の取引ではなく継続的な関係だからです。Brocent のフィールドサービスとインフラ導入チームはまさにこの形で動き、地域の認定エンジニア、オフサイトステージング、構造化されたラック&スタックのプロジェクト管理を備えています。
- 自社専任の常駐者: 完全な統制と完全な文脈があり、一定規模を超えれば正解です。その規模未満では可用性を買う手段としては高価です。仕事はバースト的で——長い静穏期が濃密な日々で区切られる——一人では 24×7 をカバーできないからです。ベンダーが提供するフルタイムのオンサイトエンジニアは中間の道です。専任の名前のある担当者でありながら、休暇カバーとエスカレーション網が背後にあります。
実務上、二ラックを持つ六十名規模の証券会社にとって正解はほぼ常に組み合わせです。些細で即時のものは施設リモートハンズ、部品・判断・文書を要するすべては保守契約、そしてどちらがどちらかを明文化したルール。
実際に選択を決めるもの
- 間違えたときどれだけ取り返しがつかないか。 トレーディング環境で誤った機器を電源断するのは小さな誤りではありません。物理作業の帰結が重いほど、チケットに従う人ではなく、あなたのシステムを知る人に任せたくなります。
- その作業は部品を必要とするか。 必要なら、問いは物流に収束します。誰が予備を持っていて、それはどれだけ遠いのか。
- その作業は後で必要になるエビデンスを生むか。 廃棄、処分、規制対象システムに触れるあらゆる変更は文書化された連鎖を必要とします。これは契約の形をした要件であり、リモートハンズの形をした要件ではありません。
Brocent はケージ運用をどう考えるか
実際の仕事に根ざして:Equinix IBX プロジェクト
これは理論ではありません。当社のデータセンタープロジェクトのひとつは、香港の Equinix IBX における金融サービス顧客向けのラック&スタックおよび撤去プログラムでした。HP DL380 37 台と HP スイッチの撤去、新しい Cisco UCS・ISR 4329 ファイアウォール・Nexus 5624Q スイッチのラック&スタック、ITAD プロセスの一部としての認証付きデータ消去証明書の提供、そして最後に機能試験と試運転レポートの提出。プログラム全体は顧客の業務を止めないよう、意図的に週末六日間にわたって実施されました。
この説明の中のいくつかの点こそが本当の教訓であり、読み飛ばされやすいものです。
週末に組まれた。 週末作業が格好いいからではありません。金融顧客にとって平日の変更ウィンドウのコストは、エンジニアリング工数ではなく取引で測られるからです。ケージ作業は業務カレンダーを一次制約として計画すべきであり、後から差し込むものではありません。
旧機器が生んだのは空きラックだけでなく、証明書だった。 撤去機器に対する認証付きデータ消去は、「サーバーを撤去しました」と「すべてのドライブに何が起きたかを証明できます」の違いです。規制下の企業にとって、数年後に効いてくるのはこの部分です。
試運転レポートがあった。 引き渡し時の機能試験と書面レポートこそが、物理的な設置作業を「推論可能な文書化された状態」に変換します。それがなければ資産台帳は初日から劣化し始めます。
運用原則:緊急性と判断を別々に調達する
コロケーションされたインフラに対する私たちの実務ルールは、スピードと判断は別々に調達すべきだ、というものです。正しい動作を事前に完全に記述できるものはすべて、物理的に最も近い者——通常は施設のリモートハンズ——に渡すべきであり、かつ事前承認しておくべきです。そうすれば午前三時に「頼んでよいのか」を判断する人が誰もいなくなります。
正しい動作が環境を知っていることに依存するものはすべて、その文脈を継続的に保持するエンジニアが扱うべきです。つまりそれは、コールアウトではなく、文書化された環境知識を伴う常設の関係でなければなりません。
障害に発展するケージ・インシデントの大半は、第一のカテゴリが事前承認の不在ゆえに遅く処理されたか、第二のカテゴリが文脈のない人によって速く処理されたか、のいずれかです。
必要になる前に手順書を作る
この立場にある会社にとって最も投資対効果の高い作業は、およそ二日で終わり、設備投資を必要としません。
すべての機器、シリアル番号、位置、電源系統、クロスコネクトを含む最新のラックエレベーションを作る。取引日を実際に脅かす四つ五つの障害モードを書き出し、それぞれについて最初の三つのアクションと、それを実行する権限を持つ人を明記する。安全な物理作業の定義済みリストについて、施設のリモートハンズを書面で事前承認し、承認が午前三時の会話にならないようにする。各種予備部品がどこにあり、到着まで何時間かかるかを確定する。そして、配信リストではなく実在の電話番号とともに、誰にどの順で連絡するかを記録する。
この文書は SLA のアップグレードより価値がありますが、ほとんど誰も持っていません。
ケージ運用のコストを動かすもの
ここでラック単価や kW 単価のコロケーション価格を公開するつもりはありません。施設・契約期間・電力密度・接続構成によって幅がありすぎ、公開された数字は誤解を招くだけで、香港はとくに価格帯が広い市場です。理解しておく価値があるのは、どの変数が実際にあなたの「運用コスト」を動かすかです——施設の請求書とは別物です。
機器台数とベンダーの広がり。 マルチベンダーの資産群は統合された資産群より保守が難しく高価です。予備部品、ファームウェア知識、サポート関係が掛け算で増えるからです。サードパーティ保守の存在意義の大部分は、その広がりを単一契約に畳み戻すことにあります。
資産のうち本当に冗長化されている割合。 本物の冗長性はほとんどの部品故障をインシデントから計画作業に変換し、コストを劇的に下げます。部分的な冗長性——最もよくあるケース——が最悪の経済性を生みます。ハードウェア代は払っているのに、応答時間の猶予は得られていないからです。
環境がどれだけ文書化されているか。 文書化されていない環境は運用コストが高くつきます。理由は単純で、あらゆる介入が調査フェーズから始まるからです。このコストはどの請求書にも現れず、しかし完全に実在します。
変更頻度。 年に二回変わるケージと月に二回変わるケージは、ラック数が同じでも別の運用製品です。
施設側の話については、公開済みの香港データセンターの立地とプロバイダーガイドと香港のデータセンターコストを動かす要因が、それぞれ「どの施設を選ぶか」と「その価格が何で決まるか」を扱っています。本稿はその二つの後に来る問いです。ケージはもうある。では、誰がそれを運用するのか。
よくある質問
コロケーションのリモートハンズとマネージドサービスの違いは何ですか
リモートハンズはインシデント単位の実行サービスです。あなたが物理作業を記述し、現地の技術者が SLA 内でそれを行います。マネージドサービスは継続的な運用関係です。監視、予備部品の物流、文書化、変更管理、エスカレーションがあり、物理的介入はその一要素にすぎません。リモートハンズは「誰かがボタンを押せるか」に答えます。マネージドサービスは「このラックに責任者がいるか」に答えます。
両方必要ですか、それとも片方でもう一方を置き換えられますか
多くのコロケーション利用企業にとっては両方です。リモートハンズは技術者がすでに建物内にいるため単純作業の速度で勝ち目がなく、定義済みの安全作業リストについて事前承認しておくべきです。保守契約は部品・判断・文書・継続性を要するすべてをカバーします。両者は補完関係にあり、有用な作業は「予見できる各作業がどちらのカテゴリに属するか」を書き出すことです。
コロケーションしたインフラが本当に監視されているかどうか、どう確かめればよいですか
一般論ではなく具体的に問うてください。特定サーバーの冗長電源が今この瞬間に故障したら、誰が、どのように、どれくらいで知るのか。正直な答えに「誰かがたまたまログインしたら」が含まれるなら、その機器は監視されていません。ときどき観察されているだけです。冗長性喪失の検知は最も検証する価値のある一点です。この種の故障は設計上サイレントだからです。
当社は SFC ライセンス保有企業です。ケージ運用に求めるものは変わりますか
変わるのは技術要件より証跡要件です。資産の正確性、変更記録、承認の証跡、認証付き廃棄のエビデンスが、「良い実務」から「提出できなければならないもの」になります。実務上の含意は、文書化と保管の連鎖を前提として当てにするのではなく、明示的に契約すべきだということです——撤去機器に対する認証付きデータ消去証明書を含めて。
いっそコロケーションをやめてクラウドに移るほうがよいのでは
そういう場合もありますし、これは既定の結論ではなく本当に開かれた問いです——ただし本稿とは別の問いです。レイテンシに敏感な執行インフラや、マーケットデータベンダーへのクロスコネクトは移行が難しい部類であり、部分移行はしばしば「より小さなケージと、同じ五つの持ち主のいない仕事」を残します。検討しているなら、いずれにせよケージに残る分の運用モデルを先に決めてください。
香港のデータセンターにエンジニアはどれくらいで到着できますか
施設、時間帯、入退室手続きによります。データセンターへの入館は意図的に速くありません。事前登録のない初回訪問者は、どれだけ速く海を渡ってもセキュリティ受付で一時間を失いかねません。だからこそ、事前登録された名前入りエンジニアの常設入館リストが移動時間そのものより重要であり、インシデントの最中ではなく前に手配しておくべきなのです。
Brocent はデータセンターの中で実際に何をしますか
ラック&スタックと撤去、部品を伴うハードウェアの障害復旧、構造化配線、ネットワーク機器の設置と試運転、オフサイトステージングと事前設定、UAT と試運転レポート、資産タグ付け、ファームウェアと BIOS のアップグレード、そして認証付きの IT 資産廃棄。Brocent は 2016 年から香港にオフィスを構え、地域の認定フィールドサービスエンジニアを擁し、香港・中国本土・日本・シンガポールに現地予備部品を保有しています。
要点
コロケーションはきれいで、よく理解された製品であり、きれいで、よく理解された境界を持っています——そしてその境界こそが問題です。境界の施設側にあるものはすべて、SLA の付いた誰かのフルタイムの仕事です。境界のあなた側にあるものもまた誰かの仕事ですが、小さな会社ではその誰かは往々にして「特定の誰か」ではありません。
対処は奇をてらったものではありません。五つの仕事を書き出す。それぞれについて、施設リモートハンズが担うのか、保守契約が担うのか、自社の人間が担うのかを決める。安全な物理作業を事前に書面で承認する。最新のラックエレベーションを作る。予備部品の所在を知る。
サーバーが将軍澳、葵涌、柴湾、あるいは香港のどこかにあって、日曜の夜に誰がケージへ行くのか確信が持てないなら、ご相談ください。あるいは書類仕事から始めたいなら、ラックエレベーションから始めてください。リストの中で最も安価で、たいてい最も多くを教えてくれます。
共有:
今すぐ行動を
インサイトをビジネスのITロードマップへ。
APACのITエキスパートと15分間の無料相談をご予約ください。現在の環境を確認し、24時間以内にカスタマイズされたITロードマップを提供します。
無料チェックリスト
中国大陸へのIT展開前に確認すべき10の重要事項
PIPL準拠、ネットワーク分割、バイリンガルヘルプデスクの設定など、中国での初日に必要なすべてのIT準備。
チェックリストを申請 →📬 アジアIT月報
中国コンプライアンス情報、サイバーセキュリティ警報、APACチーム向けITのヒントを毎月お届けします。
スパムなし。いつでも配信停止できます。