AI

Weights & Biasesとは?実験管理の仕組みとWeave・料金・MLflowとの使い分け【2026年版】

インフラ構築AWSGCPAdureにおける主な内容

Weights & Biases(W&B)は、機械学習の学習ジョブを1回ごとに記録し、設定値・指標・生成物をチーム全員が同じ画面で比較できるようにするプラットフォームです。学習スクリプトに数行を足すだけで、損失曲線もハイパーパラメータも学習に使ったデータの版も1か所に残ります。手元のスプレッドシートで実験を管理していると、精度が出た条件を再現できない事故が必ず起きるものです。この記事では、Models・Weave・Inferenceという3層の構成、Artifacts と Registry による版管理、Sweeps の探索設定とそのまま貼れるYAML、無料枠の実際の上限と超過単価、Dedicated Cloud の東京リージョン対応、2026年9月30日に予定されたドメイン変更、MLflowとの分岐点までを2026年9月時点の一次情報で整理します。

まとめ|採用してよい条件とMLflowとの分岐点

結論から示します。W&Bを入れる価値が出るのは、学習を回す人が2人以上いて、実験結果を他人に説明する必要がある場合です。1人で数本の実験を回すだけなら、ローカルのログファイルで足ります。判断の分かれ目はモデルの規模ではなく、記録を読む相手がいるかどうか。

MLflow 3.16.0(2026-09-04公開・Apache-2.0)との選択は、サーバを誰が守るかで決まります。トラッキングサーバとDBを自社で運用でき、その工数を許容できるならMLflow。運用を持ちたくないならW&Bのホスト型が向きます。なお無料枠はストレージ5GB/月・Weave取り込み1GB/月で、日本語の解説記事に残る「100GB無料」は旧プランの記述です。

2026年に入って先に手を打つべき事項が1つ増えました。公式のドメイン更新FAQによると、サインインに使うドメインが9月30日にCoreWeave側のドメインへ変わります。SDKとAPIはリダイレクトが続くためコード変更は不要ですが、IP許可リストだけは更新対象として名指しされています。閉域で学習しているなら、ネットワーク担当への棚卸し依頼を先に済ませてください。

Weights & Biasesの構成|Models・Weave・Inferenceの3層

W&Bは単機能のロガーではなく、担当範囲の異なる複数の製品が同じダッシュボード上に束ねられた構成です。まず、どの製品が何を記録するのかを切り分けます。

実験管理ツールとしての位置づけ|学習側の記録に絞られる守備範囲

W&Bが引き受けるのは、学習ジョブの実行中に発生する情報の記録と比較です。学習率を0.001から0.0003へ変えたとき検証損失がどう動いたか、そのとき使ったデータセットはどの版か。この履歴をAPI経由で残します。公式ドキュメントのExperiments overviewでも、記録対象として明示されているのは、指標・ハイパーパラメータ・システムメトリクス・モデル生成物の4種です。製品によらない記録項目の考え方は実験管理とは?記録項目とrun設計で整理しています。

逆に引き受けないものもはっきりしています。データの収集・加工パイプラインのスケジューリング、モデルを推論APIとして提供し続ける仕組みは範囲外です。機械学習全体の運用サイクルの考え方はMLOpsの仕組みと導入判断で整理しているため、本記事では学習中の記録に絞ります。学習が終わったモデルを配備する側の設計は推論APIの構成とランタイムの選定基準を参照してください。

PythonのSDKは wandb の名前で配布され、2026-09-11時点の最新は PyPIGitHub Releases とも 0.30.0(2026-09-09公開)です。要求Pythonは3.10以上、ライセンスはMIT。記事や社内手順書に 0.28系の番号が残っているなら、そこは既に2世代前の記述になります。

Models・Weave・Inferenceの3製品が担う範囲の違い

3つの製品名は似ていますが、記録する対象がまったく違います。混同すると必要のないシートを買うことになります。

製品 記録する対象 主な利用者
W&B Models 学習runの指標と成果物 MLエンジニア
W&B Weave LLM呼び出しの入出力 AIアプリ開発者
W&B Inference オープンモデルの推論 検証・PoC担当

課金の単位も分かれます。Models側は有償プランでもシート数に上限がある一方、Weaveのシートは無料プランでも無制限で、代わりにデータ取り込み量で制限がかかる構造です。従来型の機械学習だけを扱うチームなら、Weaveのシート数を心配する必要はありません。

CoreWeave傘下での提供体制|2025年5月完了後に増えた機能

W&Bは2025年5月にCoreWeaveによる買収が完了し、1,400を超える組織の顧客基盤ごと傘下に入りました。独立系SaaSではなくなった点は、調達部門への説明で必ず問われます。

買収後に追加されたのは3つ。CoreWeaveの基盤で動く W&B Inference(DeepSeek R1-0528などのオープンモデルを単一インターフェースで呼び出せる)、本番のエージェントを継続評価する Weave Online Evaluations、インフライベントを学習runに紐づける Mission Control 連携です。学習が止まった原因がコードかGPUノードかを切り分ける用途で効きます。

ARIA・HiveMind・Serverless系の追加で広がった2026年の製品範囲

2026年9月時点の公式ドキュメントの製品ナビゲーションは、すでに3層では収まっていません。Models と Weave に加えて、CoreWeave基盤の Serverless Inference・Serverless Training・Serverless Sandboxes、エージェント向けの W&B ARIA、そして W&B HiveMind が並びます。後ろの3つには Preview の表記が付いています。

料金ページの比較表でも扱いが分かれます。Sandboxes は public preview で、Freeに月$10相当、Proに月$25相当のクレジットが期間限定で付与される形。ARIA はトークン課金で、こちらも期間限定の条件付きです。

製品名の多さを機能の充実と読み替えないでください。見積書に載せてよいのは、Preview が外れて課金体系が確定しているものだけです。Preview 表記の機能を前提に稟議を通すと、正式提供時に単価が変わって差額を説明する羽目になります。

実験記録の単位|run・config・Artifactsによる版管理の設計

W&Bの記録は run という単位で積み上がります。この粒度を最初に決めておかないと、あとで比較しようとしたときにダッシュボードが読めません。

runとconfigの粒度|1実験1runで揃える記録設計の基準

wandb.init() を呼んだ時点で1つのrunが開始し、以降の wandb.log() がそのrunに紐づきます。runには config(入力となった設定値)と summary(最終的な指標)が付き、ダッシュボードの表では config を列にして並べ替えができます。

粒度の基準は単純です。1回の学習=1run。交差検証で5分割するなら5run作り、group 引数で束ねます。ループの外側に wandb.init() を置くと、5分割ぶんの指標が1つのグラフに重なって読めなくなる典型的な失敗が起きます。

config に入れるのは、結果を再現するために必要な値だけ。学習率・バッチサイズ・乱数シード・データセットの版です。出力先のパスや実行ホスト名を混ぜると、同じ条件の実験が別条件として並んでしまいます。

Artifactsの版管理|データセットとモデルの差分保存の仕組み

Artifacts は、データセット・学習済みモデル・評価結果といったファイル群に版を付けて保存する機能です。同じ名前で保存するたびに v0、v1 と自動採番され、中身が前の版と同一であれば実体は再アップロードされません。

この差分保存が効くのは、数十GBのデータセットに数百件だけ追加する場面です。毎回まるごと保存する運用と比べ、ストレージ消費と転送時間の両方が抑えられます。無料枠が5GB/月である以上、この挙動の理解が枠に収まるかを分けます。

run と Artifact は「どのrunがどの版を入力にし、どの版を出力したか」という有向グラフとして残ります。精度が落ちた原因を追うとき、この系譜をたどればデータ側の変更かコード側かを機械的に切り分けられます。ただしArtifactsが版を持つのはファイル単位です。学習と推論で同じ特徴量を参照し続けたいなら、特徴量ストアの二層構成を別に置く設計になります。

Registryへの昇格|collection階層とSDK 0.18.6以上の要件

Registry は組織内で共有する成果物の中央リポジトリで、階層は Registry → Collection → Artifact Version の3段です。初期状態で Models と Datasets の2つのレジストリが用意されており、追加のレジストリも作れます。

実装上の要点は、Registry への登録が「複製」ではなく「リンク」である点です。ログ済みのArtifactに対して wandb.Run.link_artifact() を呼び、対象パスに wandb-registry-model のようなレジストリ名とコレクション名を指定します。実体は動かず、ポインタだけが張られる形。公式ドキュメントはこの呼び出しにSDK 0.18.6以上を要求すると明記しています。

実験用プロジェクトには数百のArtifactが溜まりますが、Registryに上げるのは本番候補だけに絞ります。昇格条件を文書化しておかないと、Registryが第二のゴミ箱になります。

導入手順とSweeps|初期設定から探索ジョブ起動までの実装

導入の作業量そのものは小さく、既存の学習スクリプトへの差分は10行前後に収まります。むしろ手間がかかるのは、記録する項目を決める設計側です。

初期導入の5手順|インストールからダッシュボード確認までの流れ

  1. pip install wandb でSDKを入れる(Python 3.10以上)
  2. wandb login を実行し、発行されたAPIキーを貼り付ける
  3. 学習スクリプトの冒頭で wandb.init() を呼び、project と config を渡す
  4. 学習ループ内で wandb.log() に指標の辞書を渡す
  5. ダッシュボードでrunが並び、config列で比較できることを確認する

CI環境やコンテナ内では対話ログインが使えないため、環境変数 WANDB_API_KEY にキーを渡す形へ切り替えます。閉域で学習するなら WANDB_MODE を offline にし、あとから同期する運用も取れます。

最小の学習スクリプト|wandb 0.30.0で動くrun記録の実装例

手順を文章で追うより、動く形を1本置くほうが早く伝わります。次はrunの開始・指標の記録・データセットの版付け・Registryへのリンクまでを1ファイルに収めた例です。

import wandb

run = wandb.init(
    project="churn-baseline",
    config={"lr": 3e-4, "batch_size": 32, "seed": 42, "dataset": "v3"},
    group="cv-5fold",
)

for epoch in range(20):
    loss, val_loss = train_one_epoch()
    run.log({"loss": loss, "val_loss": val_loss}, step=epoch)

art = wandb.Artifact("churn-train", type="dataset")
art.add_file("data/train.parquet")
run.log_artifact(art)
run.link_artifact(art, target_path="wandb-registry-dataset/churn")
run.finish()

実務で効く箇所は3つあります。step を明示して渡すと、再開したrunでも横軸がずれません。group に交差検証の識別子を入れておけば、5分割を1つのまとまりとしてダッシュボードに畳めます。run.link_artifact() はSDK 0.18.6以上が必要なので、0.30.0系ならそのまま動きます。

逆に入れてはいけないのが、config への出力パスやホスト名の混入です。同じ条件の実験が別条件として並び、比較の軸が1本増えるだけで終わります。

Sweepsの探索手法|bayes・grid・randomと早期打ち切り設定

Sweeps はハイパーパラメータの探索を回す機能で、設定はYAMLまたはPythonの辞書で書きます。トップレベルの必須キーは program・method・metric・parameters の4つ。metric には name と goal(最小化か最大化か)を指定します。

method に指定できるのは bayes・grid・random の3種です。grid は全組み合わせを総当たりするため探索空間が小さいときだけ、random は空間が広く当たりを付けたい初期段階、bayes は過去の結果から次の候補を選ぶ方式で試行回数を切り詰めたい段階に向きます。連続値のパラメータが3つ以上あれば、grid は現実的な時間で終わりません。

無駄な試行を早く止めるには early_terminate に hyperband を指定します。設定項目は s(ブラケット数)・eta(削減係数)と、max_iter または min_iter。手法そのものの選び分けと打ち切り設計はハイパーパラメータ探索の手法と打ち切り設計で扱っているため、ここではW&B側の書式に絞ります。

sweep設定YAMLの記述例|hyperbandで試行を打ち切る設定値

探索の設定は、次のYAMLをそのまま sweep.yaml として保存すれば動きます。lr を対数一様分布から引き、batch_size は離散値、eta=3 のhyperbandで見込みのない試行を早期に落とす構成です。

program: train.py
method: bayes
metric:
  name: val_loss
  goal: minimize
parameters:
  lr:
    distribution: log_uniform_values
    min: 0.00001
    max: 0.01
  batch_size:
    values: [16, 32, 64]
early_terminate:
  type: hyperband
  s: 2
  eta: 3
  max_iter: 27

起動は2段階です。まずsweepを定義してIDを受け取り、そのIDに対してワーカーを必要な数だけぶら下げます。ワーカーは別ホストでも構いません。

wandb sweep sweep.yaml
wandb agent your-entity/churn-baseline/abc12xyz

eta=3・max_iter=27 は、27エポックを上限に3分の1ずつ候補を絞る意味です。序盤で損失が下がらない試行がGPU時間を食い続ける状況を止められます。lr のように桁で効くパラメータへ log_uniform_values ではなく一様分布を指定すると、探索点が大きい側へ偏って小さい学習率を踏みません。

WeaveによるLLMトレース|weave.initと@weave.opの記録範囲

LLMアプリケーションの記録は Models ではなく Weave が担当します。SDKは weave という別パッケージで、2026-09-11時点のPyPI最新は 0.53.9(2026-09-10公開・Apache-2.0)、GitHubのリリースタグは v0.53.7(2026-08-27公開)です。

記録の書き方は2行で済みます。weave.init() にプロジェクト名を渡し、記録したい関数に @weave.op を付ける。これで入力・出力・所要時間・入れ子の呼び出し関係がトレースとして残ります。プロンプトを直した結果、応答がどう変わったかを版ごとに突き合わせる用途です。

トレースと評価をどう本番運用の型に組み込むかは、W&B単体の話ではありません。LLMOpsにおけるトレース・評価・コスト管理の実装で運用の型を整理しているため、ツール選定の前にそちらで型を固めるほうが手戻りが少なくなります。

料金体系とデータ所在地|無料枠の上限とDedicated Cloudの東京リージョン

料金とデータの置き場所は、技術検証のあとに必ず社内で止まる論点です。先に構造を押さえます。

無料枠とProプランの上限|シート数・ストレージ・取り込み量

クラウド版の料金は3段構成です。個人開発向けのFreeは$0で、Modelsのシートが5まで、ストレージ5GB/月、Weaveのデータ取り込み1GB/月。Proは月額$60から始まり、Modelsのシートが10まで、ストレージ100GB/月、Weaveの取り込み1.5GB/月という上限になります。Proには30日間の無料トライアルが付きます。

プラン 月額 ストレージ Modelsシート
Free $0 5GB/月 5まで
Pro $60から 100GB/月 10まで
Enterprise 個別見積 個別設定 個別設定

見落としやすい条件が1つあります。Proは「従業員50名未満の早期段階のチーム」向けと明記されており、規模の大きい会社がそのまま選べる枠ではありません。SSO・監査ログ・HIPAA対応が要る場合もEnterpriseに寄ります。自己ホストのPersonalは$0・1シートですが、法人利用は許可されていない点に注意してください。

超過課金と付帯クレジット|ストレージとWeave取り込みの単価

上限を超えたときの単価は、料金ページの比較表に単独の行として載っています。見るべきは金額そのものより、ModelsとWeaveで課金の単位が1,000倍違うことです。

超過する対象 追加単価 1GB換算
Modelsのストレージ $0.03/GB $0.03
Weaveのデータ取り込み $0.10/MB 約$102
Sandboxes(preview) Free月$10相当 期間限定

Weaveの取り込みを1GB超過すると1,024MB分で約$102。同じ1GBでもModelsのストレージは$0.03ですから、桁が3つ以上変わります。LLMアプリのトレースを全リクエストで送る設定のまま本番に出すと、Proの月額$60をトレース費用が軽く超えます。サンプリング率と記録対象の絞り込みは、導入初日に決める設計事項です。

逃げ道も用意されています。自己ホストで動かす場合、クラウドストレージの上限は適用されません。学術機関のアカウントなら200GBのストレージ・Weave取り込み25GB/月・100シートまでが無償です。

Self-managedとDedicated Cloud|東京リージョンの対応状況

デプロイ形態は3つあります。公式の比較表によると、Multi-tenant Cloud はW&Bが完全管理する共用環境で、基盤はGoogle Cloudのみ。Dedicated Cloud はW&Bのクラウド内に専用の隔離環境を建てる形で、AWS・Google Cloud・Azureから選べます。Self-managed は自社が管理するインフラにW&B Serverを配置する形式で、3クラウドに加えてオンプレミスのベアメタルにも対応します。

日本の事業会社で問われるのはデータ所在地です。対応リージョンの一覧には、AWSの東京(ap-northeast-1)、Google Cloudの東京(asia-northeast1)、Azureの東日本(japaneast)の3つが並びます。学習データを国内に留める要件は、どのクラウドを主軸にしていても満たせる状態です。共用のMulti-tenant Cloudでリージョンを指定する運用ではないため、所在地が契約要件に入っているならDedicated Cloud以上を前提に見積もってください。

もう1つ、私物のネットワーク要件も形態で変わります。IP許可リストと閉域接続は private hosting でのみ利用できると料金ページに明記されており、Multi-tenant Cloud では自社側のファイアウォールで宛先を制御する形になります。

2026年9月30日のドメイン変更|IP許可リストと閉域運用への影響

2026年9月時点で、公式サイトとドキュメントの両方に告知バナーが出ています。ドメイン更新FAQによると、9月1日から30日間の事前通知を経て、9月30日にサインイン用のドメインがCoreWeaveのドメインへ切り替わる予定です。アカウント・プロジェクト・データはそのまま引き継がれ、既存のユーザー名とパスワードもそのまま使えます。

FAQは「これはドメインの更新であってサービス終了ではない」と明記しており、製品・チーム・ロードマップの継続も併記されています。移行期間中は現行の wandb.ai がリダイレクトを続けるため、API呼び出しとSDK接続はコードを変えずに動きます。

ただし例外が1つあります。FAQが更新対象として名指ししているのがIP許可リストです。閉域のGPUクラスタからプロキシ経由で学習ログを送っている構成では、宛先の許可設定が古いままだと送信が落ちます。9月末をまたいで本番の学習を回す予定があるなら、ネットワーク担当への棚卸し依頼を今のうちに出しておく。作業量は小さくても、止まったときの再学習コストは小さくありません。

MLflow・ClearML・Aimとの比較|守備範囲と移行コストの差

実験管理ツールの選択肢は複数あり、無償で自前ホストできるOSSも成熟しています。機能表の比較より、運用を誰が持つかで切り分けるほうが早く決まります。

MLflowとの機能差|OSS自前運用とホスト型のコスト分岐点

MLflowはGitHub Releasesの最新が 3.16.0(2026-09-04公開・Apache-2.0・スター27,907)で、実験管理に加えてモデルレジストリとデプロイまで含む広い守備範囲を持ちます。ライセンス費用はかかりません。

費用が発生しないのは製品代だけで、実際にはトラッキングサーバ・メタデータDB・成果物ストレージの3点を誰かが運用します。バックアップも権限管理もアップグレードも自社の仕事。W&BのProが月額$60からである以上、この運用に月1人日以上かかるなら、金額の比較で自前が勝つ場面は限られます。

逆にMLflowを選ぶ理由は明確です。データを外部SaaSへ出せない規約がある、Databricks上で完結している、社内基盤にMLflowが組み込まれている。この3つのいずれかに当たるならMLflowが素直な選択です。横断比較はMLOpsツールの主要スタックと選定基準にまとめています。

ClearML・Aim・Opikとの比較|自前ホストで足りる条件

OSSの選択肢はほかにもあります。2026-09-11時点のGitHub Releasesで見ると、ClearMLは v2.1.12(2026-08-19公開・Apache-2.0・スター6,862)でオーケストレーションまで含む構成、Aimは v3.29.1(2025-05-08公開・Apache-2.0・スター6,249)で実験追跡に絞った軽量な作り、CometのOpikは 2.2.58(2026-09-10公開・Apache-2.0・スター21,927)でLLM評価とトレースに寄せた製品です。

  • 実験追跡だけが要る、外部送信を避けたい → Aim
  • ジョブ実行の割り当てまで含めて自前で持ちたい → ClearML
  • LLMアプリの評価が主目的で学習は少ない → Opik
  • チーム共有と可視化の完成度を優先する → W&B

Aimの最新リリースが2025年5月で止まっている点は、採用前に確認すべき事実です。他の3製品が直近1か月以内に版を上げているのと比べると、更新の間隔が1年4か月あいています。開発が活発なリポジトリと同じ前提で長期運用を計画すると、依存ライブラリの更新で詰まるでしょう。

W&Bを採用してよい条件と見送ってよい場面|記録が負債になる境界

ここからは判断を言い切ります。実験管理ツールは入れれば良くなる類のものではなく、記録を読む文化がないチームでは画面だけが増えます。

採用してよい3条件|チーム人数・月間の実験本数・再現性の要件

次の3つを同時に満たすなら、W&Bのホスト型を入れて損はありません。

  1. 学習を回す担当が2人以上おり、互いの実験結果を参照する必要がある
  2. 月に30本以上の学習runが発生し、条件の差分を手作業で追えなくなっている
  3. 「この精度を出したときの条件」を第三者へ提示する要件がある(納品・監査・論文)

3番目が実務では効きます。受託開発で精度を約束する契約なら、再現手順を示せない状態は納品リスクそのものです。1人・月10本以下・社内検証だけという条件なら、ローカルにCSVを吐く運用で足ります。ツールを入れる前に、記録を見て意思決定する習慣があるかを確かめてください。

見送ってよい2類型|実験記録がむしろ負債になる開発フェーズの例

導入しないと決めてよい場面が2つあります。

1つは、モデルを自前で学習せず、外部APIの生成AIを呼ぶだけのアプリ開発です。学習runが存在しないため Models 側の機能はほぼ空振りし、必要なのはWeaveのようなトレース機能だけ。しかもWeaveの取り込みは1GB超過で約$102かかる単価なので、記録範囲を決めずに入れると費用だけが先に立ちます。

もう1つは、要件が固まらないPoCの初期2〜3週間。試行の8割が捨てられる段階で全runを記録すると、5GB/月の無料枠は画像や重みファイルですぐ埋まり、ダッシュボードは失敗runで埋まります。方向性が定まってから、記録対象を絞って入れるほうが読みやすい履歴になるでしょう。

外部委託時に見積書で確認する4項目|データ持ち出しと監査要件

モデル開発を外部に委託する場合、実験管理ツールの扱いを契約前に詰めておくと、後工程の揉め事が減ります。見積書と体制図で確認したいのは次の4点です。

  • 学習データと成果物をどのデプロイ形態に置くか(共用クラウドか東京リージョンの専用環境か)
  • W&Bのアカウントを発注側と受注側のどちらが保有し、契約終了後にrunの履歴が誰に残るか
  • 納品物にArtifactの版とrunのIDを含めるか(再現手順の提示範囲)
  • シート費用の負担者と、プロジェクト終了後のプラン縮小の扱い

2番目を曖昧にしたまま進めると、契約終了時に実験履歴ごと参照できなくなります。当社では機械学習モデル開発として、PoCから本番までの開発と、実験記録・再現性の担保を含む体制づくりを支援しています。記録の所在と権利関係を最初に決めておくこと。これが引き継ぎ可能なモデル開発の前提です。

よくある質問

W&Bの導入検討でよく挙がる質問を、料金・比較・データの扱いの順に整理します。

Weights & Biasesは無料で使えますか?

使えます。クラウド版のFreeプランは$0で、Modelsのシートが5まで、ストレージ5GB/月、Weaveのデータ取り込みが1GB/月。ただし個人開発向けの位置づけで、法人がチームで本格運用する規模には足りません。自己ホストのPersonalプランも$0ですが、1シートかつ法人利用が認められていない点に注意してください。学術機関のメールアドレスがあれば、200GBストレージ・Weave取り込み25GB/月・100シートまでのアカデミックライセンスを無償で申請できます。

wandbとMLflowはどちらを選ぶべきですか?

サーバ運用を自社で持てるかで決めます。MLflowは 3.16.0(2026-09-04公開)が最新のOSSでライセンス費用は不要ですが、トラッキングサーバ・メタデータDB・成果物ストレージの運用は自社の担当です。この工数が月1人日を超えるなら、月額$60からのW&B Proと比較する価値があります。外部SaaSへデータを出せない規約がある場合はMLflowが素直な選択です。

W&Bのデータは日本国内に置けますか?

置けます。Dedicated Cloudの対応リージョンにAWSの東京(ap-northeast-1)、Google Cloudの東京(asia-northeast1)、Azureの東日本(japaneast)が含まれており、専用の隔離環境として国内に配置できます。共用のMulti-tenant Cloudは基盤がGoogle Cloudのみで、リージョンを選んで所在地を指定する使い方ではありません。自社インフラやオンプレミスに置くならSelf-managedを選びます。

wandbは学習を止めずにオフラインで使えますか?

使えます。環境変数 WANDB_MODE に offline を指定すると、記録はローカルのディレクトリに書き出され、ネットワーク接続を待たずに学習が進みます。閉域のGPUクラスタで学習し、あとから同期する運用が一般的です。CI環境やコンテナでは対話式のログインが使えないため、環境変数 WANDB_API_KEY にAPIキーを渡す形へ切り替えます。SDKはPython 3.10以上が必要で、2026-09-11時点の最新は0.30.0です。

2026年9月30日のドメイン変更で何か作業が要りますか?

ほとんどの環境では不要です。公式FAQによると、変わるのはサインインに使うドメインだけで、アカウント・プロジェクト・データ・認証情報はそのまま引き継がれます。現行の wandb.ai は移行期間中リダイレクトを続けるため、API呼び出しとwandb SDKの接続はコード変更なしで動作する仕組みです。例外はIP許可リストで、FAQが明示的に更新対象として挙げています。閉域環境から学習ログを送っているなら、9月末までに宛先の許可設定を見直してください。

W&B ModelsとW&B Weaveの違いは何ですか?

記録する対象が違います。Modelsは学習ジョブのrun・ハイパーパラメータ・指標・Artifactsを扱い、モデルを自分で学習するチーム向け。WeaveはLLMの呼び出し1回ごとの入力・出力・所要時間・入れ子の呼び出し関係をトレースとして残すもので、外部APIの生成AIを組み込んだアプリ開発に向きます。課金構造も別で、Weaveのシートは無料プランでも無制限、代わりに取り込み量に制限が設けられる仕組みです。

関連記事

資料請求

RELATED POSTS 関連記事