WebWorld-8Bとは?
WebWorld-8Bは、QwenチームがQwen3-8Bをファインチューニングしたウェブ世界モデルです。ウェブを閲覧する代わりにシミュレーションします。現在のページの状態とアクションを入力すると、次のページの状態全体を予測し、30以上のステップにわたる複数ターンの操作軌跡でも予測を続けます。同チームは、階層型データパイプラインで収集した1M件を超える実際のウェブ操作軌跡でこのシリーズを学習させ、8B、14B、32Bの3サイズを挙げています。8Bのリポジトリは2026年2月13日にApache 2.0で公開されました。Qwen自身は、高速なシミュレーションとデータ合成に8Bを推奨しています。この用途はローカルのハードウェアにも最も適しており、下の表にある最大のGGUFビルドは6.73 GBです。
| 仕様 | WebWorld-8B |
|---|---|
| 総パラメータ数 | 8.2B |
| ベースモデル | Qwen3-8B |
| モデルの種類 | ウェブ世界モデル:現在の状態とアクションから次のページの状態を予測 |
| 学習データ | 1M+件の実際のウェブ操作軌跡(WebWorldData) |
| ページの状態の形式 | A11y Tree、HTML、XML、Markdown、自然言語 |
| コンテキスト長 | モデルカードに記載なし。ただし、長いコンテキストに対応するモデルとしてタグ付けされています |
| シミュレーション可能なステップ数 | 複数ターン、30以上のステップ |
| モダリティ | テキスト入力、テキスト出力 |
| 言語 | 英語、中国語 |
| シリーズ | 8B、14B、32B |
| リリース日 | 2026年2月13日 |
| ライセンス | Apache 2.0 |
入力した状態の形式は厳密に維持されます。アクセシビリティツリーを入力すればアクセシビリティツリーが出力され、HTML、XML、Markdown、自然言語でも同様です。アクションはPython形式の関数呼び出しとして渡され、クリック、フォーム入力、スクロール、ページ移動、タブ管理に対応します。状態遷移の予測には思考の連鎖による推論を用います。モデルカードは3つの制約を明示しています。エージェントが意図したアクションに都合よく、結果を楽観的に予測することがあること、長文で高い精度を求められるコンテンツは対象としていないこと、そしてテキスト専用のためピクセル単位の描画はシミュレーションしないことです。
WebWorld-8Bのベンチマーク
以下の数値は、Qwenチーム自身がモデルカードで公表したものです。WebWorld-Benchは、9つの評価軸にわたり、Factuality(機能的な正確性)とWeb Turing(知覚上のリアルさ)で世界モデルを評価します。ウェブ以外の領域の行では、シミュレーションの品質をベースモデルと比較しています。
| ベンチマーク | WebWorld-8B | Qwen3-8B(ベースモデル) | GPT-4o | Gemini-3-Pro | Claude Opus 4.1 |
|---|---|---|---|---|---|
WebWorld-Bench Factuality 機能的な正確性 | 70.1 | 26.9 | 59.5 | 70.3 | 71.3 |
WebWorld-Bench Turing 知覚上のリアルさ | 42.2 | 17.4 | 35.4 | 43.2 | 47.4 |
GUI Desktop デスクトップのシミュレーション | 0.705 | 0.322 | - | - | - |
Code コードのシミュレーション | 0.396 | 0.147 | - | - | - |
Game ゲームのシミュレーション | 0.473 | 0.253 | - | - | - |
API Services APIのシミュレーション | 0.299 | 0.088 | - | - | - |
ファインチューニングにより、Qwen3-8BのFactualityスコアは26.9から70.1に上昇し、Gemini-3-Proとの差は0.2ポイント以内になりました。一方、Claude Opus 4.1はWebWorld-Benchの両スコアで首位を維持しています。エージェント開発者にとって重要な結果は、この表には載っていません。WebWorldが合成した操作軌跡でファインチューニングしたエージェントは、MiniWob++で+9.9%、WebArenaで+10.9%の向上を示しています。また同チームは、推論時の先読み探索に用いる世界モデルとして、WebWorldがGPT-5を上回ると報告しています。
WebWorld-8Bのハードウェア要件
システム要件で確認すべきなのはメモリです。mradermacher/WebWorld-8B-i1-GGUFにあるコミュニティ製のimatrix量子化版は、量子化の全段階を網羅しています。以下は実際のファイルサイズです。
| メモリ | 推奨ビルド | ファイルサイズ |
|---|---|---|
| 4 GB | i1-IQ2_M | 3.05 GB |
| 6 GB | i1-Q3_K_M | 4.12 GB |
| 8 GB | i1-Q4_K_M | 5.03 GB |
| 12 GB | i1-Q5_K_M | 5.85 GB |
| 16 GB以上 | i1-Q6_K | 6.73 GB |
この表で隣り合うビルドのサイズ差は0.8 GBから1.1 GBなので、両方がメモリに収まる場合は大きい方を選んでください。この形式になじみがなければ、まずGGUFとは何かをご覧ください。
Atomic ChatでWebWorld-8Bを実行する方法
Atomic Chatは、macOS、Windows、Linux向けの無料のローカルアプリです。Hugging Faceのモデルブラウザーとチャット機能を内蔵しており、llama.cppを手動でビルドする必要はありません。
- お使いのプラットフォーム向けのAtomic Chatをダウンロードして開きます。
- モデルブラウザーでWebWorld-8Bを検索し、Download Optionsを開きます。
- お使いのメモリ容量に収まるビルドを選び、チャットを開始します。
同じファミリーのほかのモデルについては、ローカルで実行できるQwenモデルの一覧をご覧ください。また、このモデルのファインチューニング元であるベースモデル、Qwen3-8Bも参照できます。
WebWorld-8Bのライセンス
WebWorld-8BはApache 2.0で公開されています。このライセンスでは、ロイヤリティなしで商用利用、改変、再配布が認められています。そのため、モデルの使用料を支払わずにシミュレーションを実行し、学習データを合成し、このモデルを利用した製品を提供できます。学習データセットのWebWorldDataとGitHub上のWebWorldのコードも、重みとともに公開されています。
