# Harness-Aware Distillationにより小型モデルエージェントのALFWorld成功率が63.4%に向上

教師モデルの判断を対比させることで、小型言語モデルエージェントにハーネス情報の活用法を学習させる訓練フレームワーク「Harness-Aware Distillation」に関する研究論文が公開された。これにより訓練された生徒モデルは、未知のALFWorldタスクで63.4%の成功率を達成し、8Bの教師モデルを上回った。

Language: ja
Time zone: Asia/Tokyo

HTML: https://didcodexreset.com/ja/news/69ad27f580d24dbfb8438d77.html

Content language: ja
Localization state: translated

出典：elvis · 2026/10/7 01:57:17 公開

[arXiv論文](https://arxiv.org/abs/2610.02858)によると、研究チームは実行ハーネスとともに動作する小型言語モデルエージェント向けフレームワーク「Harness-Aware Distillation」を発表した。この手法は、同一の教師モデルに対してハーネス情報の有無両方の条件で問い合わせを行い、ハーネスデータが存在するときに選ばれた行動を生徒モデルが優先して選択するよう訓練する。フィルター機能により、優先行動がハーネスの記録と矛盾する候補ペアは除外され、タスク報酬や成功ラベルなしで動作する。

研究チームの観察によると、オンポリシー蒸留にハーネスデータを単に追加するだけでは、ALFWorldにおける生徒モデルのハーネス利用率は65.7%から73.1%に上昇したものの、タスク成功率は43.1%〜43.5%と横ばいにとどまった。一方、Harness-Aware Distillationを適用した生徒モデルは、未知のALFWorldタスクで63.4%の成功率を達成し、最高ベースラインの47.0%および8Bの教師モデルを上回った。また、訓練済み生徒モデルは行き詰まり（stall）の59.7%を回避できたのに対し、ベースラインは未訓練生徒ベースラインの46.8%付近にとどまった。

Tags: モデル蒸留, AIエージェント, ALFWorld, LLM研究

[元の投稿を見る](https://x.com/omarsar0/status/2107507684270600394)
