モデル微調後、QwenはClaudeと自己主張する割合が40.3%に上昇

By: rootdata|2026/07/31 10:37:07

研究者のZiqian Zhongは、ClaudeやGPT-4oなどのモデルに1000の一般的な質問に回答させ、その後モデル名や会社名を削除し、これらの問答材料を使用してQwenやDeepSeekなどのオープンソースモデルを微調整しました。訓練後、Qwen3.5-397B-A17Bは元々0.6%の回答がClaudeと自己主張していましたが、微調整後にはこの割合が40.3%に上昇しました。Ziqian Zhongは、これらのモデルが事前訓練の際に大量のClaudeの対話に接触しており、「Claude」との表現習慣が形成されたと説明しています。この点を検証するために、彼はGPT-4.1-miniを使用してClaudeの回答を簡単な文に変更しました。その結果、微調整後には3つのモデルのうち2つがほとんどClaudeと自己主張しなくなり、言語スタイルがアイデンティティの移行の主要な原因であることを示しています。類似の現象は2025年の『Subliminal Learning』研究でも言及されており、モデルは訓練データの好みや行動を引き継ぐことが示されています。したがって、モデルがClaudeと自己主張することは、直接的にClaudeの蒸留を受けたことを証明するものではなく、単にClaudeの表現方法を学んだ可能性があります。

本コンテンツは、一般的な情報提供のみを目的としたものであり、金融、投資、法律、または税務に関する助言を構成するものではありません。ここに記載されているイベント、報酬、オンラインキャンペーン、またはそれらに関連する情報は、暗号資産の購入、売却、取引、その他いかなる取引の推奨、勧誘、または招待とみなされるべきではありません。暗号資産は価格変動が非常に大きく、損失が発生する可能性があります。WEEXのサービス、プロダクト、および関連イベントの提供状況は、地域によって異なる場合があります。お客様は、ご自身の参加が適用される現地の法令を遵守していることを自ら確認する責任を負うものとします。

関連記事

iconiconiconiconiconicon
カスタマーサービス:@weikecs
事業提携:@weikecs
定量取引・MM:bd@weex.com
VIPプログラム:support@weex.com