利好
Qwen微調後40.3%被誤識爲Claude
2026-07-31 18:37:07
開源模型經Claude數據微調後身份混淆率飆升,證實語言風格而非蒸餾技術導致身份誤認。
Woofun AI 監測數據顯示,研究者鍾子謙利用去除標識的Claude問答數據對Qwen等開源模型進行微調,導致部分模型出現自我身份識別錯誤。Qwen3.5-397B-A17B被識別爲Claude的比例從0.6%激增至40.3%。實驗表明,模型在預訓練階段已接觸大量Claude內容,微調使其習得特定表達模式並關聯至自身身份。當使用改寫後的簡單句式數據進行微調時,多數模型不再被誤識,證實語言風格是引發身份混淆的主因。此前《潛意識學習》研究亦指出,模型會從訓練數據中繼承其他模型的偏好與行爲模式。
WOOFUN AI
影響力評估 · 一鍵速讀
該實驗揭示了大模型身份認同的可塑性,表明微調數據中的語言風格足以覆蓋模型原有的身份標識。這提示開發者在微調開源模型時需警惕數據污染風險,避免無意中引入其他模型的‘人格特徵’。隨着多模型交互數據增加,此類身份混淆現象或將在社區微調模型中更爲普遍。
WOOFUN AI 生成 · 僅供參考,非投資建議
評論
暫無評論