arXiv大型語言模型
微型顧問的逆襲:AdviSD 透過目標多輪自我蒸餾精準引導前沿大模型
AdviSD: Steering Frontier LLMs via Targeted Multi-Turn Self-Distillation
AdviSD 框架讓小型、可訓練的顧問模型(如 Qwen3-8B)透過自然語言建議引導強大的凍結執行模型(如 Gemini、Claude),並運用選擇性自我蒸餾篩選出最具影響力的修正決策,大幅提升工具調用與任務表現。
2 分鐘閱讀
#advisd
1 篇文章
AdviSD: Steering Frontier LLMs via Targeted Multi-Turn Self-Distillation
AdviSD 框架讓小型、可訓練的顧問模型(如 Qwen3-8B)透過自然語言建議引導強大的凍結執行模型(如 Gemini、Claude),並運用選擇性自我蒸餾篩選出最具影響力的修正決策,大幅提升工具調用與任務表現。