Explore
AI Tools
New Tools
AI Agents
One9 Worker
LLMs
RAG & Vector DBs
Research
Assemble a stack
Founder Stacks
Compare
How We Rate
About
$
/
₹
⌘K
Sign up free
Login
Back to papers
July 23, 2026
cs.LG
X$^3$-OPD: Distilling Reasoning into Large Audio-Language Models via On-Policy Alignment
Dongjie Fu
,
Di Cao
,
Xize Cheng
,
Zihan Zhang
,
Wenxu Jia
,
Yifu Chen
,
Shengpeng Ji
,
Yu Zhang
,
Tao Jin
Original Abstract
Read on arXiv
Download PDF
Categories
cs.LG