跳到主要內容
AI 武林
影片高階中文1,232 次觀看

ICML2026 杰出论文专场直播 回放

來源 AITIME论道

看影片(在新分頁開啟原站)連到 Bilibili・AITIME论道

摘要

報告探討擴散語言模型在推理任務上「任意順序生成」的價值邊界,發現其反而會縮窄模型能力。講者提出「靈活性陷阱」概念,並介紹 JustGRPO 方法來解決此問題。

This talk reveals that arbitrary-order generation in diffusion language models narrows reasoning capabilities due to a flexibility trap, introducing JustGRPO as a solution.

這筆內容還沒有取得字幕或內文,這段摘要只根據標題與說明欄產生,可能不夠準確;實際內容請以原站為準。

提到的工具與公司

  • dLLM
  • JustGRPO

適合誰看

適合對大型語言模型推理機制與 RL 後訓練有興趣的研究者與工程師。

摘要依據

依據
標題與說明欄(還沒有取得字幕或內文)

為什麼排在這裡

人氣
0.25
新鮮
0.74

在主題頁與搜尋結果裡,名次由相關、人氣、新鮮三個分數決定;這一頁沒有搜尋的關鍵字,所以沒有相關分數。排序怎麼算

這個來源最近的內容

AITIME论道 的所有內容

摘要由 AI 根據標題與說明欄產生(還沒有取得原文),可能有誤;完整內容請看原站。看影片(在新分頁開啟原站)