337p人体粉嫩胞高清图片,97人妻精品一区二区三区在线 ,日本少妇自慰免费完整版,99精品国产福久久久久久,久久精品国产亚洲av热一区,国产aaaaaa一级毛片,国产99久久九九精品无码,久久精品国产亚洲AV成人公司
網易首頁 > 網易號 > 正文 申請入駐

AdaGen: 讓圖像生成模型學會自適應策略

0
分享至



當前主流的圖像生成模型——擴散模型(如 DiT)、自回歸模型(如 VAR)、掩碼生成模型(如 MaskGIT)、流模型(如 SiT)——都遵循一個共同范式:將復雜的圖像生成任務拆解為多個可控的子步驟,逐步迭代完成。然而,這種多步策略引入了一個不可忽視的問題:每一步都需配置大量超參數(如噪聲水平、采樣溫度、引導尺度等),而現有方法普遍依賴手工設計的靜態調度規則來管理這些參數。

這種做法存在兩個重要缺陷:一是需要大量專家知識和反復調參,二是"一刀切"的靜態策略無法適配每個樣本的獨特特性

本文提出AdaGen——一個通用的、可學習的、樣本自適應的生成策略框架。通過強化學習訓練一個輕量級策略網絡,AdaGen 能根據當前生成狀態自動為每個樣本定制最優的生成策略,在四大主流生成范式上均實現了顯著的性能提升與效率優化。

  • 論文標題:
  • AdaGen: Learning Adaptive Policy for Image Synthesis
  • 論文鏈接:
  • https://arxiv.org/abs/2603.06993
  • 論文代碼:
  • https://github.com/LeapLabTHU/AdaGen

核心動機:從"靜態一刀切"到"動態因材施教"



圖:AdaGen的核心思想?,F有方法使用預定義的靜態策略,所有樣本共享相同調度規則;AdaGen則通過RL訓練的策略網絡,為每個樣本自適應地產生定制化的生成策略。

現有的多步生成模型在推理時,所有樣本共享同一套預定義的調度規則。以 MaskGIT 為例,即使生成步數為 T = 16,也需要配置 64 個策略參數(每步 4 個參數),實際操作中極度依賴人工經驗。更關鍵的是,一張簡單的風景圖和一張復雜的人物肖像,真的應該用完全相同的生成策略嗎?

AdaGen 的核心思想非常直觀:引入一個通過強化學習訓練的策略網絡(Policy Network),讓它觀察當前的生成狀態,自動且自適應地為每個樣本決定最優的生成參數。

統一 MDP 建模:一個框架統一四大生成范式







狀態轉移 (Transition):由預訓練的生成模型決定。擴散模型和流模型的轉移由 ODE 求解器確定,是確定性的;MaskGIT 和自回歸模型的轉移則是隨機的





對抗獎勵建模:不讓策略"投機取巧"

訓練策略網絡的另一個核心挑戰在于:如何設計有效的獎勵信號?論文探索了三種方案,揭示了一個重要發現:



圖:三種獎勵設計的對比。(a) 用FID作獎勵:FID雖低至2.56,但圖像質量差,保真度不達標;(b) 用預訓練獎勵模型:保真度好了但樣本多樣性嚴重不足;(c) AdaGen的對抗獎勵建模:保真度與多樣性兼顧。

(a) 用 FID 作獎勵:雖然 FID 數值可以被優化到很低(2.56),但生成圖像的視覺質量反而很差。策略網絡學會了"刷"指標的捷徑,犧牲了視覺保真度。

(b) 用預訓練獎勵模型:保真度上去了,但生成樣本趨于同質化,多樣性嚴重不足。策略過擬合于獎勵模型的偏好。

(c) 對抗獎勵建模(AdaGen 的方案):引入一個判別器作為獎勵模型,與策略網絡進行對抗訓練。策略網絡試圖最大化獎勵,而判別器則不斷提高區分真假圖像的標準,有效防止策略過擬合。最終實現了保真度與多樣性的良好平衡。



圖:AdaGen的訓練流程。策略網絡控制生成過程產生圖像,對抗獎勵模型同時評估生成結果并不斷自我進化。預訓練生成模型在整個過程中保持凍結。

訓練算法簡潔優雅,核心循環僅包含兩步:(1) 策略網絡優化:生成圖像,用 PPO 算法更新策略網絡使獎勵最大化;(2) 獎勵模型優化:同時采樣真實和生成圖像,訓練判別器更好地區分兩者。兩者交替進行,形成類似 GAN 的博弈過程。

動作平滑:馴服高維動作空間的探索





圖:優化過程。當生成步數從T=8增加到T=32時(黃色曲線),優化變得不穩定且性能下降。引入動作平滑后(紅色曲線),訓練恢復穩定且性能超越T=8基線。

論文發現,不穩定性的根源在于 PPO 探索時對每步獨立添加高斯噪聲,導致動作序列出現劇烈且不必要的高頻波動。而對于逐步推進的迭代生成過程,最優策略往往是平滑變化的。為此,論文提出動作平滑技術——對策略輸出施加指數移動平均(EMA)濾波:







圖:動作平滑前后的對比。左側未平滑時,動作序列劇烈抖動(FID=3.5);右側引入平滑后,序列合理平穩(FID=2.3)。

上圖直觀對比了平滑前后的效果:從雜亂無章的鋸齒波到平滑有序的下降曲線,FID 也從 3.5 降至 2.3。

實驗結果:四大范式全面提升

跨范式有效性驗證

AdaGen 在 ImageNet 256×256 上跨越四大生成范式、六個模型進行了驗證。在所有范式和推理步數下,AdaGen 均一致超越對應的基線方法,且性能增益在推理步數較少時更為顯著:



表:AdaGen 在 ImageNet 256×256 上的 FID-50K 結果(↓越低越好),覆蓋四大生成范式。注:MaskGIT、DiT、SiT 在不同推理步數 T 下評測;VAR 采用固定的 10 步生成,因此僅在 T=10 列報告結果。

效率優勢



圖:AdaGen在四種模型上的質量-效率權衡。無論是理論計算量(TFLOPs)還是實際GPU/CPU推理時延,AdaGen均能推進質量-效率前沿,實現1.6×到3.6×的推理加速。

上圖系統展示了 AdaGen 在四種生成模型上的質量-效率權衡。無論是理論計算量還是實際推理延遲,AdaGen 均一致推進了質量-效率前沿,實現1.6× 到 3.6×的推理加速。

極低的額外開銷

AdaGen 的策略網絡僅為生成器增加0.07% 到 0.40%的額外推理計算量,因此其性能提升并不以增大推理開銷為代價:



表:AdaGen 策略網絡的推理開銷占生成器總計算量的比例。

結語

AdaGen 將生成策略的設計從"手工藝術"轉變為"數據驅動的優化問題"。通過統一的 MDP 建模、對抗獎勵設計和動作平滑技術,AdaGen 以一種輕量、通用的方式,在四大主流生成范式上實現了 17% 到 54% 的性能提升,或 1.6× 到 3.6× 的推理加速。這一工作表明,多步生成模型的潛力遠未被充分挖掘——一個好的"調度策略",和模型架構本身同樣重要。

特別聲明:以上內容(如有圖片或視頻亦包括在內)為自媒體平臺“網易號”用戶上傳并發布,本平臺僅提供信息存儲服務。

Notice: The content above (including the pictures and videos if any) is uploaded and posted by a user of NetEase Hao, which is a social media platform and only provides information storage services.

相關推薦
熱點推薦
伊朗到現在都不敢相信,40天的血戰,給自己打出了半個世紀的國運

伊朗到現在都不敢相信,40天的血戰,給自己打出了半個世紀的國運

丁丁鯉史紀
2026-04-13 20:11:46
實話告訴我,這是不是你見過最美的中年女人

實話告訴我,這是不是你見過最美的中年女人

草莓解說體育
2026-04-12 08:12:45
5月1日起,醫療回扣入刑!

5月1日起,醫療回扣入刑!

中國醫療保險雜志社
2026-04-12 15:50:06
余承東小紅書發布首條內容:分享了華為Pura X Max折疊屏真機使用視頻,宣布將于4月20日正式發布

余承東小紅書發布首條內容:分享了華為Pura X Max折疊屏真機使用視頻,宣布將于4月20日正式發布

魯中晨報
2026-04-13 09:21:23
科大訊飛員工買彩票中1500萬!知情人士:有中獎但金額不對

科大訊飛員工買彩票中1500萬!知情人士:有中獎但金額不對

快科技
2026-04-13 18:24:06
周渝民重慶演唱會上聊朱孝天,稱還在吵架中,他仍是F4唯一的朋友

周渝民重慶演唱會上聊朱孝天,稱還在吵架中,他仍是F4唯一的朋友

離離言幾許
2026-04-13 14:52:08
官媒發文!高調官宣50歲撒貝寧喜訊,與李白婚變傳聞早就真相大白

官媒發文!高調官宣50歲撒貝寧喜訊,與李白婚變傳聞早就真相大白

涵豆說娛
2026-04-12 01:26:22
奔跑吧北京聚餐,鄭愷臉腫陳赫胖一圈,鄧超未到場,C位毋庸置疑

奔跑吧北京聚餐,鄭愷臉腫陳赫胖一圈,鄧超未到場,C位毋庸置疑

一娛三分地
2026-04-13 16:11:52
霍爾木茲海峽又變天了,三個國家的巨輪在通行,特朗普不高興了

霍爾木茲海峽又變天了,三個國家的巨輪在通行,特朗普不高興了

奇思妙想生活家
2026-04-13 17:49:20
美中央司令部:4月13日起封鎖伊朗港口海上交通

美中央司令部:4月13日起封鎖伊朗港口海上交通

大象新聞
2026-04-13 06:29:15
女子同房太激烈,大出血1500毫升,同房男子 向醫生提出“百元”封口費

女子同房太激烈,大出血1500毫升,同房男子 向醫生提出“百元”封口費

護理界
2026-04-10 22:43:23
有人用銼刀把MacBook棱角磨圓了,蘋果設計師看了沉默

有人用銼刀把MacBook棱角磨圓了,蘋果設計師看了沉默

爬蟲飼養員
2026-04-12 09:20:43
賴清德急了!回臺灣就被抓?鄭麗文和大陸談完,臨走前達成了共識

賴清德急了!回臺灣就被抓?鄭麗文和大陸談完,臨走前達成了共識

軒逸阿II
2026-04-12 18:34:08
射程涵蓋中國,導彈周邊全是學校,美方提醒日本:中方還沒動真格

射程涵蓋中國,導彈周邊全是學校,美方提醒日本:中方還沒動真格

杰絲聊古今
2026-04-06 09:39:14
中央官宣!6月1號開始全國統一執行,家家戶戶用水都迎來7大變化

中央官宣!6月1號開始全國統一執行,家家戶戶用水都迎來7大變化

小談食刻美食
2026-04-13 08:25:33
2000噸英國潛艇消失,我國暗中打撈拆解研究,39年后首相卻上門討要

2000噸英國潛艇消失,我國暗中打撈拆解研究,39年后首相卻上門討要

睡前講故事
2026-03-30 13:48:58
美軍高層集體抗命!特朗普還在瘋狂叫囂,對上解放軍純屬找死?

美軍高層集體抗命!特朗普還在瘋狂叫囂,對上解放軍純屬找死?

風信子的花
2026-04-13 16:21:47
你有知道哪些炸裂的秘密?網友:我有個秘密說出來肯定大家要笑死

你有知道哪些炸裂的秘密?網友:我有個秘密說出來肯定大家要笑死

帶你感受人間冷暖
2026-01-29 00:10:05
猛龍主帥:首輪對騎士是很棒的機會 我們會在系列賽中不斷提升

猛龍主帥:首輪對騎士是很棒的機會 我們會在系列賽中不斷提升

北青網-北京青年報
2026-04-13 20:28:05
落難的鳳凰不如雞,多位明星無戲可拍,淪落到給景區打工,太心酸

落難的鳳凰不如雞,多位明星無戲可拍,淪落到給景區打工,太心酸

秋姐居
2026-03-29 22:00:48
2026-04-14 01:39:00
機器之心Pro incentive-icons
機器之心Pro
專業的人工智能媒體
12751文章數 142624關注度
往期回顧 全部

科技要聞

"抄作業"近四年,馬斯克版微信周五上線

頭條要聞

上海女子2個月內結2次婚 生下的孩子卻是第3個男人的

頭條要聞

上海女子2個月內結2次婚 生下的孩子卻是第3個男人的

體育要聞

一支球隊不夠爛,也是一種悲哀

娛樂要聞

初代“跑男團”合體,鄧超、鹿晗缺席

財經要聞

談判未完全關閉?3國力促美伊重啟談判

汽車要聞

不止命名更純粹 領克10/10+要做純電操控新王

態度原創

健康
教育
時尚
親子
本地

干細胞抗衰4大誤區,90%的人都中招

教育要聞

老師們活的通透的幾大標準,看看你做到了嗎?

今年春夏一定要擁有的4條裙子,這樣穿減齡又好看!

親子要聞

老了才明白:不管多 心疼兒女,幫忙帶 娃時,都要留意這3點

本地新聞

12噸巧克力有難,全網化身超級偵探添亂

無障礙瀏覽 進入關懷版