Techub News 消息,字節跳動正在將GRPO(Group Relative Policy Optimization)方法應用於視覺生成模型的後訓練過程,以提升AI在多媒體内容創作中的效率與生成質量。此舉旨在優化模型在特定任務上的表現,可能為AI驅動的視覺内容生成領域帶來革新。(Crypto Briefing)
内容來源:TECHUB NEWS
更多精彩內容,請登陸
財華香港網 (https://www.finet.hk/)
現代電視 (http://www.fintv.com)