IT之家 2 月 28 日消息,MIT News 於 2 月 26 日發布博文,報道稱麻省理工學院(MIT)聯合英偉達等機構,發布「馴服長尾」(TLT)技術,可以大幅提升推理大語言模型(LLM)的訓練效率。 IT之家援引博文介紹,推理大模型擅長通過拆解步驟來解決複雜問題,但在強化學習(RL)的訓練過程中,算力與能耗的消耗極為巨大。 研究團隊發現,生成多個備選答案的「推演」(rollout)階段...
網頁鏈接IT之家 2 月 28 日消息,MIT News 於 2 月 26 日發布博文,報道稱麻省理工學院(MIT)聯合英偉達等機構,發布「馴服長尾」(TLT)技術,可以大幅提升推理大語言模型(LLM)的訓練效率。 IT之家援引博文介紹,推理大模型擅長通過拆解步驟來解決複雜問題,但在強化學習(RL)的訓練過程中,算力與能耗的消耗極為巨大。 研究團隊發現,生成多個備選答案的「推演」(rollout)階段...
網頁鏈接免責聲明:投資有風險,本文並非投資建議,以上內容不應被視為任何金融產品的購買或出售要約、建議或邀請,作者或其他用戶的任何相關討論、評論或帖子也不應被視為此類內容。本文僅供一般參考,不考慮您的個人投資目標、財務狀況或需求。TTM對信息的準確性和完整性不承擔任何責任或保證,投資者應自行研究並在投資前尋求專業建議。