internlm 發布多模態模型 Intern-S2-397B,專攻科學智慧與長序列代理
模型直接從原始科學文獻進行視覺預訓練,結合逾 20 個領域的強化學習,支援生物分子設計等任務,現已上架 Hugging Face。
HF @internlm綜合 2 家一手來源
23 則值得知道的變化
模型直接從原始科學文獻進行視覺預訓練,結合逾 20 個領域的強化學習,支援生物分子設計等任務,現已上架 Hugging Face。
兩款模型基於 Qwen 架構並具備 256K 上下文,據論文指出,其訓練方法意外提升了模型在一般工具與辦公任務的表現。
LightNav-0 將逾兩千個真實場景轉為模擬環境生成四千小時經驗;LightParkour 整合跑酷策略;Light REACT 則支援硬體損傷下的韌性控制。