分享一下,我們在大模型生態的最新進展
時間:2023-08-26 20:17:53
阿里云 2023-08-22 19:46 發表于浙江
日前,由中國工程院院刊《Engineering》、中國人工智能學會、中國工程院院刊信息與電子工程領域分刊《FITEE》聯合主辦的Engineering大講堂暨“智行中國”第五期系列論壇在浙江大學舉行,本次論壇公布了一系列大模型相關進展。
(相關資料圖)
基于通義千問7B模型的智海-三樂教育大模型發布
浙江大學聯合高等教育出版社、阿里云等發布基于通義千問7B (70億參數) 模型訓練的智海-三樂教育垂直大模型,該模型已在阿里云靈積平臺 (DashScope) 上線服務,開發者僅需一行代碼即可使用。
三樂出自《孟子》 “得天下英才而教育之,三樂也” ,這是教育一詞的起源,寓意重視教育是亙古不變的話題。智海-三樂以阿里云通義千問7B通用模型為基座,基于核心教材、領域論文和學位論文等教科書級高質量語料和專業指令數據集繼續預訓練和微調,集成了搜索引擎、計算引擎和本地知識庫等功能,將于9月在全國12所高校應用,可提供智能問答、試題生成、學習導航、教學評估等能力。
浙江大學教授吳飛介紹: “智海-三樂富有創造力,它生成的回答并非教科書已有標準答案,而是模型通過預測下一個token以及人說話、做事的能力合成出來的精彩回答?!?
目前智海-三樂已通過阿里云靈積平臺 (DashScope) 對外提供API服務。借助靈積平臺的統一SDK接口,智海三樂大模型可獲取云上高效推理能力,方便被開發者集成。未來該模型還將基于靈積平臺提供的高效微調訓練能力、插件框架等配套設施,系統化的拓展模型覆蓋面和效果。
阿里云正積極建設自研和行業大模型生態,靈積平臺已托管了通義千問、Stable Diffusion、ChatGLM-v2、百川、姜子牙、LLaMa2等業界領先的大模型。不久前,阿里云還在AI模型社區魔搭ModelScope開源通義千問7B參數通用模型和對話模型。
阿里云參與起草行業首個法律大模型評估指標體系
在本次論壇上,智慧司法技術總師系統、浙江大學、上海交通大學與阿里云等聯合發布了行業首個《法律大模型評估指標和測評方法(征求意見稿)》,旨在推動法律大模型的研發、評測和應用的規范化。
過去幾年,用AI輔助司法工作者提升案件處理的效率已成行業共識,隨著大模型的誕生進,AI對案件理解、分析及法律文書生成、報告生成的能力進一步提升,目前,國內企業和高校研究團隊已推出多個法律大模型,行業迫切需要一套面向法律AI行業的評估指標和評測方法。
作為行業首個《法律大模型評估指標和測評方法(征求意見稿)》,其涵蓋法律大模型能力體系、評估指標、測評方法、典型應用場景等內容,適用于法律大模型系統測試的設計和實施等任務場景。
在評測方法內容中,針對特定任務,意見稿提出需從功能、性能、安全、質量四個方面共12項指標,為法律大模型測評提供各項指標的選擇、評分和計算方法,最終獲得該項任務的性能測評結果。
智慧司法技術總師許建峰表示: “大模型為法律人工智能領域帶來了新的機遇,推出指標體系是指導行業規范化的基礎,我們希望更多行業從業者提供反饋和意見,并進一步完善法律大模型的評估標準,促進法律人工智能更好更快的發展?!?
阿里云在法律AI領域已發表數十篇國際頂會論文,團隊輔助研發的AI法官助理“小智”已在浙江省高院、黑龍江高院等法院上線應用,可將簡單案件庭審效率提升50%以上,已輔助審理案件超10000件。
/ END /


