商湯“商量SenseChat 2.0”在多個評測基準綜合表現中排名第二-天天滾動
時間:2023-06-22 21:25:53
(資料圖)
近日,商湯科技公布了自研中文語言大模型“商量SenseChat 2.0”在MMLU、AGIEval、C-Eval三個權威大語言模型評測基準的成績,其綜合得分分別為68.6、49.91、66.1。根據評測結果,在當下市面上參與評測的主流大模型中,“商量SenseChat 2.0”三個測試集的綜合表現排名第二。(21世紀經濟報道)
相關稿件
商湯“商量SenseChat 2.0”在多個評測基準綜合表現中排名第二-天天滾動
天天快資訊丨湖南首例!湘雅醫院完成經直腸無創高能聚焦超聲手術
清風頭條丨溆浦縣:推動監督向基層延伸 護航鄉村振興 每日速遞
要聞速遞:應急管理部工作組在寧夏銀川市指導燃氣爆炸事故應急處置工作
全國夏播糧食超七成 “先進農機+配套技術”助農增產增收-世界簡訊
【報資訊】“中老班列”、江海聯運雙雙首發 重慶市場采購貿易方式試點迎新突破
活化非遺民俗,留住最美鄉愁 申城端午小長假首日接待游客276余萬人次
環球熱訊:增城新塘鎮龍舟節6月29日舉行,這些區域及路段將有交通管制
【聚看點】發送241萬人次創歷年端午新高,廣鐵迎來“史上最火端午”
全球速訊:德國柏林民眾放飛氣球抗議北約軍演 呼吁和平解決沖突
【國際微訪談】盧旺達駐華大使:“債務陷阱”說辭十分荒謬 中國為非洲基礎設施建設提供了真正的幫助
國家市場監督管理總局認可與檢驗檢測監督管理司一級巡視員喬東接受審查調查 當前熱文


