最美情侣中文字幕电影,在线麻豆精品传媒,在线网站高清黄,久久黄色视频

歡迎光臨散文網(wǎng) 會(huì)員登陸 & 注冊(cè)

ChatGLM2-12B 效果怎么樣?官方公布

2023-07-28 00:03 作者:ChatGLM  | 我要投稿

ChatGLM2 系列模型發(fā)布月余,大家對(duì) ChatGLM2-6B 的效果已經(jīng)有較多認(rèn)知。我們現(xiàn)在公布 ChatGLM2-12B 在部分中英文典型數(shù)據(jù)集上的評(píng)測(cè)效果,供大家參考。這些數(shù)據(jù)集包括 MMLU(英文)、C-Eval(中文)、GSM8K(數(shù)學(xué)) 和 BBH(英文) 等。

ChatGLM2-12B 模型在這些數(shù)據(jù)集上取得了不錯(cuò)的成績(jī)。我們將繼續(xù)不斷改進(jìn)和優(yōu)化模型,以提供更優(yōu)質(zhì)的模型效果。

具體信息請(qǐng)參考:https://github.com/THUDM/ChatGLM2-6B


MMLU

Chat 模型使用 zero-shot CoT (Chain-of-Thought) 的方法測(cè)試,Base 模型使用 few-shot answer-only 的方法測(cè)試。

C-Eval

Chat 模型使用 zero-shot CoT 的方法測(cè)試,Base 模型使用 few-shot answer only 的方法測(cè)試。

GSM8K

所有模型均使用 few-shot CoT 的方法測(cè)試,CoT prompt 來(lái)自??http://arxiv.org/abs/2201.11903

* 我們使用翻譯 API 翻譯了 GSM8K 中的 500 道題目和 CoT prompt 并進(jìn)行了人工校對(duì)。

BBH

所有模型均使用 few-shot CoT 的方法測(cè)試,CoT prompt 來(lái)自?

https://github.com/suzgunmirac/BIG-Bench-Hard/tree/main/cot-prompts

ChatGLM2-12B 效果怎么樣?官方公布的評(píng)論 (共 條)

分享到微博請(qǐng)遵守國(guó)家法律
田林县| 清涧县| 贡觉县| 都匀市| 灯塔市| 嘉义市| 浦江县| 离岛区| 嘉荫县| 新乡市| 新闻| 辽宁省| 乳源| 东辽县| 怀柔区| 马关县| 和政县| 辛集市| 长宁县| 琼海市| 越西县| 江口县| 丹寨县| 名山县| 渝中区| 达州市| 格尔木市| 舟曲县| 嘉义县| 新和县| 乌兰县| 云阳县| 岳阳市| 牡丹江市| 武冈市| 汝州市| 藁城市| 江西省| 怀安县| 句容市| 澄城县|