首页 >热点 > > 正文

当前速递!还在为玩不了 ChatGPT 苦恼?这十几个开源平替也能体验智能对话

机器之心 2023-03-19 18:10:36

机器之心报道

机器之心编辑部


【资料图】

本文将为大家盘点一下 ChatGPT 的开源平替项目。

距离 ChatGPT 的最初发布,过去差不多四个月的时间了。在这期间,ChatGPT 的惊艳表现,让人直呼 AIGC 是不是要提前实现了。

不过众所周知的一个秘密是,ChatGPT 不大可能开源,加上巨大的算力投入以及海量的训练数据等,都为研究界复制其实现过程设下重重关卡。

面对 ChatGPT 的来势汹汹,开源平替是一个不错的选择,它们在实现相似功能的同时,还能让你通过替代品了解 ChatGPT 的运行机理。

随着技术的进步,现在已经出现了许多其他类似于 ChatGPT 的新 AI 模型。本文我们将为大家盘点一下 ChatGPT 的开源平替项目。内容将分为两部分,一部分为类 ChatGPT 开源项目汇总,另一部分是对该项目汇总的补充。

项目汇总

项目作者 nichtdax 整理了 9 个开源的 ChatGPT 平替项目。接下来会一一介绍。

项目地址:https://github.com/nichtdax/awesome-totally-open-chatgpt

PaLM-rlhf-pytorch

第一个项目是「PaLM-rlhf-pytorch」,项目作者为 Phil Wang。该项目是在 PaLM 架构之上实现 RLHF(人类反馈的强化学习),它基本上是使用 PaLM 的 ChatGPT。

该项目已在 GitHub 上获得了 5.8k 的 Stars。

项目地址:https://github.com/lucidrains/PaLM-rlhf-pytorch

下图为训练流程。

OpenChatKit

第二个项目是「OpenChatKit」,它提供了一个强大的的开源基础,为各种应用程序创建专用和通用的聊天机器人。该 kit 包含了一个经过指令调优的 200 亿参数语言模型、一个 60 亿参数调节模型和一个涵盖自定义存储库最新响应的可扩展检索系统。

OpenChatKit 是在 OIG-43M 训练数据集上训练的,该数据集是 Together、LAION 和 Ontocord.ai 三者的联合。项目作者表示,这不仅仅是一个模型的发布,还是一个开源项目的开始。他们正在发布一套工具和流程,并通过社区贡献持续改进。

该项目已在 GitHub 上获得了 5.7k 的 Stars。

项目地址:https://github.com/togethercomputer/OpenChatKit

text-generation-webui

第三个项目是「text-generation-webui」,它是一个用于运行 GPT-J 6B、OPT、GALACTICA、LLaMA 和 Pygmalion 等大语言模型的 gradio web UI。该项目旨在成为文本生成领域的 AUTOMATIC1111/stable-diffusion-webui。

功能包括使用下拉菜单在不同模型之间切换、提供类似于 OpenAI playground 的笔记本模式、用于对话和角色扮演的聊天模式、为 GPT-4chan 生成漂亮的 HTML 输出等等。

该项目已在 GitHub 上获得了 3.4k 的 Star。

项目地址:https://github.com/oobabooga/text-generation-webui

KoboldAI-Client

第四个项目是「KoboldAI-Client」,它是一个基于浏览器的前端,通过多个本地和远程 AI 模型实现 AI 辅助写作。

KoboldAI-Client 提供了一系列标准的工具,包括内存、作者注释、世界信息、保存 & 加载、可调节的 AI 设置、格式化选项以及导入现有文字冒险游戏《AI Dungeon》的能力。你可以开启 Adventure 模式,也可以玩 AI Dungeon Unleashed 之类的游戏。

该项目已在 GitHub 上获得了 1.4k 的 Stars。

项目地址:https://github.com/KoboldAI/KoboldAI-Client

Open-Assistant

第五个项目是「Open-Assistant」,它旨在让每一个人都可以访问基于聊天的大语言模型。项目作者希望借此在语言创新方面掀起一场革命,就像 stable diffusion 帮助世界以新的方式创造艺术和图像一样。

项目作者计划收集高质量人工生成指令执行样本(指示 + 响应),目标大于 50k。对于收集到的每个指示,他们将采样多个补全结果。接下来进入基于指示和奖励模型的 RLHF 训练阶段。

该项目已在 GitHub 上获得了 19k 的 Stars。

项目地址:https://github.com/LAION-AI/Open-Assistant

stanford_alpaca

第六个项目是「stanford_alpaca」,它旨在建立和共享一个指令遵循的 LLaMA 模型。该 repo 包含了用于微调模型的 52k 数据、用于生成数据的代码以及用于微调模型的代码。

该项目已在 GitHub 上获得了 9.5k 的 Stars。

项目地址:https://github.com/tatsu-lab/stanford_alpaca

ChatRWKV

第七个项目是「ChatRWKV」,它类似于 ChatGPT,但由 RWKV(100% RNN)模型支持,并且是开源的。项目作者表示,RWKV 是目前唯一能在质量和扩展方面媲美 transformers 的 RNN 模型,同时速度更快、节省 VRAM。

该项目已在 GitHub 上获得了 3.5k 的 Stars。

项目地址:https://github.com/BlinkDL/ChatRWKV

ChatGLM-6B

第八个项目是由清华技术成果转化的公司智谱 AI 开源、支持中英双语的对话语言模型「ChatGLM-6B」,基于 General Language Model ( GLM ) 架构,具有 62 亿参数。结合模型量化技术,用户可以在消费级的显卡上进行本地部署(INT4 量化级别下最低只需 6GB 显存)。

ChatGLM-6B 使用了和 ChatGPT 相似的技术,针对中文问答和对话进行优化。经过约 1T 标识符的中英双语训练,辅以监督微调、反馈自助、人类反馈强化学习等技术的加持,62 亿参数的 ChatGLM-6B 已经能生成相当符合人类偏好的回答。

不过由于 ChatGLM-6B 的规模较小,目前已知其具有相当多的局限性,如事实性 / 数学逻辑错误、可能生成有害 / 有偏见内容、较弱的上下文能力、自我认知混乱、以及对英文指示生成与中文指示完全矛盾的内容。

该项目已在 GitHub 上获得了 6k 的 Stars。

项目地址:https://github.com/THUDM/ChatGLM-6B

xmtf

第九个项目是「xmtf」,包含了创建论文《Crosslingual Generalization through Multitask Finetuning》中介绍的 BLOOMZ、mT0 和 xP3 的所有组件。

其中 BLOOMZ 是一个 1760 亿参数且可开放获取的多语言模型;mT0(这里特指谷歌的 T5X);xP3 是 46 种语言的有监督数据集,带有英语和机器翻译的 prompts。

项目地址:https://github.com/bigscience-workshop/xmtf

除了上述提到的模型,ChatGPT 平替项目还包括基于 Meta 开源的大模型系列 LLaMA(Large Language Model Meta AI)的一些研究,这个系列模型的参数量从 70 亿到 650 亿不等。具有 130 亿参数的 LLaMA 模型「在大多数基准上」可以胜过 GPT-3( 参数量达 1750 亿),而且可以在单块 V100 GPU 上运行;而最大的 650 亿参数的 LLaMA 模型可以媲美谷歌的 Chinchilla-70B 和 PaLM-540B。

论文链接:https://research.facebook.com/publications/llama-open-and-efficient-foundation-language-models/

GitHub 链接:https://github.com/facebookresearch/llama

基于此研究,开发者也提出了几个开源项目。

llama.cpp 无需 GPU,就能运行 LLaMA

llama.cpp 项目实现了在 MacBook 上运行 LLaMA,还有开发者成功的在 4GB RAM 的树莓派上运行了 LLaMA 7B。总结而言,即使开发者没有 GPU ,也能运行 LLaMA 模型。

项目地址:https://github.com/ggerganov/llama.cpp

ChatLLaMA

由于 LLaMA 大模型系列没有使用 RLHF 方法,因此初创公司 Nebuly AI 开源了 RLHF 版 LLaMA(ChatLLaMA)的训练方法。它的训练过程类似 ChatGPT,该项目允许基于预训练的 LLaMA 模型构建 ChatGPT 形式的服务。与 ChatGPT 相比,LLaMA 架构更小,但训练过程和单 GPU 推理速度更快,成本更低;该库还支持所有的 LLaMA 模型架构(7B、13B、33B、65B),因此用户可以根据训练时间和推理性能偏好对模型进行微调。

项目地址:https://github.com/nebuly-ai/nebullvm/tree/main/apps/accelerate/chatllama

期待后续更多开源项目加入进来。

参考链接:https://www.reddit.com/r/MachineLearning/comments/11uk8ti/d_totally_open_alternatives_to_chatgpt/

探寻隐私计算最新行业技术,「首届隐语开源社区开放日」报名启程

春暖花开之际,诚邀广大技术开发者 & 产业用户相聚活动现场,体验数智时代的隐私计算生态建设之旅,一站构建隐私计算产业体系知识:

隐私计算领域焦点之性

分布式计算系统的短板与升级策略

隐私计算跨平台互联互通

隐语开源框架金融行业实战经验

3 月 29 日,北京 · 798 机遇空间,隐语开源社区开放日,期待线下面基。

上一篇: 下一篇:
x
推荐阅读

当前速递!还在为玩不了 ChatGPT 苦恼?这十几个开源平替也能体验智能对话

2023-03-19

今日快看!皇马五鹰时代_皇马五鹰

2023-03-19

世界通讯!Insights | Swaran Singh: Chinese modernization unique and has global significance

2023-03-19

山东一村医行医50多年 免去村民40余万医药费_环球速讯

2023-03-19

樊振东王楚钦男双夺冠具体详细内容是什么

2023-03-19

世界短讯!今年最大的金矿被探明!有近50吨!地点在山东乳山市

2023-03-18

动态:幻剑书盟网游小说_幻剑书盟小说网

2023-03-18

雪梨直播卖1.7亿元,晋升顶级流量大咖,曾喊话没王思聪照样红 今日热文

2023-03-18

陈祥:为学生梦想指路引航|环球新资讯

2023-03-18

廊坊师范学院招生热线_廊坊师范学院招生办电话_世界资讯

2023-03-18

战国四公子中齐国的孟尝君名为魏无忌_战国四公子中齐国的孟尝君名为|天天简讯

2023-03-18

新的组词_新读音及解释

2023-03-18

附近秘聊_附近秘约|环球聚看点

2023-03-17

吴江区平望复兴公墓清明节交通管制措施

2023-03-17

陈凯师个人资料简介_本人照到底长得什么样子

2023-03-17

世界最资讯丨主驾驶脚垫下有水怎么办 _奔驰s有轿跑车吗

2023-03-17

赶紧收藏!柳州“嗍粉公交”来了,各网红螺蛳粉店一网打尽 今日热讯

2023-03-17

丽江股份:3月16日融资净买入7.41万元,连续3日累计净买入973.1万元:世界快讯

2023-03-17

追梦谈小卡从十字韧带伤回归:他越来越接近原来的那个莱昂纳德 天天关注

2023-03-17

拉线保护套_拉线:当前快看

2023-03-17

每日速读!车险必须买的四样(车险必须买的有哪些)

2023-03-16

3月16日永赢成长远航一年持有混合C净值下跌0.82%|观天下

2023-03-16

即时看!iQOO手机登上315晚会,公司连夜发教程,程刚曾反思手机更新太快

2023-03-16

【当前独家】津南区:金融知识进校园 维护良好消费环境

2023-03-16

消息!重庆4号线首末车时间(最新)

2023-03-16

值不值1亿?!欧冠双响,奥斯梅恩赛季28场23球5助场均造1球 天天快资讯

2023-03-16

中通快递2022年包裹量达244亿件,市场份额扩大至22.1%|天天精选

2023-03-16

上海市场监管部门跟进违法加工香精案件,对相关场所开展现场调查

2023-03-16

环球关注:青海春天(600381):3月15日北向资金增持5.27万股

2023-03-16

平安养老险厦门分公司315以案说险:谨防电信网络诈骗,守护财产安全

2023-03-15

金蝶国际2022年收入增长约16.6%至48.66亿元 云业务收入同比增长34.6%

2023-03-15

世界微动态丨2023年315晚会播出时间

2023-03-15

重庆城口、四川万源联动执法 筑牢燃气安全底线_每日消息

2023-03-15

脉压差值的大与小,代表了血管的“硬”与“软”,多少算正常?

2023-03-15

长春师范高等专科学校实施“十大工程” 全力培养家国情怀浓专业技能精的应用型技术技能人才-全球观速讯

2023-03-15

迪丽热巴在我胯下挣扎小说_妻子在别人胯下挣扎小说-全球聚看点

2023-03-15

我国实现多个领域新突破 推动高质量发展_全球快播

2023-03-15

斜沟煤矿简介_斜沟煤矿 环球看热讯

2023-03-15

全球速讯:蒙氏数学亲子册_蒙氏数学

2023-03-14

天天日报丨2023广州海珠湿地公园赏樱花从哪个门入园?

2023-03-14

肉豆蔻酸的功效与作用及副作用_肉豆蔻酸的功效与作用|速讯

2023-03-14

薛晓庆:金价今天时间之窗,谨防冲高回落

2023-03-14

世界观热点:芜湖宜居投资20亿元小公募债券状态更新为“已反馈”

2023-03-14

航发动力:公司坚持推动长期发展和为投资者创造真实价值作为市值管理的出发点

2023-03-14

热门看点:中金公司:智慧安防行业将保持较快增长

2023-03-14

徐州新型冠状病毒肺炎疫情:3月14日徐州疫情最新消息今天数据统计情况通报

2023-03-14

锦州以下地区即将停气

2023-03-13

热点在线丨南涧:街面“法考” 喊麦说法

2023-03-13

大盘震荡整理 结构机会强势|世界时快讯

2023-03-13

4块电瓶48伏能跑多远_五块电瓶60伏能跑多远-关注

2023-03-13

迷雾轮回:全球报资讯

2023-03-13

委员建议将中小学生睡眠质量纳入考核:国内多地学校推作业熔断机制 超9点无条件停做_全球微头条

2023-03-13

传递民生温度 彰显开放自信——全国两会“三大通道”聚焦_全球聚看点

2023-03-13

传闻NVIDIAGeForceRTX3080Ti12GB将于4月发布GeForceRTX3070Ti8GB将于5月发布:每日热闻

2023-03-13

龙王传说唐家三少燃文_龙王传说唐家三少

2023-03-12

每日焦点!德恩精工(300780):2022年度实现营业收入6.97亿元,同比增加20.09%

2023-03-12

为人处世厚黑学经典语录_为人处世厚黑学

2023-03-12

北京市交管局发预报这些路段可能堵车|全球报道

2023-03-12

英超积分榜!利物浦0-1 曼城1-0 伦敦双雄全胜 克洛普劫富济贫|世界快播

2023-03-12

无怨无悔的意思怎么解释_无怨无悔的意思

2023-03-11

米体:罗马考虑聘请德泽尔比替穆帅,但热刺和切尔西也在考虑他

2023-03-11

环球通讯!枇杷可以泡在白酒里喝吗_枇杷可以泡酒喝吗

2023-03-11

03月11日12时辽宁沈阳疫情数据 阳了以后为什么会腰疼?应该怎么办?

2023-03-11

环球要闻:海南航空发布夏秋季航班计划 海口往返北京航班覆盖早中晚时段

2023-03-11

齐天大胜_天天观天下

2023-03-11

汉武帝儿子有几个_汉武帝儿子

2023-03-11

非黑即白演员表_非黑即白

2023-03-11

网上买的火车票怎么退_网上买的火车票怎么退

2023-03-10

环球播报:四季更替的诗句_四季更替

2023-03-10

为何越看越想弃剧?剧中人物“假装生活”?用现实“敲醒”漂浮感

2023-03-10

什么是情态动词有哪些_什么是情态动词_天天要闻

2023-03-10

撞车百度文心一言?微软下周发布“游戏规则改变者”GPT-4,支持视频

2023-03-10

ST东洋(002086)3月10日主力资金净买入87.33万元 速看

2023-03-10

法拉第未来拟再融5000万美元 为生产爬坡提供资金_微资讯

2023-03-10

天天亮点!jocelyn什么意思_joc

2023-03-10

“消息不实”!知名品牌紧急回应

2023-03-10

今日快看!车床安全操作规程有哪些_车床安全操作规程

2023-03-10

苹果7p怎么设置动态壁纸自定义_苹果7p怎么设置动态壁纸-环球视讯

2023-03-10

长风破浪会有时的下一句_诗的原文是什么

2023-03-10

织金县文腾街道:织金阁樱花,绽放!:天天微头条

2023-03-09

实时:如图在五边形abcde中角abc等于角aed_如图 在五边形ABCDE中

2023-03-09

《方世玉续集谁与争锋》_方世玉2谁与争锋迅雷下载

2023-03-09

当前快报:大满贯赛男单签位公布!国乒首轮迎战张本智和,19岁小将担重任

2023-03-09

海欣食品:国信证券投资者于3月9日调研我司

2023-03-09

生地会考成绩怎么查_会考成绩怎么查

2023-03-09

国际航协:2023年航空货运市场开年疲软_环球看热讯

2023-03-09

比亚迪“F品牌”首款车型谍照曝光,售价或在40至60万元

2023-03-09

每日时讯!丹麦学者:“北溪”爆炸严重破坏海洋生态,暂且无法补救

2023-03-09

二年级彩色的梦手抄报简单_二年级彩色的梦手抄报

2023-03-09

3月9日起成都城北出口高速交通有变

2023-03-09

火影之水无月夜未删减_火影之水无月夜

2023-03-09

试行文件有效期如何描述_试行文件有效期

2023-03-09

今日讯!ChanelCF价格破8万,叹为观止!

2023-03-08

世界微头条丨淘宝上买的省电宝有用吗_省电宝有用吗

2023-03-08

全球快播:蜂围蝶阵的意思

2023-03-08

世界信息:21个自然日!北交所直联机制迎新进展,逾40家企业有意向,初期鼓励推荐这类企业

2023-03-08

石磊|世界通讯

2023-03-08

【世界快播报】行车记录仪怎么安装走线_行车记录仪怎么安装

2023-03-08

广汽埃安 AION Y Younger 上市:续航 430 公里 售 11.98 万元

2023-03-08

宜兴有哪些高中 每日焦点

2023-03-08