
网站截图

复旦大模型MOSS,正式开源了!
MOSS开源地址一放出,又冲上知乎热搜:
从官网介绍来看,MOSS是一个拥有160亿参数的开源对话语言模型。
它由约7000亿中英文及代码单词预训练得到,精度要求不那么高的话,甚至可以在单张3090显卡上运行。
MOSS支持中英双语,拥有多轮对话和使用多种插件双重能力,具备搜索引擎、文生图、计算器、方程求解的“技能点”。
目前,MOSS在GitHub上已有2.3k Star,热度还在持续上涨中。
那么,MOSS究竟开源了哪些项目,目前有哪些功能?一起来看看。
会解方程,也能生成图片
据了解,这次MOSS开源的是第三轮迭代版本,名叫MOSS 003。
当然,MOSS 003也并非开源了全部模型,目前主要开放的是基座预训练模型,最终模型即将在近期开源:
此前,MOSS已经经历了两版迭代,一版是公开邀请内测的MOSS 002版本,另一版是内部测试版本OpenChat 001。
三月份大伙儿见证的“国内首个开放测试的GPT”,正是MOSS 002版本。
最新这个版本展现的功能效果如何?
MOSS团队放出了它多轮对话、解方程、写代码、生成图片和回答道德伦理等示例。
这是多轮对话的展示效果,具备资料追根溯源的能力:
这是做数学题的示例,包括鸡兔同笼问题:
也包括生成图片功能:
还有近期网友热议的AI道德性问题:
当然,这波里面也不乏“砸场子”的网友。
例如官方GitHub问答中,有网友很想了解它的中文能力和chatglm6b相比谁更好,下面有网友调侃:
你是来砸场子的么?
这也是因为此前团队在MOSS 002公开测试时曾经表示过,MOSS的中文能力不算太好,这也与训练数据有关。
除此之外,团队这次还开源了一部分训练数据。
至于完整数据,复旦MOSS团队表示“近期会全部开源”。
国内最先发布的GPT产品
MOSS取自于《流浪地球》里面那个拥有自我意识的AI。
它由复旦自然语言处理实验室邱锡鹏团队研发,2月20日正式发布。
当时国内一众大厂还在陆续高调官宣要造GPT,谁都没想到它就这么一声不吭地杀了出来。
所以尽管MOSS的参数量比GPT小了一个量级,大家还是蜂拥而上,把服务器都给挤爆了。
而发布没过一周,复旦大学教授邱锡鹏就在演讲中提出,如果优化顺利,计划在三月底开源MOSS。
因为在他看来:
人们之所以很容易有“卡脖子”问题,是因为缺乏一个好的行业生态。
就拿GPT来说,AI公司只需专注做好模型,算力、数据和系统则交给其他公司。反观国内,很多公司在做大型语言模型时所有环节都需要自己做,每家的数据和算力也有限,结果是每家都做不大。在发展过程中,大型语言模型训练与在线推理成本过高也是一个重大问题。
因此,他们一开始就考虑要把MOSS开源而不是商业化。
有了这样一个基座,大家就不用重复开发底层技术,可以在上面接不同的细分领域。
如今,虽晚了快一个月,MOSS也说到做到了。
你试用过复旦MOSS开源模型了吗?效果如何?
MOSS开源项目地址:
[1]https://github.com/OpenLMLab/MOSS
[2]https://huggingface.co/fnlp/moss-moon-003-base
[3]https://huggingface.co/fnlp/moss-moon-003-sft
[4]https://huggingface.co/fnlp/moss-moon-003-sft-plugin
数据统计
相关导航

书生通用大模型体系是一套全面、高效的AI解决方案,涵盖了语言处理、多模态分析、气象预报、翼型设计和三维建模等多个领域。

华之科
基于openAi的大模型应用,提供支持多轮对话,内容创作、图片制作、音乐制作、图片文档表格等文件的内容解析的相关功能。

同济大学CivilGPT
同济大学TAIER实验室自主研发的“知识大模型”,它融合了土木、建筑、规划、交通、测绘、环境、力学、材料、机械、经管等十个学科的知识

探迹SalesGPT
探迹SalesGPT通过其大数据和AI技术,为企业提供全方位的智能销售解决方案,帮助企业实现销售流程的数字化转型,提升销售效率和业绩。

子曰大模型
子曰是网易有道推出的教育领域垂直大模型,包含基于子曰大模型研发的六大创新应用——“LLM翻译”、“虚拟人口语教练”、“AI作文指导”、“语法精讲”、“AI Box”以及“文档问答”。

乾元BigBangTransformer
BBT-2-12B-Text基于中文700亿tokens进行预训练,经过指令微调的BBT-2基础模型可以回答百科类和日常生活的问题。BBT-2.5-13B-Text基于中文+英文 2000亿tokens进行预训练。

讯飞医疗大模型
讯飞医疗大模型致力于通过人工智能技术赋能医疗行业,提供包括智能导诊、医疗影像分析、医疗大数据分析等在内的医疗健康解决方案。

同花顺·问财
同花顺·问财大模型是一款集合了实时数据获取、深度语义理解、专业投资建议、数据可视化和内容安全控制等多功能的智能投顾工具。
暂无评论...