马斯克用行动反击 开源自家顶级大模型 压力给到OpenAI

1077次浏览

  马斯克用行动反击 开源自家顶级大模型 压力给到OpenAIFVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  《科创板日报》3月18日讯(编辑 宋子乔) 似乎是为了表明自己始终坚持对AI模型开源,马斯克做出了与阿尔特曼全然不同的选择。3月17日,马斯克宣布开源Grok-1,这使得Grok-1成为当前参数量最大的开源大语言模型,拥有3140亿参数,远超OpenAI GPT-3.5的1750亿。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  有意思的是,Grok-1宣布开源的封面图为Midjourney生成,可谓“AI helps AI”。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  一直吐槽OpenAI不open的马斯克,自然要在社交平台上含沙射影一番,“我们想了解更多OpenAI的开放部分。”FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  Grok-1遵照Apache 2.0协议开放模型权重和架构。这意味着它允许用户自由地使用、修改和分发软件,无论是个人还是商业用途。这种开放性鼓励了更广泛的研究和应用开发。项目发布至今,已经在GitHub上揽获6.5k星标,热度还在持续增加。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  项目说明中明确强调,由于Grok-1是一个规模较大(314B参数)的模型,需要有足够GPU内存的机器才能使用示例代码测试模型。网友表示这可能需要一台拥有628 GB GPU内存的机器。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  此外,该存储库中MoE层的实现效率并不高,之所以选择该实现是为了避免需要自定义内核来验证模型的正确性。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  目前已开源的热门大模型包括Meta的Llama2、法国的Mistral等。通常来说,发布开源模型有助于社区展开大规模的测试和反馈,意味着模型本身的迭代速度也能加快。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  Grok-1是一个混合专家(Mixture-of-Experts,MOE)大模型,由马斯克旗下的AI创企xAI在过去4个月里开发。回顾该模型的开发历程:FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  在宣布成立xAI之后,相关研究人员首先训练了一个330亿参数的原型语言模型(Grok-0),这个模型在标准语言模型测试基准上接近LLaMA2(70B)的能力,但使用了更少的训练资源;FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  之后,研究人员对模型的推理和编码能力进行了重大改进,最终开发出了Grok-1并于2023年11月发布,这是一款功能更为强大的SOTA语言模型,在HumanEval编码任务中达到了63.2%的成绩,在MMLU中达到了73%,超过了其计算类中的所有其他模型,包括ChatGPT-3.5和Inflection-1。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  与其他大模型相比,Grok-1的优势在哪呢?FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  xAI特别强调,Grok-1是他们自己从头训练的大模型,即从2023年10月开始使用自定义训练堆栈在JAX和Rust上训练,没有针对特定任务(如对话)进行微调;FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  Grok-1的一个独特而基本的优势是,它可以通过X平台实时了解世界,这使得它能够回答被大多数其他AI系统拒绝的辛辣问题。Grok-1发布版本所使用的训练数据来自截至2023年第三季度的互联网数据和xAI的AI训练师提供的数据;FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  3140亿参数的Mixture-of-Experts模型,其对于每个token,活跃权重比例为25%,这一庞大的参数量为其提供了强大的语言理解和生成能力。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

  xAI此前介绍,Grok-1将作为Grok背后的引擎,用于自然语言处理任务,包括问答、信息检索、创意写作和编码辅助。未来,长上下文的理解与检索、多模态能力都是该模型将会探索的方向之一。FVX速刷资讯——探索最新科技、每天知道多一点SUSHUAPOS.COM

本文链接:http://m.sushuapos.com/show-2-3998-0.html马斯克用行动反击 开源自家顶级大模型 压力给到OpenAI

声明:本网站为非营利性网站,本网页内容由互联网博主自发贡献,不代表本站观点,本站不承担任何法律责任。天上不会到馅饼,请大家谨防诈骗!若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。

热门文章

延伸阅读

相关阅读

全国人大代表、沈阳市于家台村总书记佟亮:加强农村直播带货基础设施建设
21世纪经济报道记者周慧 北京报道农村居民如何更好的就业和增收?全国人大代表、辽宁省沈阳市辽中区潘家堡镇于家台村党总支书记佟亮,提出了《关于发挥好直播带货的作用 促进农民就业
聚焦两会丨全国人大代表、国家电网党组组织部主任李生权:加快构建新型电力系统,打造数智化坚强电网
21世纪经济报道记者吴文汐 北京报道 今年的政府工作报告中提出,深入推进能源革命,控制化石能源消费,加快建设新型能源体系。新型电力系统是建设新型能源体系、服务碳达峰碳中和的重要
广汽飞行汽车 GOVE 首次在城市公众复杂低空环境完成飞行验证
3 月 10 日消息,据广汽集团官方公众号昨日晚间推文,3 月 8 日,广汽飞行汽车 GOVE 在广州 CBD 上空进行飞行展示,首次完成在城市公众复杂低空环境进行飞行验证,为广汽城市空中交通示范运行探索迈出了重要一步。据介
特斯拉纯视觉坚定跟随者!极越获中国光谷首张L3自动驾驶测试牌照
3月9日消息,在自动驾驶领域,特斯拉当前可以说是非常独特的,因为其坚持采用纯视觉方案,而非不少国内厂商使用的带有激光雷达的“融合感知”,不过有一家品牌则坚定地跟随特斯拉采用纯视觉,它正是极越汽车
专访全国人大代表、辽宁大学校长余淼杰:发展新质生产力归根结底要靠创新人才
21世纪经济报道记者 贺佳雯 实习生 王雅琪 北京报道2024年是全国人大代表、辽宁大学校长余淼杰第二年上两会。和去年一样,他带来了厚厚一沓建议,今年的建议有8份,既有涉及出口外贸、改
配第5代DM-i技术 比亚迪秦L无伪装谍照
近日,网络上曝光了接近量产状态的比亚迪秦L路试谍照,该车已经完全去掉了伪装,让我们能够更清晰的看到实车。根据官方的定位,其将高于秦PLUS车型,仍然定位为一款紧凑型轿车,售价或在12-13万元起。该车将搭载比亚迪第5代D

热点精选

最新推荐

您可能感兴趣