声明:本文来自于微信公众号 AIGC开放社区,作者:AIGC开放社区,授权转载发布。
7月23日凌晨,有人爆料,Meta的Llama3.1-405B评测数据遭遇泄漏,明天可能会发布Llama3系列中最大的参数模型,同时还会发布一个Llama3.1-70B版本。
这也是在3.0版本基础之上进行了功能迭代,即便是70B的基础模型的性能也超过了GPT-4o。
就连磁力链接都流出来了,「AIGC开放社区」试了一下大约有763.84G。本来huggingface上也有的,后来库被删除了。
磁力地址:
Magnet: magnet:?xt=urn:btih:c0e342ae5677582f92c52d8019cc32e1f86f1d83&dn=miqu-2&tr=udp%3A%2F%https://2Ftracker.openbittorrent.com%3A80
下载速度也还可以,每秒14M左右,看来确实是有不少人在下这个模型。
但这个模型一般的GPU肯定是跑不起来,如此大的参数在部署方面个人开发者也负担不起(如果你有一些H100也没问题),估计是给企业、政务公共部门用的。
对于Meta即将发布的模型,就有网友泼冷水。相比OpenAI最新的GPT-4o mini版本,Llama3.1-70B推理成本提升了3倍,但编码的性能却要差很多。
从性价比、功能来看,Meta的新模型也没什么值得期待的。
还有人甚至在GitHub上看到了上述发布的模型,但很快就拿下来了,估计有一些人可能已经能使用了。
也有人表示,对于这个泄漏事件他认为是真的,因为这是从微软的Azure Github流出来的。
但是这个模型参数较大,对GPU的要求太高了,不如GPT-4o mini性价比高。
虽然模型是免费的,想运行起来还是相当费劲的,没有企业级的算力基础真的无法使用。所以,这对于企业来说是一个不错的好消息。
有人指出即便对Llama3.1-405B模型进行大幅度优化,量化到5位数,仍然无法适用于消费级GPU,真的是对硬件要求特别高。
如果这份评测数据是真的,那么对于全球多数国家来说都是一个天大的..。因为这是Meta的Llama3系列的顶级模型并且是全部开放权重,也就是说人人都能用上免费的AI模型。
但是如果想开发生成式AI应用,也需要强大的AI算力基础、高质量数据以及微调技术。
由于监管机构和各种法案的原因,Meta一直在推迟405B系列模型的发布。那么,本次泄漏是否是Meta特意放出来的呢,因为这是他们的老传统了,去年的Llama模型就干过一次,
当时「AIGC开放社区」也测试过,确实就是他的原模型。期待一波明天,看看Meta还能整啥花活。
新华社北京7月21日电 党的二十届三中全会强调,必需自发把改造摆在加倍凸起位置,紧紧环绕推进中国式现代化进一步周全深化改造。进修贯彻全会
大家好,小豪今天来为大家解答参考文献类型以下问题,常用的参考文献类型很多人还不知道,现在让我们一起来看看吧!1、参考文献通常包括以下
大家好,小乐今天来为大家解答360邮箱以下问题,360邮箱登陆入口很多人还不知道,现在让我们一起来看看吧!1、首先打开360安全浏览器。2、在36
奥运会接近尾声,乒乓球整体赛事最后决赛光降,双打竞赛的划定相对复杂,这里简洁介绍一下其划定,以便更好的观战竞赛。从以下几个步
大家好,小娟今天来为大家解答团队管理计划书怎么写以下问题,团队管理计划怎么写很多人还不知道,现在让我们一起来看看吧!1、问题一:团队
大家好,小丽今天来为大家解答深圳奥特莱斯哪个最好知道以下问题,深圳奥特莱斯那家好很多人还不知道,现在让我们一起来看看吧!1、深圳的奥
大家好,小娟今天来为大家解答轩字五行属什么以下问题,萱字五行属什么很多人还不知道,现在让我们一起来看看吧!1、轩五行:土。2、轩字五行
大家好,小伟今天来为大家解答沸点医药以下问题,沸点医药视频1168网治多病很多人还不知道,现在让我们一起来看看吧!1、当你浏览沸点分类网时
8月22日22点54分48秒将迎来处暑骨气。处暑秋色,最丽人间!瞻仰最高远的天,欣赏最澹泊的云,注视最柔情的水,聆听最美妙的雨……六合有大美而
大家好,小豪今天来为大家解答剪力墙图片以下问题,剪力墙图片cad图示很多人还不知道,现在让我们一起来看看吧!1、短肢剪力墙,指的是截面厚
Copyright 2024 优质自媒体,让大家了解更多图文资讯!