跳到正文
非凡资本

研究与观点 / UNIQUERESEARCH

速报 | Meta推出更高效的新Llama模型

速报 | Meta推出更高效的新Llama模型 · 原文图片 1

Meta宣布了其Llama系列生成式人工智能(AI)模型的新成员:Llama 3.3 70B。
Meta生成式AI副总裁艾哈迈德·阿尔-达勒(Ahmad Al-Dahle)在X平台的一篇帖子中表示,这款仅支持文本的Llama 3.3 70B模型以更低的成本实现了Meta最大型Llama模型Llama 3.1 405B的性能。
阿尔-达勒写道:“通过利用训练后技术的最新进展……该模型以更低的成本显著提升了核心性能。”
阿尔-达勒发布了一张图表,显示Llama 3.3 70B在包括MMLU(评估模型理解语言能力的基准)在内的多项行业基准测试中,表现优于谷歌的Gemini 1.5 Pro、OpenAI的GPT-4(此处原文GPT-4o应为GPT-4的笔误)和亚马逊最新发布的Nova Pro。Meta的一位发言人通过电子邮件表示,该模型应该在数学、常识、指令遵循和应用使用等方面带来改进。

速报 | Meta推出更高效的新Llama模型 · 原文图片 2

Llama 3.3 70B可从AI开发平台Hugging Face以及包括Llama官方网站在内的其他来源下载,是Meta试图通过可用于多种应用并实现商业化的“开放”模型在AI领域占据主导地位的最新举措。
Meta的条款限制了某些开发人员使用Llama模型的方式;月活跃用户超过7亿的平台必须申请特殊许可证。但对于许多人来说,Llama模型在最严格意义上是否“开放”并不重要。据Meta称,Llama的下载量已超过6.5亿次。
Meta也在内部利用了Llama。据Meta首席执行官马克·扎克伯格(Mark Zuckerberg)称,公司的人工智能助手Meta AI完全由Llama模型提供支持,目前月活跃用户已接近6亿。扎克伯格声称,Meta AI有望成为全球使用最广泛的人工智能助手。
对于Meta来说,Llama的开放性既是福音也是阻碍。去年11月,有报道称中国军事研究人员利用Llama模型开发了一款国防聊天机器人。Meta随后将其Llama模型提供给美国国防承包商使用。
Meta还对其遵守欧盟《人工智能法案》的能力表示担忧,该法案为人工智能建立了监管框架,Meta称该法案的实施对其开放发布策略来说“过于不可预测”。对于公司而言,另一个相关问题是欧盟《通用数据保护条例》(GDPR)中涉及AI训练的条款。Meta在未经选择退出的Instagram和Facebook用户的公开数据上训练AI模型,而这些数据在欧洲受到GDPR的保护。
今年早些时候,欧盟监管机构要求Meta在评估其GDPR合规性期间停止使用欧洲用户数据进行训练。Meta妥协了,同时支持一封呼吁对GDPR进行“现代解释”、不“拒绝进步”的公开信。
Meta也面临着其他AI实验室所遇到的技术挑战,正在加强其计算基础设施,以训练和提供下一代Llama。该公司周三宣布,将在路易斯安那州建造一座耗资100亿美元的AI数据中心,这是Meta建造过的最大的AI数据中心。
扎克伯格在Meta今年8月的第四季度财报电话会议上表示,为了训练下一代主要Llama模型——Llama 4,公司将需要比训练Llama 3多10倍的计算能力。Meta已经采购了一个由超过10万台Nvidia GPU组成的集群用于模型开发,其资源可与xAI等竞争对手相媲美。
训练生成式AI模型是一项成本高昂的业务。Meta第二季度2024年的资本支出增长了近33%,达到85亿美元,而一年前为64亿美元,增长主要得益于对服务器、数据中心和网络基础设施的投资。
- END -

来源:非凡产研 · 腾讯新闻。文章中的“非凡产研”是原始发布账号署名,不代表已核实个人执笔作者。引用访谈或圆桌观点时,应按正文标明具体发言人及当时身份;无法确认时不要推断。日期为原始发表日期,历史信息以发布时点为准。

阅读原始发布版本 ↗
← 返回研究文章库