当前位置:首页 > 元宇宙 > AI

Hugging Face 公布 4.5 亿参数开源机器人模型 SmolVLA,消费级硬件设备即可运行

来源: 责编: 时间:2025-06-12 09:53:05 110观看
导读 6 月 9 日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。当下,业界机器人模型通常采用“视觉-语言-行

6 月 9 日消息,Hugging Face现已公布 4.5 亿参数开源机器人模型 SmolVLA,该模型主打高普适性,可在 MacBook Pro等的消费级硬件设备上运行,旨在帮助开发者降低入门成本。gl428资讯网——每日最新资讯28at.com

当下,业界机器人模型通常采用“视觉-语言-行动”(Vision-Language-Action,VLA)设计,此类模型尝试在单一架构中整合感知能力、语言理解与行动决策,从而让机器人实现自主执行复杂任务。不过相应模型训练成本极高,目前大多数模型仍为闭源项目,训练过程中依赖昂贵硬件、大量工程资源和大规模私有数据集。gl428资讯网——每日最新资讯28at.com

为此,Hugging Face 推出 SmolVLA 这一轻量级开源模型,使用公开数据集进行训练,并可在消费级硬件设备上运行,旨在降低爱好者入门成本,推动通用机器人智能体的研究进展。gl428资讯网——每日最新资讯28at.com

据介绍,SmolVLA 在模型架构上结合 Transformer 结构与 flow-matching 解码器,并采用了四项关键优化技术:一是跳过视觉模型中一半层数,以提升推理速度并减小模型体积;二是交替融合自注意力与交叉注意力模块,提高多模态信息整合效率;三是减少视觉 Token 数量以提升处理效率;四是采用更轻量的 SmolVLM2 作为视觉编码器,从而进一步降低硬件要求。gl428资讯网——每日最新资讯28at.com

gl428资讯网——每日最新资讯28at.com

▲ 图源Hugging Face(下同)

而在训练策略方面,SmolVLA 首先通过通用操作数据进行预训练,再针对特定任务进行微调,以提升适应能力。因此虽然 SmolVLA 的训练数据远少于现有其他 VLA 模型(仅包括不到 3 万个任务记录),但 Hugging Face 表示,该模型在模拟环境和真实场景中的表现与大型模型相当,甚至在部分任务上实现“超越”。gl428资讯网——每日最新资讯28at.com

此外,Hugging Face 透露 SmolVLA 还引入“异步推理架构”(Asynchronous Inference Stack),将感知处理(如视觉和语音理解)与动作执行进行解耦,使机器人在面对快速变化的环境时能做出更及时的响应,大幅提升其实用性。gl428资讯网——每日最新资讯28at.com

gl428资讯网——每日最新资讯28at.com

Hugging Face 强调,用户使用MacBook Pro 笔记本电脑等消费级硬件即可运行 SmolVLA-450M 模型,无需花费大成本采购专用AI训练服务器。同时用户也可以考虑采购 Hugging Face 推出的低成本机器人平台(SO-100、SO-101 和 LeKiwi)等降低成本。gl428资讯网——每日最新资讯28at.com

Hugging Face 援引自家进行的多项基准测试验证SmolVLA 的性能,在 LIBERO 与 Meta-World 等模拟测试平台上,SmolVLA 的表现据称优于Octo、OpenVLA 等业界竞品,而在使用真实机器人 SO-100 和 SO-101 进行抓取、放置、堆叠与分类任务中,SmolVLA 也展现出更好的性能。gl428资讯网——每日最新资讯28at.com

gl428资讯网——每日最新资讯28at.com

目前,SmolVLA 的基础模型已在 Hugging Face 平台上线,完整训练方法也同步在 GitHub 上公开,附项目页面如下(https://huggingface.co/lerobot/smolvla_base)。gl428资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-13643-0.htmlHugging Face 公布 4.5 亿参数开源机器人模型 SmolVLA,消费级硬件设备即可运行

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 国产 AI 初创企业硅基流动完成新一轮数亿元融资,阿里云领投

下一篇: 英国电影协会警告:AI 会掠夺剧本,将对本土影视业构成直接威胁

标签:
  • 热门焦点
  • AIGC产品测评TOP25丨谁能抢到下个十年的“船票”?

    Tech星球(微信ID:tech618) 文 | 何煦阳策划 | 杨晓鹤封面来源 | 图虫创意 2016年,李彦宏站在百度联盟峰会的讲台上,向所有人宣布:互联网的下一幕是人工智能。同年,Google 旗下 Dee
  • 上、中、下游加深融合,搭建元宇宙产业全景

    元宇宙产业链涉及多种技术和多个领域。在上游,聚集着大量的技术厂商,提供元宇宙相关的硬件和软件支持;在中游,内容运营与分发领域也吸引着越来越多的企业以VR内容
  • 中国虚拟数字人如何横向拓展市场需求,探索发展场景?

    通过5G、AI等新技术更新换代,虚拟数字人为诸多下游行业带来新的发展机会。虚拟数字人技术以其简化性和精品性持续拓展泛娱乐、金融、教育、政务、医疗、零售等
  • Layer1的新以太坊,更好的以太坊?

    以太坊作为区块链基础设施地位看起来已不可动摇,但也面临着费用高、效率低、偏离去中心化初衷等问题。平台上既得利益群体的形成和固化也逐渐让革新变得困难。
  • Meta正在研发元宇宙语音助手;广东省462家企业申请元宇宙商标

    今日《元宇宙新鲜事》有:扎克伯格透露正在为元宇宙研发语音助手;完美世界声明称不会以“元宇宙投资项目”等名义吸收资金。广东省申请元宇宙商标的企业达462家位
  • 从4个方面解析2022年加密行业趋势

    作者:去月球基础设施瓶颈仍然存在尽管2021年公链基础设施之间的竞争显著升温,但关键瓶颈仍需解决。例如,以太坊作为DApp开发的顶级公链,仍然遭受网络拥塞和高额交
  • 从概念到落地 Web3.0初具雏形

    加密资产热潮催生出的链上应用中,除了DeFi、NFT、链游GameFi等场景外,还有一个热词叫「Web3.0」。Web3.0的概念最早出现在2014年,由以太坊联合创始人及波卡创建者
  • 初探元宇宙

    2021年可以被称为“元宇宙”元年。继2021年3月沙盒游戏平台Roblox将“元宇宙”概念放入招股书中,被称为“元宇宙”第一股后,Facebook更名为Meta, 引发全球范围内
  • 我们离元宇宙的实现只差一副眼镜?

    近日的苹果春季新品发布会,想必许多人都守在了屏幕前,就为等待传说中的首款AR Glass。在发布会之前,苹果全球营销主管Greg Joswiak曾在Twitter上分享了一段短视频
Top