当前位置:首页 > 元宇宙 > AI

谷歌发布 Mirasol:30 亿参数,将多模态理解扩展到长视频

来源: 责编: 时间:2023-11-20 17:10:26 478观看
导读 11 月 16 日消息,谷歌公司近日发布新闻稿,介绍了小型人工智能模型 Mirasol,可以回答有关视频的问题并创造新的记录。AI 模型目前很难处理不同的数据流,如果要让 AI 理解视频,需要整合视频、音频和文本等不同模态的

11 月 16 日消息,谷歌公司近日发布新闻稿,介绍了小型人工智能模型 Mirasol,可以回答有关视频的问题并创造新的记录。o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

AI 模型目前很难处理不同的数据流,如果要让 AI 理解视频,需要整合视频、音频和文本等不同模态的信息,这大大增加了难度。o3o28资讯网——每日最新资讯28at.com

谷歌和谷歌 Deepmind 的研究人员提出了新的方法,将多模态理解扩展到长视频领域。o3o28资讯网——每日最新资讯28at.com

借助 Mirasol AI 模型,该团队试图解决两个关键挑战:o3o28资讯网——每日最新资讯28at.com

需要以高频采样同步视频和音频,但要异步处理标题和视频描述。o3o28资讯网——每日最新资讯28at.com

视频和音频会生成大量数据,这会让模型的容量紧张。o3o28资讯网——每日最新资讯28at.com

谷歌在 Mirasol 中使用合路器(combiners)和自回归转换器(autoregressive transformer)模型。o3o28资讯网——每日最新资讯28at.com

该模型组件会处理时间同步的视频和音频信号,然后再将视频拆分为单独的片段。o3o28资讯网——每日最新资讯28at.com

转换器处理每个片段,并学习每个片段之间的联系,然后使用另一个转换器处理上下文文本,这两个组件交换有关其各自输入的信息。o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

名为 Combiner 的新颖转换模块从每个片段中提取通用表示,并通过降维来压缩数据。每个段包含 4 到 64 帧,该模型当前共有 30 亿个参数,可以处理 128 到 512 帧的视频。o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

在测试中,Mirasol3B 在视频问题分析方面达到了新的基准,体积明显更小,并且可以处理更长的视频。使用包含内存的组合器变体,该团队可以将所需的计算能力进一步降低 18%。o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

o3o28资讯网——每日最新资讯28at.com

在此附上 Mirasol 的官方新闻稿,感兴趣的用户可以深入阅读。o3o28资讯网——每日最新资讯28at.com

本文链接:http://www.28at.com/showinfo-45-2592-0.html谷歌发布 Mirasol:30 亿参数,将多模态理解扩展到长视频

声明:本网页内容旨在传播知识,若有侵权等问题请及时与本网联系,我们将在第一时间删除处理。邮件:2376512515@qq.com

上一篇: 浙江卫健委推出可陪诊数字健康人“安诊儿”:基于支付宝技术,可提供全流程陪伴

下一篇: TPC 联盟成立:目标万亿以上参数 AI 模型,推进科学发现

标签:
  • 热门焦点
  • AI特效、虚拟人、数字盲盒,来看看元宇宙如何融合冬奥会!

    今天是冬奥会比赛的第12天,截至目前所累计的成绩,中国代表团已经取得了冬奥历史最佳战绩。全世界的人都在关注着这场盛事,为奥运健儿呐喊助威。谷爱凌、徐梦桃、
  • DAO登上了历史舞台,但是主流准备好采用DAO了吗?

    Block-807DAO要么是定义虚拟未来、无领导组织的革命性概念,要么是充满存在主义和自我毁灭挑战的反乌托邦结构,取决于你在与谁交谈。近几个月来, DAO已经从Crypto
  • a16z:元宇宙办公会取代实体办公室吗?

    6位不同的专家对未来的工作发表看法----元宇宙--沉浸式的、基于区块链的虚拟世界,大多数日常活动最终会在这里发生--但仍然只是一个概念。但它是一个拥有宝贵不
  • 参加元宇宙里的招聘会是什么样一种体验?

    求职者可以在活动中走动,就像他们在现实生活中一样。长话短说看亮点:招聘公司Hirect为Y-combinator支持的初创公司举办了一场元宇宙招聘会。这里有一个大厅、一
  • 元宇宙需要的5个重要安全功能

    元宇宙的可能用途使其成为一个令人难以置信的概念,但是,就像科技界的任何事物一样,需要做一些事情来控制其使用。元宇宙的安全功能需要仔细考虑和开发,以保护用户
  • 王老吉启动元宇宙“吉空间”,HTC发布元宇宙应用VIVERSE

    今日《元宇宙新鲜事》有:王老吉启动元宇宙“吉空间”;HTC发布元宇宙应用VIVERSE;Meta将在马德里构建一个元宇宙创新中心;央视网《新闻+》推出系列视频《聊聊元宇宙
  • 音乐家如何利用NFTs来提高歌迷参与度

    "音乐是一种语言,不以特定的文字说话。它用情感说话,如果它在骨子里,它就在骨子里。" - Keith Richards音乐激励着我们,使我们流泪,使我们充满狂喜,并抚慰我们的灵魂
  • 元宇宙不完全是想出来的,而是实打实做出来的

    沈阳强调,元宇宙不完全是想出来的,而是靠实打实做出来的;互联网向三维化升级是已经明确的大方向,这意味着大量的资金和技术会持续涌入。跨入2022年,元宇宙并没有“
  • 初探元宇宙

    2021年可以被称为“元宇宙”元年。继2021年3月沙盒游戏平台Roblox将“元宇宙”概念放入招股书中,被称为“元宇宙”第一股后,Facebook更名为Meta, 引发全球范围内
Top