0
  • 聊天消息
  • 系统消息
  • 评论与回复
登录后你可以
  • 下载海量资料
  • 学习在线课程
  • 观看技术视频
  • 写文章/发帖/加入社区
会员中心
创作中心

完善资料让更多小伙伴认识你,还能领取20积分哦,立即完善>

3天内不再提示

大脑视觉信号被Stable Diffusion复现图像!

新机器视觉 来源:量子位 2023-03-16 10:26 次阅读

导读

“现在Stable Diffusion已经能重建大脑视觉信号了!”

一个听起来细思极恐的“AI读脑术”研究,在网上掀起轩然大波:

32fc8f98-c378-11ed-bfe3-dac502259ad0.jpg

这项研究声称,只需用fMRI(功能磁共振成像技术,相比sMRI更关注功能性信息,如脑皮层激活情况等)扫描大脑特定部位获取信号,AI就能重建出我们看到的图像!

330a216c-c378-11ed-bfe3-dac502259ad0.jpg

例如这是一系列人眼看到的图像,包括戴着蝴蝶结的小熊、飞机和白色钟楼:

3312c6fa-c378-11ed-bfe3-dac502259ad0.jpg

AI看了眼人脑信号后,立马就给出这样的结果,属实把该抓的重点全都抓住了:

331d6f4c-c378-11ed-bfe3-dac502259ad0.gif

再发展一步,这不就约等于哈利波特里的读心术了吗??

34ee7e06-c378-11ed-bfe3-dac502259ad0.png

更有网友感到惊叹:如果说ChatGPT开放API是件大事,那这简直称得上疯狂。

3512a524-c378-11ed-bfe3-dac502259ad0.png

所以,这究竟是怎么一回事?

用Stable Diffusion可视化人脑信号

这项研究来自日本大阪大学,目前已经被CVPR 2023收录:

35262d6a-c378-11ed-bfe3-dac502259ad0.png

研究希望能从人类大脑活动中,重建高保真的真实感图像,来理解大脑、并解读计算机视觉模型和人类视觉系统之间的联系。

要知道,此前虽然有不少脑机接口研究,致力于从人类大脑活动中读取并重建信号,如意念打字等。

然而,从人类大脑活动中重建视觉信号——具有真实感的图像,仍然挑战极大。

例如这是此前UC伯克利做过的一项类似研究,复现一张人眼看到的飞机片段,但计算机重建出来的图像却几乎看不出飞机的特征:

35309a34-c378-11ed-bfe3-dac502259ad0.jpg

△图源UC伯克利研究Reconstructing Visual Experiences from Brain Activity Evoked by Natural Movies

这次,研究人员重建信号选用的AI模型,是这一年多在图像生成领域地位飞升的扩散模型。

当然,更准确地说是基于潜在扩散模型(LDM)——Stable Diffusion。

整体研究的思路,则是基于Stable Diffusion,打造一种以人脑活动信号为条件的去噪过程的可视化技术。

它不需要在复杂的深度学习模型上进行训练或做精细的微调,只需要做好fMRI(功能磁共振成像技术)成像到Stable Diffusion中潜在表征的简单线性映射关系就行。

它的概览框架是这样的,看起来也非常简单:

仅由1个图像编码器、1个图像解码器,外加1个语义解码器组成。

353da54e-c378-11ed-bfe3-dac502259ad0.jpg

具体怎么work?

如下图所示,第一部分为本研究用到的LDM示意图。

其中ε代表图像编码器,D代表图像解码器,而τ是一个文本编码器(CLIP)。

3550921c-c378-11ed-bfe3-dac502259ad0.jpg

重点是解码分析,如下图所示,模型依次从大脑早期(蓝色)和较高(黄色)视觉皮层内的fMRI信号中,解码出重建图像(z)和相关文本c的潜在表征。

然后将这些潜在表征当作输入,就可以得到模型最终复现出来的图像Xzc。

3564b850-c378-11ed-bfe3-dac502259ad0.jpg

最后还没有完,如编码分析示意图,作者还构建了一个编码模型,用来预测LDM不同组件(包括图像z、文本c和zc)所对应的fMRI信号,它可以用来理解Stable Diffusion的内部过程。

357a3540-c378-11ed-bfe3-dac502259ad0.jpg

可以看到,采用了zc的编码模型在大脑后部视觉皮层产生的预测精确度是最高的。(zc是与c进行交叉注意的反向扩散后,z再添加噪声的潜在表征)

3584d482-c378-11ed-bfe3-dac502259ad0.jpg

相比其它两者,它生成的图像既具有高语义保真度,分辨率也很高。

359d6326-c378-11ed-bfe3-dac502259ad0.jpg

还有用GAN重建人脸图像的

看完这项研究,已经有网友想到了细思极恐的东西:

这个AI虽然只是复制了“眼睛”所看到的东西。
但是否会有一天,AI能直接从人脑的思维、甚至是记忆中重建出图像或文字?

35dddfdc-c378-11ed-bfe3-dac502259ad0.jpg

“语言的用处不再存在了”

35f8543e-c378-11ed-bfe3-dac502259ad0.png

于是有网友进一步想到,如果能读取记忆的话,那么目击证人的证词似乎也会变得更可靠了:

360e982a-c378-11ed-bfe3-dac502259ad0.png

还别说,就在去年真有一项研究基于GAN,通过fMRI收集到的大脑信号重建看到的人脸图像:

3614f224-c378-11ed-bfe3-dac502259ad0.jpg

不过,重建出来的效果似乎不怎么样……

36291312-c378-11ed-bfe3-dac502259ad0.jpg

显然,在人脸这种比较精细的图像生成上,AI“读脑术”还有很长一段路要走。

对于这种大脑信号重建的研究,也有网友提出了质疑。

例如,是否只是AI从训练数据集中提取出了相似的数据?

3639f768-c378-11ed-bfe3-dac502259ad0.jpg

对此有网友回复表示,论文中的训练数据集和测试集是分开的:

365692c4-c378-11ed-bfe3-dac502259ad0.jpg

作者们也在项目主页中表示,代码很快会开源。可以先期待一下~

366d19e0-c378-11ed-bfe3-dac502259ad0.png

作者介绍

本研究仅两位作者。

一位是2021年才刚刚成为大阪大学助理教授的Yu Takagi,他主要从事计算神经科学和人工智能的交叉研究。

最近,他同时在牛津大学人脑活动中心和东京大学心理学系利用机器学习技术,来研究复杂决策任务中的动态计算。

另一位是大阪大学教授Shinji Nishimoto,他也是日本脑信息通信融合研究中心的首席研究员。

研究方向为定量理解大脑中的视觉和认知处理,谷歌学术引用3000+次。

那么,你觉得这波AI重建图像的效果如何?

审核编辑 :李倩

声明:本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人,不代表电子发烧友网立场。文章及其配图仅供工程师学习之用,如有内容侵权或者其他违规问题,请联系本站处理。 举报投诉
  • 图像
    +关注

    关注

    2

    文章

    1083

    浏览量

    40418
  • AI
    AI
    +关注

    关注

    87

    文章

    30146

    浏览量

    268421
  • 深度学习
    +关注

    关注

    73

    文章

    5492

    浏览量

    120978

原文标题:CVPR 2023|大脑视觉信号被Stable Diffusion复现图像!“人类的谋略和谎言不存在了”

文章出处:【微信号:vision263com,微信公众号:新机器视觉】欢迎添加关注!文章转载请注明出处。

收藏 人收藏

    评论

    相关推荐

    Stable Diffusion的完整指南:核心基础知识、制作AI数字人视频和本地部署要求

    的,其目的是消除对训练图像的连续应用高斯噪声,可以将其视为一系列去噪自编码器。Stable Diffusion由3个部分组成:变分自编码器(VAE)、U-Net和一个文本编码器。添加和去除高斯噪声的过程
    的头像 发表于 09-18 10:06 2305次阅读
    <b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>的完整指南:核心基础知识、制作AI数字人视频和本地部署要求

    Stability AI开源图像生成模型Stable Diffusion

    Stable Diffusion 的很多用户已经公开发布了生成图像的样例,Stability AI 的首席开发者 Katherine Crowson 在推特上分享了许多图像。基于 AI
    的头像 发表于 09-21 15:37 2909次阅读

    大脑视觉信号Stable Diffusion复现图像

    这项研究声称,只需用fMRI(功能磁共振成像技术,相比sMRI更关注功能性信息,如脑皮层激活情况等)扫描大脑特定部位获取信号,AI就能重建出我们看到的图像
    的头像 发表于 03-06 10:56 1688次阅读

    大脑视觉信号Stable Diffusion复现图像!“人类的谋略和谎言不存在了”

    它不需要在复杂的深度学习模型上进行训练或做精细的微调,只需要做好fMRI(功能磁共振成像技术)成像到Stable Diffusion中潜在表征的简单线性映射关系就行。
    的头像 发表于 03-08 10:21 737次阅读

    高性能计算HPC照亮AIGC未来:PC集群+Stable Diffusion 打造极致游戏体验

    随着计算能力和技术水平的不断提高,PC集群和Stable Diffusion集成在游戏行业中的应用将会更加广泛,可以为游戏开发者和分析师提供更多一流的工具和技术支持,从而推动整个游戏产业迎来新的发展机遇。
    的头像 发表于 04-20 11:46 801次阅读
    高性能计算HPC照亮AIGC未来:PC集群+<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b> 打造极致游戏体验

    一文读懂Stable Diffusion教程,搭载高性能PC集群,实现生成式AI应用

    PC Farm、生成式AI和Stable Diffusion模型都是非常有用的工具和技术,可以帮助用户快速构建和管理计算机集群,生成高质量的数据和图像,提高模型的泛化能力和鲁棒性。
    的头像 发表于 05-01 07:47 2290次阅读
    一文读懂<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>教程,搭载高性能PC集群,实现生成式AI应用

    使用OpenVINO™在算力魔方上加速stable diffusion模型

    Stable Diffusion 是 stability.ai 开源的 AI 图像生成模型,实现输入文字,生成图像的功能。Stable
    的头像 发表于 05-12 09:10 1399次阅读
    使用OpenVINO™在算力魔方上加速<b class='flag-5'>stable</b> <b class='flag-5'>diffusion</b>模型

    惊!大脑视觉信号Stable Diffusion复现成视频!

    大脑活动中重建人类视觉任务,尤其是功能磁共振成像技术(fMRI)这种非侵入式方法,一直是受到学界较多的关注。因为类似这样的研究,有利于理解我们的认知过程。
    的头像 发表于 06-02 16:51 937次阅读
    惊!<b class='flag-5'>大脑</b><b class='flag-5'>视觉</b><b class='flag-5'>信号</b><b class='flag-5'>被</b><b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b><b class='flag-5'>复现</b>成视频!

    优化 Stable Diffusion 在 GKE 上的启动体验

    Diffusion 等应运而生。Stable Diffusion 是一个文字生成图像Diffusion 模型,它能够根据给定任何文本输
    的头像 发表于 06-03 08:35 850次阅读

    基于一种移动端高性能 Stable Diffusion 模型

      Stable Diffusion (SD)是当前最热门的文本到图像(text to image)生成扩散模型。尽管其强大的图像生成能力令人震撼,一个明显的不足是需要的计算资源巨大,
    的头像 发表于 06-12 10:14 757次阅读
    基于一种移动端高性能 <b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b> 模型

    iPhone两秒出图,目前已知的最快移动端Stable Diffusion模型来了

    近日,Snap 研究院推出最新高性能 Stable Diffusion 模型,通过对网络结构、训练流程、损失函数全方位进行优化,在 iPhone 14 Pro 上实现 2 秒出图(512x512
    的头像 发表于 06-12 15:25 745次阅读
    iPhone两秒出图,目前已知的最快移动端<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>模型来了

    树莓派能跑Stable Diffusion了?

    Stable Diffusion是一种文本到图像生成的大型深度学习模型,它可以根据文本的描述生成详细的图像,也可以用于其他任务,如图像修复、
    的头像 发表于 07-26 11:46 1498次阅读

    Stable Diffusion的完整指南:核心基础知识、制作AI数字人视频和本地部署要求

    13400;i3 12100;i7 12700 ;i9 12900  在当今的数字时代,人工智能正在逐步改变人们的生活和工作方式。其中,Stable Diffusion作为一种深度学习技术,受到广泛关注。它能够通过对图像或视频
    的头像 发表于 09-07 14:12 2131次阅读
    <b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>的完整指南:核心基础知识、制作AI数字人视频和本地部署要求

    Stability AI试图通过新的图像生成人工智能模型保持领先地位

    Stability AI的最新图像生成模型Stable Cascade承诺比其业界领先的前身Stable Diffusion更快、更强大,而Stab
    的头像 发表于 02-19 16:03 895次阅读
    Stability AI试图通过新的<b class='flag-5'>图像</b>生成人工智能模型保持领先地位

    UL Procyon AI 发布图像生成基准测试,基于Stable Diffusion

    UL去年发布的首个Windows版Procyon AI推理基准测试,以计算机视觉工作负载评估AI推理性能。新推出的图像生成测试将提供统一、精确且易于理解的工作负载,用以保证各支持硬件间公平、可比的性能表现。
    的头像 发表于 03-25 16:16 837次阅读