大脑视觉信号被Stable Diffusion复现图像！-电子发烧友网

导读

“现在Stable Diffusion已经能重建大脑视觉信号了！”

一个听起来细思极恐的“AI读脑术”研究，在网上掀起轩然大波：

这项研究声称，只需用fMRI（功能磁共振成像技术，相比sMRI更关注功能性信息，如脑皮层激活情况等）扫描大脑特定部位获取信号，AI就能重建出我们看到的图像！

例如这是一系列人眼看到的图像，包括戴着蝴蝶结的小熊、飞机和白色钟楼：

AI看了眼人脑信号后，立马就给出这样的结果，属实把该抓的重点全都抓住了：

再发展一步，这不就约等于哈利波特里的读心术了吗？？

更有网友感到惊叹：如果说ChatGPT开放API是件大事，那这简直称得上疯狂。

所以，这究竟是怎么一回事？

用Stable Diffusion可视化人脑信号

这项研究来自日本大阪大学，目前已经被CVPR 2023收录：

研究希望能从人类大脑活动中，重建高保真的真实感图像，来理解大脑、并解读计算机视觉模型和人类视觉系统之间的联系。

要知道，此前虽然有不少脑机接口研究，致力于从人类大脑活动中读取并重建信号，如意念打字等。

然而，从人类大脑活动中重建视觉信号——具有真实感的图像，仍然挑战极大。

例如这是此前UC伯克利做过的一项类似研究，复现一张人眼看到的飞机片段，但计算机重建出来的图像却几乎看不出飞机的特征：

△图源UC伯克利研究Reconstructing Visual Experiences from Brain Activity Evoked by Natural Movies

这次，研究人员重建信号选用的AI模型，是这一年多在图像生成领域地位飞升的扩散模型。

当然，更准确地说是基于潜在扩散模型（LDM）——Stable Diffusion。

整体研究的思路，则是基于Stable Diffusion，打造一种以人脑活动信号为条件的去噪过程的可视化技术。

它不需要在复杂的深度学习模型上进行训练或做精细的微调，只需要做好fMRI（功能磁共振成像技术）成像到Stable Diffusion中潜在表征的简单线性映射关系就行。

它的概览框架是这样的，看起来也非常简单：

仅由1个图像编码器、1个图像解码器，外加1个语义解码器组成。

具体怎么work？

如下图所示，第一部分为本研究用到的LDM示意图。

其中ε代表图像编码器，D代表图像解码器，而τ是一个文本编码器（CLIP）。

重点是解码分析，如下图所示，模型依次从大脑早期（蓝色）和较高（黄色）视觉皮层内的fMRI信号中，解码出重建图像（z）和相关文本c的潜在表征。

然后将这些潜在表征当作输入，就可以得到模型最终复现出来的图像Xzc。

最后还没有完，如编码分析示意图，作者还构建了一个编码模型，用来预测LDM不同组件（包括图像z、文本c和zc）所对应的fMRI信号，它可以用来理解Stable Diffusion的内部过程。

可以看到，采用了zc的编码模型在大脑后部视觉皮层产生的预测精确度是最高的。（zc是与c进行交叉注意的反向扩散后，z再添加噪声的潜在表征）

相比其它两者，它生成的图像既具有高语义保真度，分辨率也很高。

还有用GAN重建人脸图像的

看完这项研究，已经有网友想到了细思极恐的东西：

这个AI虽然只是复制了“眼睛”所看到的东西。
但是否会有一天，AI能直接从人脑的思维、甚至是记忆中重建出图像或文字？

“语言的用处不再存在了”

于是有网友进一步想到，如果能读取记忆的话，那么目击证人的证词似乎也会变得更可靠了：

还别说，就在去年真有一项研究基于GAN，通过fMRI收集到的大脑信号重建看到的人脸图像：

不过，重建出来的效果似乎不怎么样……

显然，在人脸这种比较精细的图像生成上，AI“读脑术”还有很长一段路要走。

对于这种大脑信号重建的研究，也有网友提出了质疑。

例如，是否只是AI从训练数据集中提取出了相似的数据？

对此有网友回复表示，论文中的训练数据集和测试集是分开的：

作者们也在项目主页中表示，代码很快会开源。可以先期待一下~

作者介绍

本研究仅两位作者。

一位是2021年才刚刚成为大阪大学助理教授的Yu Takagi，他主要从事计算神经科学和人工智能的交叉研究。

最近，他同时在牛津大学人脑活动中心和东京大学心理学系利用机器学习技术，来研究复杂决策任务中的动态计算。

另一位是大阪大学教授Shinji Nishimoto，他也是日本脑信息通信融合研究中心的首席研究员。

研究方向为定量理解大脑中的视觉和认知处理，谷歌学术引用3000+次。

那么，你觉得这波AI重建图像的效果如何？

审核编辑：李倩

声明：本文内容及配图由入驻作者撰写或者入驻合作网站授权转载。文章观点仅代表作者本人，不代表电子发烧友网立场。文章及其配图仅供工程师学习之用，如有内容侵权或者其他违规问题，请联系本站处理。举报投诉

图像

图像

+关注

关注
2

文章
1091

浏览量
40892
AI

AI

+关注

关注
87

文章
33443

浏览量
274020
深度学习

深度学习

+关注

关注
73

文章
5546

浏览量
122278

原文标题：CVPR 2023｜大脑视觉信号被Stable Diffusion复现图像！“人类的谋略和谎言不存在了”

文章出处：【微信号：vision263com，微信公众号：新机器视觉】欢迎添加关注！文章转载请注明出处。

Stable Diffusion的完整指南：核心基础知识、制作AI数字人视频和本地部署要求

的，其目的是消除对训练图像的连续应用高斯噪声，可以将其视为一系列去噪自编码器。Stable Diffusion由3个部分组成：变分自编码器（VAE）、U-Net和一个文本编码器。添加和去除高斯噪声的过程

发表于 09-18 10:06 •2947次阅读

<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>的完整指南：核心基础知识、制作AI数字人视频和本地部署要求

Stability AI开源图像生成模型Stable Diffusion

Stable Diffusion 的很多用户已经公开发布了生成图像的样例，Stability AI 的首席开发者 Katherine Crowson 在推特上分享了许多图像。基于 AI

发表于 09-21 15:37 •3167次阅读

大脑视觉信号被Stable Diffusion复现图像！“人类的谋略和谎言不存在了”

它不需要在复杂的深度学习模型上进行训练或做精细的微调，只需要做好fMRI（功能磁共振成像技术）成像到Stable Diffusion中潜在表征的简单线性映射关系就行。

发表于 03-08 10:21 •940次阅读

一文读懂Stable Diffusion教程，搭载高性能PC集群，实现生成式AI应用

PC Farm、生成式AI和Stable Diffusion模型都是非常有用的工具和技术，可以帮助用户快速构建和管理计算机集群，生成高质量的数据和图像，提高模型的泛化能力和鲁棒性。

发表于 05-01 07:47 •2589次阅读

一文读懂<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>教程，搭载高性能PC集群，实现生成式AI应用

使用OpenVINO™在算力魔方上加速stable diffusion模型

Stable Diffusion 是 stability.ai 开源的 AI 图像生成模型，实现输入文字，生成图像的功能。Stable

发表于 05-12 09:10 •1738次阅读

使用OpenVINO™在算力魔方上加速<b class='flag-5'>stable</b> <b class='flag-5'>diffusion</b>模型

惊！大脑视觉信号被Stable Diffusion复现成视频！

从大脑活动中重建人类视觉任务，尤其是功能磁共振成像技术（fMRI）这种非侵入式方法，一直是受到学界较多的关注。因为类似这样的研究，有利于理解我们的认知过程。

发表于 06-02 16:51 •1145次阅读

惊！<b class='flag-5'>大脑</b><b class='flag-5'>视觉</b><b class='flag-5'>信号</b><b class='flag-5'>被</b><b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b><b class='flag-5'>复现</b>成视频！

优化 Stable Diffusion 在 GKE 上的启动体验

Diffusion 等应运而生。Stable Diffusion 是一个文字生成图像的 Diffusion 模型，它能够根据给定任何文本输

发表于 06-03 08:35 •1098次阅读

基于一种移动端高性能 Stable Diffusion 模型

Stable Diffusion （SD）是当前最热门的文本到图像（text to image）生成扩散模型。尽管其强大的图像生成能力令人震撼，一个明显的不足是需要的计算资源巨大，

发表于 06-12 10:14 •971次阅读

基于一种移动端高性能 <b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b> 模型

iPhone两秒出图，目前已知的最快移动端Stable Diffusion模型来了

近日，Snap 研究院推出最新高性能 Stable Diffusion 模型，通过对网络结构、训练流程、损失函数全方位进行优化，在 iPhone 14 Pro 上实现 2 秒出图（512x512

发表于 06-12 15:25 •996次阅读

iPhone两秒出图，目前已知的最快移动端<b class='flag-5'>Stable</b> <b class='flag-5'>Diffusion</b>模型来了

树莓派能跑Stable Diffusion了？

Stable Diffusion是一种文本到图像生成的大型深度学习模型，它可以根据文本的描述生成详细的图像，也可以用于其他任务，如图像修复、

发表于 07-26 11:46 •1801次阅读

Stable Diffusion的完整指南：核心基础知识、制作AI数字人视频和本地部署要求

13400;i3 12100;i7 12700 ;i9 12900 在当今的数字时代,人工智能正在逐步改变人们的生活和工作方式。其中,Stable Diffusion作为一种深度学习技术,受到广泛关注。它能够通过对图像或视频

发表于 09-07 14:12 •2883次阅读

Stability AI试图通过新的图像生成人工智能模型保持领先地位

Stability AI的最新图像生成模型Stable Cascade承诺比其业界领先的前身Stable Diffusion更快、更强大，而Stab

发表于 02-19 16:03 •1138次阅读

UL Procyon AI 发布图像生成基准测试，基于Stable Diffusion

UL去年发布的首个Windows版Procyon AI推理基准测试，以计算机视觉工作负载评估AI推理性能。新推出的图像生成测试将提供统一、精确且易于理解的工作负载，用以保证各支持硬件间公平、可比的性能表现。

发表于 03-25 16:16 •1178次阅读

如何开启Stable Diffusion WebUI模型推理部署

如何开启Stable Diffusion WebUI模型推理部署

发表于 12-11 20:13 •389次阅读

林超文PCB设计：PADS教程，PADS视频教程	郑振宇老师：Altium Designer教程，Altium Designer视频教程
张飞实战电子视频教程	朱有鹏老师：海思HI3518e教程，HI3518e视频教程
李增老师：信号完整性教程，高速电路仿真教程	华为鸿蒙系统教程，HarmonyOS视频教程
赛盛：EMC设计教程，EMC视频教程	杜洋老师：STM32教程，STM32视频教程
唐佐林：c语言基础教程，c语言基础视频教程	张飞：BUCK电源教程，BUCK电源视频教程
正点原子：FPGA教程，FPGA视频教程	韦东山老师：嵌入式教程，嵌入式视频教程
张先凤老师：C语言基础视频教程	许孝刚老师：Modbus通讯视频教程
王振涛老师：NB-IoT开发视频教程	Mill老师：FPGA教程，Zynq视频教程
C语言视频教程	RK3566芯片资料合集
朱有鹏老师：U-Boot源码分析视频教程	开源硬件专题

搜索历史

大脑视觉信号被Stable Diffusion复现图像！

评论

Stable Diffusion的完整指南：核心基础知识、制作AI数字人视频和本地部署要求

Stability AI开源图像生成模型Stable Diffusion

大脑视觉信号被Stable Diffusion复现成图像！

大脑视觉信号被Stable Diffusion复现图像！“人类的谋略和谎言不存在了”

一文读懂Stable Diffusion教程，搭载高性能PC集群，实现生成式AI应用

使用OpenVINO™在算力魔方上加速stable diffusion模型

惊！大脑视觉信号被Stable Diffusion复现成视频！

优化 Stable Diffusion 在 GKE 上的启动体验

基于一种移动端高性能 Stable Diffusion 模型

iPhone两秒出图，目前已知的最快移动端Stable Diffusion模型来了

树莓派能跑Stable Diffusion了？

Stable Diffusion的完整指南：核心基础知识、制作AI数字人视频和本地部署要求

Stability AI试图通过新的图像生成人工智能模型保持领先地位

UL Procyon AI 发布图像生成基准测试，基于Stable Diffusion

如何开启Stable Diffusion WebUI模型推理部署