首次发现!AI脑回路演化向人类更进一步,OpenAI最新研究引热议
2021/03/05 15:07AI云资讯10835
两个月前轰动网络的AI设计大师CLIP,刚刚被OpenAI“扒开”了脑子。
没想到,这个性能强大的AI竟和人类思维方式如此相像。

打个比方,无论你听到“炸鸡”二个字,还是看到炸鸡实物,都可能流口水。因为你的大脑里有一组“炸鸡神经元”,专门负责对炸鸡起反应。
这个CLIP也差不多。
无论听到“蜘蛛侠”三个字,还是看到蜘蛛侠的照片,CLIP的某个特殊区域就开始响应,甚至原本用来响应红色和蓝色的区域也会“躁动”。

OpenAI发现,原来CLIP有一个“蜘蛛侠神经元”。
在脑科学中,这并不是啥新鲜事。因为早在15年前,研究人脑的科学家就发现了,一张脸对应一组神经元。
但是对AI来说却是一个巨大的进步。过去,从文字到图像,和从图像到文字,用的是两套系统,工作方式都不一样。
而CLIP却有着和人脑极为相似的工作方式,CV和NLP不仅技术上打通,连脑子里想的都一样,还有专门的处理区域。
看到二者如此相像,有网友表示:
太可怕了,这说明通用人工智能(AGI)到来,比所有人想象的都快。

而且,OpenAI还惊讶地发现,CLIP对图片的响应似乎类似与癫痫患者颅内神经元,其中包括对情绪做出反应的神经元。说不定AI今后还能帮助治疗神经类疾病。
AI的“脑子”,其实和人类一样
先前情回顾一下,CLIP到底是神马。
不久前,OpenAI发布了脱胎于GPT-3的DALL·E,能按照文字描述准确生成图片。

DALL·E对自然语言和图像的理解和融汇贯通,做到了前无古人的水准。一经问世,立刻引来吴恩达、Keras之父等大佬点赞。

而DALL·E的核心部分,就是CLIP。
简单的说,CLIP是一个重新排序模型,检查DALL·E所有生成结果,挑出好的展现出来。
CLIP能做“裁判”,离不开将文字和图片意义“融合”理解的能力,但这样的能力从哪来,之前人们根本不清楚。
OpenAI紧接着深挖CLIP神经网络的原理结构,发现了它的多模态神经元,具有跟人类大脑类似的工作机制:能够对文字和图像中的相同意义同时做出响应。

而所谓模态,是指某个过程或某件事,包含多个不同的特征,图像通常与标签和文本解释相关联,是完整理解一个事物的要素。
比如,你看到蜘蛛侠三个字,或者是Spiderman,都能联想起穿着红蓝紧身衣的超级英雄。
熟悉这个概念以后,看到这样一幅黑白手绘,你也能马上明白这是“蜘蛛侠”:

CLIP中的多模态神经元,能力与人类没有任何区别。
这样专门负责某个事物的神经元,OpenAI发现了好几个,其中有18个是动物神经元,19个是名人神经元。
甚至还有专门理解情绪的神经元:

其实,人本身就是一个多模态学习的总和,我们能看到物体,听到声音,感觉到质地,闻到气味,尝到味道。
为了让AI摆脱以往“人工智障”式的机械工作方式,一条路径就是让它向人一样能够同时理解多模态信号。
所以也有研究者认为认为,多模态学习是真正的人工智能发展方向。
在实现过程中,通常是将识别不同要素子网络的输出加权组合,以便每个输入模态可以对输出预测有一个学习贡献。

根据任务不同,将不同的权值附加到子网后预测输出,就能让神经网络实现不同的性能。
而具体到CLIP上,可以从研究人员的测试结果中清楚的看到,从语言模型中诞生的它,对于文字,比对图像更加敏感。
攻击AI也更容易了
但是,文字和图像在AI“脑海”中的联动是一把双刃剑。
如果我们在贵宾犬的身上加上几串美元符号,那么CLIP就会把它识别为存钱罐。

OpenAI把这种攻击方式叫做“印字攻击”(typographic attacks)。
这意味着,我们可以在图片中插入文字实现对AI的攻击,甚至不需要复杂的技术。
只需一张纸、一支笔,攻破AI从未如此容易。
苹果就这样被改装成了“苹果”iPod。
△CLIP:iPod就是“苹果”产品,没错啊~
甚至还有网友把苹果改装成了图书馆。

中国网友应该更加熟悉,看来我们可以像用符咒封住僵尸一样封住AI。

在防止对抗攻击这件事上,CLIP还有很多工作要做。
AI黑匣子没那么黑
即便如此,“多模态神经元”依然是在AI可解释性上的重要进展。
可用性和可解释性就像鱼和熊掌。
我们现在用的正确率最高的图像识别模型,其可解释性很差。而可解释AI做出的模型,很难应用在实际中。
AI并不能满足于实用。AI医疗、无人驾驶,如果不能知其所以然,伦理道德就会受到质疑。
OpenAI表示,大脑和CLIP这样的合成视觉系统,似乎都有一种非常相似的信息组织方式。CLIP用事实证明,AI系统并没有我们想象的那么黑。
CLIP不仅是个设计大师,它还是一个开放大脑的AI,未来也许减少人工智能错误与偏见。
相关文章
- 忆联Gen5 QLC AE631即将面市:性能看齐TLC,唤醒本地AI算力
- AI体验+视频下载增强+工具箱 华为浏览器焕新适配暑期场景
- 华为云与滴普科技联合发布数据智能解决方案,加速制造与零售行业AI落地
- “智天哨兵”出战 全国首个AI无人机巡检落地湖北襄阳
- 权威认可!浪潮数据双重收获:参编AI云基础设施系列标准,助力东营算力中心入选2026可信云创新应用实践
- 动码印章携全系列AI智能印控解决方案登陆全球商业创新大会
- 助力企业 AI 落地,南凌科技「智枢 AI 网关」让大模型接得快、用得稳、看得见、算得清
- 战略转型全面落地丨卓特视觉新版官网焕新上线,构建数创协同的 AI 服务新底座
- 数据管理国标“天花板”!百度胜算拿下AI云首张五级通行证
- AI 赋能 “机器管”,三亚市阳光招采服务平台正式上线运行
- 维谛技术(Vertiv):电冷耦合重构算力底座 筑牢AI算力新底座
- 中电金信:中国银行业IT解决方案领跑者,以全栈AI与数字底座驱动金融数字化转型
- 跻身 IDC MarketScape领导者!中关村科金以企业级 AI 全栈能力赋能千行百业
- 聚力AI创新,赋能千行百业!AI Show 2026杭州人工智能与机器人展将于9月9日启幕
- 蚂蚁集团领投,老股东超额跟投加注,戴盟两月内连获数亿元融资,以全栈触觉能力破局物理AI
- 驾驭AI,数智融合新底座|用友BIP技术峰会圆满举行
AI企业
更多>>AI硬件
更多>>- 联合开源!因时机器人携手上海交大、复旦发布HandEdit数据集与评测基准
- 华沿机器人与骅升科技达成战略合作,携手布局具身智能与协作机器人市场
- 元点机器人Bridge斩获IFA年度创新奖,全球首款AI原生人形机器人柏林首秀
- 华硕 ProArt 创梦 27 OLED:以 4K QD-OLED 与专业色彩表现,支持精细化创作
- 芯展速 Gen 6 Retimer 正式上市,副总裁李蓁 ODCC大会演讲官宣 获媒体热议
- 行业首款60℃热雾巨无霸滚筒扫拖旗舰!iRobot Roomba 875发布,重新定义扫地机器人清洁力
- 华硕主板助国产颗粒内存达成四槽满插6000C30与双条8000C36双重突破
- 首日销量突破600台!8888元的元点机器人Bridge正在赢得开发者
AI产业
更多>>AI技术
更多>>- 全球最强开源模型 Kimi K3 发布,参数规模 3 万亿,真的是强!
- 范式变革!东软发布AI原生软件工程白皮书,重构软件产业底层逻辑
- KAT-Coder-Pro V2.5正式发布:从“写代码”迈向“做工程”,Agentic能力全面升级
- 自变量机器人王昊:训练世界模型需付出“时间税”,解决模态对齐是当务之急
- 腾讯发布CodeBuddy Security,用AI Agent实现更高效的代码审计
- Twinkle x昇腾,率先实现Deepseek-V4系列模型高效训练
- 高德发布鸿蒙首个生成式 UI 开源框架 AGenUI,告别传统 UI 开发模式
- 发布即适配| 天数智芯全力支持腾讯混元Hy3 preview 开源落地,共推国内大模型产业普惠









