在交互中,玩懂 AI 底层逻辑
16 2026 年 7 月 15 日 探索 AI 世界
这一期走进暗房——一朵雏菊先被揉碎成雪花,再一步步显影回来。今天所有的 AI 图像,都是这么洗出来的。 iris-wonderland 选编
本期 · Diffusion

扩散模型:
从噪声中显影

一朵雏菊,先被你亲手揉碎成雪花,再看它一步步显影回来。进去,亲手冲洗这张照片。
Ho et al. · UC Berkeley · 2020
显影台:从一团雪花里,洗出一朵雏菊
拖动拉杆 = 一步步去噪 · 这就是扩散模型生成图像的全部动作
去噪进度:第 20/20 步 · 每一步只擦掉一点点噪声
显影20/20
显影完成 —— 为什么非要一小步一小步走?进入本期,答案会让你亲手推出来
最受欢迎读者最常翻开的几篇
01
斯坦福 AI 小镇
Park et al. · Stanford / Google · UIST 2023
论文导读
02
大语言模型中的情绪概念
Sofroniew et al. · Anthropic · 2026
论文导读
03每个词,望向全句
注意力,就是你所需要的一切
Vaswani et al. · Google Brain · 2017
论文导读
04
造假者与鉴定师:GAN
Goodfellow et al. · Montréal · 2014
论文导读

探索 AI 世界

从模型、Agent、产品到商业,一个持续生长的 AI 空间
AI
斯坦福 AI 小镇
Park et al. · Stanford / Google · UIST 2023
25 个智能体住进一座小镇,没有剧本,派对却真的办成了——涌现第一次变得可以观察。
论文导读
AI
大语言模型中的情绪概念
Sofroniew et al. · Anthropic · 2026
没有人教过模型情绪,情绪概念的几何结构却自己长了出来。
论文导读
AI每个词,望向全句
注意力,就是你所需要的一切
Vaswani et al. · Google Brain · 2017
八页纸长出了今天的全部 AI。读懂它,后面每一篇都有了地基。
论文导读
AI
造假者与鉴定师:GAN
Goodfellow et al. · Montréal · 2014
两个网络互相较劲,直到假的骗过真的——「对抗」这个思想本身就足够优雅。
论文导读
AIresidual: 选择性回望
注意力残差
Kimi Team · Moonshot AI · 2026
残差连接用了快十年没人质疑,Kimi 问了一句:为什么每一层都要照单全收?
论文导读
AI3 个例子 → 学会
语言模型是少样本学习者
Brown et al. · OpenAI · 2020
「给几个例子就会了」——2020 年这句话像魔法,今天它是所有 prompt 的起点。
论文导读

具身智能

当 AI 长出眼睛和手——从看懂世界,到伸手改变它
具身
当 AI 长出手来:VLA 地图
Ma et al. · 2024–2026(持续更新)
语言模型会说话,但世界需要它伸手。这张持续更新的地图,讲清 AI 怎么长出身体。
论文导读
具身
RT-1:用笨功夫喂大的机器人
Brohan et al. · Google · 2022
17 个月、13 台机器人、13 万条演示——在大模型伸手之前,先看笨功夫能把机器人带多远。
论文导读
具身
RT-2:把机械臂挤进词表
Brohan et al. · Google DeepMind · 2023
把动作写进词表的那一刻,整个互联网的常识第一次流进了电机——VLA 这个词从这里诞生。
论文导读
具身
OpenVLA:拆开一台机器人大脑
Kim et al. · Stanford 等 · 2024
70 亿参数打赢 550 亿,还把全部零件摊在桌上——开源让所有人第一次能拆开一台 VLA。
论文导读
具身
π0:动作是长出来的
Black et al. · Physical Intelligence · 2024
离散的词说不出灵巧的手。π0 把「说动作」换成「长动作」——50Hz 的连续流,会叠衣服。
论文导读
具身
GR00T N1:人形机器人的快与慢
NVIDIA · 2025
慢想的大脑 × 快动的小脑,外加一座用梦境数据填底的金字塔——NVIDIA 给人形机器人打地基。
论文导读

AI 洞察

帮助你建立属于自己的 AI 判断力
No.62025-06
AI 创业者必读的 a16z 备忘录:五条新规则 + 依然管用的四种护城河
到 500 万美元年收入:SaaS 要 37 个月,新一代 AI 公司 9 个月。及格线换了,护城河没换。
No.52015
给创业者和投资人的聚合理论:三个问题,看清一家 AI 公司能走多远
Uber 没有车,Airbnb 没有房,Google 不写内容。十一年前的框架,正在预言 AI 这一章。

更大的世界

那些不会因为模型更新而过时的思想
人文另一种 AI 想象
想象一个有智能机器的未来
Dihal et al. · 剑桥 CFI · 2021
论文导读
探索
巴赫,或如何让一条线开口说话
对位 / 赋格 / 卡农
Iris 原创
探索C D E F G A B
音律的秘密
七个音的交互探索
Iris 原创
探索有限无限
有限与无限的游戏
James P. Carse · 1986
原作署名
探索欲望 平静
幸福操作系统
Naval Ravikant · 纳瓦尔宝典
原作署名
探索saccade → 缝合
跨眼跳工作记忆
Zhao et al. · Husain Lab · Oxford · eLife 2026
论文导读
读到值得推荐的内容?
投稿给 Iris →