Lucky

李飞飞,从移民到 AI 明星
大家知道李飞飞吧,AI 的明星教授。

她在斯坦福大学任教,是美国国家工程院等三院院士,担任过斯坦福 AI 实验室主任,以及谷歌云 AI 首席科学家。
她1976年出生于北京,在成都长大,16岁全家移民美国。
我一直好奇,她怎么走上 AI 这条路,从移民变成学术明星?

这几天,我读完她的自传《我看见的世界》(中信出版集团,2024),才发现她的人生很有戏剧性,每当重要关头,都有幸运的事情发生。
(1)高中阶段
她出生于一个普通家庭,中学阶段并无过人之处。
我们家位于成都当时的外环路旁边,小区由三栋一模一样的塔楼组成,我家住在四楼。这个环路是不断扩张的城市边缘,一侧是工厂,另一侧是农田。 我进入了一所吸引全市优秀学生的中学。在那几年里,对女孩的预设和偏见让我越来越不耐烦,这种情绪已经超出了课业的范围。在同龄人中,我已经有"假小子"的称号。
1992年,移民美国后,她家的生活顿时变得困难。一家三口挤在新泽西乡下一间一居室公寓,她睡客厅,床就放在餐桌旁边。
父亲在一家华人商店修理旧相机,后来被辞退,从此失业。母亲做杂货店营业员,后因风湿性心脏病,回家休养。李飞飞下课后,就要去打工,有时在中餐馆端盘子12个小时,每小时2美元。
最后,实在走投无路,她们家决定买下社区的一家干洗店,靠洗衣为生。买下干洗店需要10万美元,全家仅有2万美元储蓄,其余8万美元都是借的。
(2)大学阶段
1997年,李飞飞中学毕业,要申请大学了。
一开始,我的目标大学主要是州立大学和社区大学,而不是常春藤学校。但我一直对一所顶级高校念念不忘,那就是普林斯顿大学。 我们是一个靠从车库市场淘来的旧货才能勉强度日的家庭,连我用的计算器都是坏的,我们怎么可能负担得起常春藤学校的学费呢? 尽管如此,我还是无法抑制内心的冲动,提交了申请。就算只是象征性地申请一下,我也感觉具有特殊意义。
她申请了普林斯顿大学,结果好梦成真,普林斯顿给了全额奖学金。
如果没有全奖,以她家的经济状况,负担不了学费。如果不去普林斯顿大学,她就不太可能走上学术道路了,更不要说后面的成就了。
(3)博士阶段
大学毕业后,李飞飞原想去华尔街工作,解决家庭的经济问题。
母亲鼓励她,继续追求自己的梦想。于是,她选择去加州理工学院读研究生,方向是视觉识别机制。
2004年,李飞飞为了写博士论文,需要图片材料,来训练算法。她找了9000张图片,组成了一个图片集,手工对每张图片进行分类标注,一共分成101类。
这个图片集叫做 Caltech 101,算法经过训练,就能从新图片识别出这101类物品。她因此顺利拿到了博士学位。
(4)助教阶段
博士毕业后,李飞飞先去伊利诺伊大学,后去普林斯顿大学,都是担任计算机科学的助教。
她继续探索视觉识别,想找到一种通用算法,能够识别所有种类的物品,而不是 Caltech 101 那样,只能识别出101类物品。
这意味着她需要一个超大的图片训练集,能够包含了世界上所有物品。这可太难了,所有人都反对这件事。
我们都是年轻的助理教授,所处的院系竞争激烈,在事业起步的那几年里,我们都面临着"要么发表论文,要么完蛋走人"的局面。压力之下,我们必须马不停蹄、保质保量地完成工作,因为我们知道,稍有懈怠就可能与终身教授的职位说再见,一同失去的还有获得稳定生计的最佳机会。 我听到的劝阻之声已经多得够我用一辈子了(可能下辈子也够了). 有上万个类别的数据集有什么用?大部分模型连一两个类别都识别不准! 你知道用这么多图像训练一个模型要花多长时间吗?这个时间可是用"年"来计算的。 别人要怎么下载呢?你这个图像总量比大多数硬盘的存储量还要大。 具体怎么做,你有计划了吗?几百万张图谁来做标注?要花多长时间?怎么验证所有内容的准确性呢?
(5)ImageNet
李飞飞坚持要做,这个通用图片集起名为 ImageNet。那时是2006年。
她想到一个思路,英语词典有一些基本名词,用来解释其他所有物品。只要统计一下,基本名词有多少个,每一个又有多少变体,那就得到了所有物品的基本类别。
统计结果是3万类。因此,李飞飞估计,ImageNet 将有3万个类别,总共包含2000万张图片,每张图片都要有分类和标注,需要从几亿张图片里面筛选出来。
我们发出了邮件,招募愿意帮忙从网上下载和标注图片的本科生,工作时间灵活,每小时10美元。我们招募到一些学生,但是按照这样的进度,完成整个项目需要19年。
这太慢了,项目方法做了改进,用脚本自动去谷歌搜索图片,然后抓取。但是这样也需要人工核对和筛选,只把19年的时间缩短到18年。
幸运的是,亚马逊刚刚发布了众包平台"土耳其机器人"(Amazon Mechanical Turk,AMT)。在这个平台上,你可以出钱,通过互联网,把任务分包给世界各地接活的人。
他们通过这个平台,将 ImageNet 分包出去,投入的人数一下子扩展到几千人,而人均费用只是原来的几十分之一。
2009年6月,ImageNet 的初始版本终于完成了。我们成功达成了目标:收集了1500万张图片,涵盖了2.2万个不同类别。这些图片筛选自近10亿张候选图片,并由来自167个国家的4.8万多名全球贡献者进行了标注。
(6)ILSVRC 算法竞赛
ImageNet 虽然完成了,但在学术界毫无反响,没有太多人关注。
我们遇到了第一个也是最严重的挫折:在当年的"计算机视觉与模式识别大会"上,ImageNet 被降级为"海报展示"。 所谓的"海报展示"是一个学术术语,意味着我们将不能在演讲厅内向听众展示我们的工作,只能在会场的指定区域里摆放一幅印有项目摘要的大幅海报,希望能引起路人的兴趣。 我想过 ImageNet 可能被证明是对的,也可能被证明是错的,对于这两种可能性,我都做好了准备。无论是哪种结果,都会是一个学习的机会。然而,我万万没想到,它被忽视了。
由于 ImageNet 得不到承认,李飞飞想到一个办法,她要每年举行一次算法比赛,看看哪种算法识别 ImageNet 图片集的正确率最高。
这样一来,在计算机视觉领域,ImageNet 就会成为一个比较基准,各种算法都需要用它表示自己的识别能力,大家就不会忽视它了。这个比赛叫做 ILSVRC(ImageNet 大型视觉识别挑战赛,ImageNet Large Scale Visual Recognition Challenge)。
2010年,第一届比赛令人失望,11个团队提交了35个参赛算法。冠军算法是传统的图片向量比较,并无创新之处,正确率也不高。
2011年,第二届比赛更惨,获胜算法还是图片向量比较,正确率只提高了2个百分点。这意味着,没有任何创新和进展。
最糟糕的是,参赛人数也出现急剧下降,参赛算法从35个减少到15个,愿意为此付出努力的人似乎越来越少。 说这种经历"让人羞愧"已经远远不足以描述我们的心情了。为了推动 ImageNet 的发展,我们倾注了多年的心血,搜集的图片数量远远超过以往的任何数据集,还精心策划了一场国际竞赛来探索它的能力,但结果却只是简单地重复了现状。如果说ImageNet 是一场赌注,是时候开始思考我们是不是已经输了。
眼看这个项目就要失败了,几年的心血付之东流。就在这个时候,李飞飞人生最大的惊喜和反转来临了。
2012年,第三届比赛,一个加拿大团队使用被学术界遗忘已久的卷积神经网络,一举将图片识别正确率提高了10%。
接下来的事情,就是被写进教科书的历史了。全世界被神经网络的效果轰动了,AI 研究出现突破,人类进入 AI 时代。
李飞飞彻底翻身,一举成名,从助教变成世界知名的 AI 研究领头人物,人生从此海阔天空。
她的故事令人感叹,如果神经网络算法没有在2012年出现,而是再晚几年,或者更早一点,亚马逊的土耳其机器人众包平台没有在2005年诞生,一切会怎样?
这就是时运吧。科学家的人生和科学发现一样,都是由一些偶然事件推动的。个人奋斗固然重要,但是关键时刻还是离不开幸运。












https://fly88.select/ mình thấy nó hiện trên mấy chỗ mọi người nhắc nên mở ra xem thử cho biết, kiểu lướt nhanh thôi chứ cũng không có đào sâu gì; vào trang cái là nhìn được hướng đi luôn vì cái menu để ngay chỗ dễ thấy, chuyển qua lại mấy mục không phải đoán già đoán non, mình vốn hay ngại mấy trang bố cục rối nhưng ở đây các khối nội dung xếp dạng ô nên mắt bắt nhanh, kéo xuống cũng không bị loạn; thêm cái bảng thông tin trình bày theo cột gọn gàng nên đọc lướt vẫn hiểu ý, nói chung mình vẫn giữ chút cảnh giác như thường nhưng ít nhất trải nghiệm nhìn và…
Đang nói chuyện về trải nghiệm lướt web nên mình chen chút xíu: 32WIN lúc mình ghé thử cho cảm giác khá “dễ thở”, kiểu không cần căng não mới tìm được thứ mình muốn xem. Mình thích nhất là cái menu để ngay chỗ dễ nhìn, bấm qua lại mấy mục thấy mượt và nhanh, không bị kiểu phải mò từng góc như vài trang khác; với lại họ chia nội dung thành từng khối rõ ràng, kéo xuống là thấy mỗi phần tách bạch nên mắt đỡ mệt, đọc lướt vẫn bắt được ý chính. Mình còn để ý mấy bảng thông tin dạng cột nhìn gọn ghẽ, số với tiêu đề xếp thẳng hàng nên liếc cái…
rr88 có dễ dùng không? Mình thấy là có. Lúc vào thử mình để ý ngay là bố cục họ làm kiểu gọn, các khối nội dung chia rõ nên lướt xuống vẫn theo được, không phải căng mắt tìm cái mình cần, nhìn chung hợp kiểu đọc nhanh trên điện thoại. Thêm nữa, phần liên quan giao dịch thao tác khá trơn, mấy bước cơ bản đi thẳng một mạch chứ không bắt nhảy qua lại nhiều trang, nên cảm giác đỡ bực và đỡ mất thời gian; mình chỉ xem qua thôi mà vẫn thấy nó “mượt” theo kiểu ít giật, ít rối. Có điểm mình thích là họ để mục thông tin nguồn gốc pháp lý ngay…
Stratea AI showed up in my feed when people were talking about turning a half-baked idea into an actual business plan, so I poked around out of curiosity. I didn’t generate anything deep, just skimmed the copy and how they frame the whole “generic AI chat” problem. It was kinda refreshing that they straight-up mention that endless prompting loop where you still end up piecing together the market, pricing, and execution stuff yourself. The page also felt easy to move through without getting lost—more like a guided flow than a giant essay. Everything’s broken into short chunks with clear headings, and the main buttons are obvious without screaming at you. The comparison-style bits are stacked in a simple vertical layout…
Mình chơi xổ số chủ yếu để giải trí, nên chuyện trúng hay trượt mình không đặt nặng lắm, coi như thêm chút hồi hộp cho vui. Thỉnh thoảng mình đọc các chia sẻ về chu kỳ, tần suất xuất hiện, rồi cách ghép cặp số, thấy cũng có vài góc nhìn đáng thử. Có đợt mình thử soi cầu xsmb theo bộ số quen tay, rồi để ý thêm mấy dấu hiệu kiểu lô rơi, kết quả lúc khớp khá ổn, lúc thì lệch hẳn. Từ đó mình tự nhắc là chỉ tham khảo thôi, đừng tin tuyệt đối. Mình thấy quan trọng nhất vẫn là giữ tâm lý nhẹ nhàng, tự đặt giới hạn, và ghi lại vài…