让鲁迅说绕口令、赫本玩嘻哈,又一视频模型火了,斯坦福华人博士创立
让鲁迅说绕口令、赫本玩嘻哈,又一视频模型火了,斯坦福华人博士创立
AI 视频领域卷疯了。
Luma 引发的狂欢还没结束,AI 视频圈又来了个挑战者——
斯坦福大学团队出品的 Proteus。
据介绍,Proteus 是一款低延迟基础模型,可以生成高度真实且富有表现力的人物形象。
例如,让世界名画中的主角——蒙娜丽莎或者带珍珠耳环的女孩——肆无忌惮地大笑,面部表情自然流畅:
让奥黛丽 · 赫本一改往日淑女形象,玩起嘻哈说唱:
还让《哈利 · 波特》中的斯内普教授唱《Despacito》:
Proteus 刚发布,一众大佬发来「贺信」:
AI 科学家贾扬清称赞,实时人工智能头像质量出奇得好。
英伟达科学家 Jim Fan 则表示,这一项目令人印象深刻。
早期投资人 Brian Zhan 发文称,现有 AI 视频工具,比如 Runway 和 Pika,最大的问题就是会产生幻觉,尤其是在生成含有人类的视频时。而 Apparate Labs 通过解决时间连贯性和对象恒定性等问题,使 AI 视频生成步入下一个阶段。
离谱!鲁迅说起了绕口令
Proteus 是新一代的基础模型,用于人类的实时表情生成。
要知道,目前即便是最先进和最强大的生成模型,也无法完全实现人类表情的实时生成。
现有的模型运行速度缓慢,无法提供对生成人物的复杂面部表情和身体动作的直观控制,而且它们在逼真度和表现力方面仍有所欠缺。
而 Proteus 采用了最先进的 transformer 架构的潜在扩散模型,其创新性的潜在空间设计确保了实时的高效率,并且随着架构和算法的持续优化,Proteus 能够实现每秒 100 帧以上(100+ FPS)的视频流。
换句话说,只需一张简单的照片,Proteus 不仅能够模仿人类的笑声、说唱、歌唱、眨眼、微笑和对话,还能执行更多生动的表情和动作。
比如说,一向严肃的鲁迅说起了绕口令:
或者让居里夫人清唱《Le Festin》:
抑或是给科学家们开个圆桌会议:
据 Proteus 研发团队介绍,他们期望 Proteus 可以成为一个声音可控的视觉化身,为人工智能对话实体提供一个直观的交互界面,同时能够与众多多模态大语言模型无缝兼容,为各种不同的应用场景提供定制化服务。
对此,不少网友脑洞大开——
「只需要用爱因斯坦的数据对大语言模型进行微调,再配上他生动的面部表情,就能让伟大的爱因斯坦化身教学助手,来亲自教授物理课,青少年再也不用愁学不好科学了。」
还有网友表示,我爱死它了,今年绝对是 AI 视频之年。
起底背后团队
这款被大佬力捧、小而美的模型, 背后是个怎样的团队?
据官网介绍,这是由斯坦福大学的 Apparate Labs 研发出来的。
目前该团队仅 6 人,从名字和照片来看,有 3 人为华人。
首席执行官兼联合创始人沈博魁(William Shen)博士就读于斯坦福大学计算机科学系,由知名教授 Silvio Savarese 和 Leonidas J. Guibas 共同指导。
他的研究涵盖人工智能多个领域,包括计算机视觉、机器人学、图形学、生成模型和具身智能。其论文多次获奖,例如在 IEEE-CVPR 获得了最佳论文奖,还在 RSS 上入围了最佳学生论文奖的决赛。
此前,他还以 GPA4.0 的优异成绩获得斯坦福大学计算机科学学士学位。
首席技术官兼联合创始人 Connor Lin 也是个学霸。
他本硕就读于卡内基 · 梅隆大学,师从 Keenan Crane 教授。2020 年前往斯坦福大学攻读计算机博士。目前他是一名四年级在读博士生,由 Leonidas Guibas 和 Gordon Wetzstein 两位教授共同指导。
Connor Lin 的研究聚焦于 3D 先验知识和神经表示,用于 3D 重建、生成和编辑,曾获得 David Cheriton 斯坦福研究生奖学金的支持。
在攻读博士期间,他在谷歌研究、英伟达研究和 Adobe 研究实习。此前,还在谷歌担任软件工程师,负责 Pixel 手机的人像模式开发。
此外,这小哥兴趣广泛,喜欢旅行和体育,喜欢烹饪、羽毛球、游泳、桌游和音乐,还是泰勒 · 斯威夫特的铁杆粉丝
和 Connor Lin 一样,首席科学家 Linqi ( Alex ) Zhou 也是斯坦福大学的一名博士生,由 Stefano Ermon 教授指导。
此前,Linqi Zhou 在加州大学洛杉矶分校获得了计算机科学和应用数学的学士学位,由 Song-Chun Zhu 教授和 Ying-Nian Wu 教授指导。
他主要在计算机视觉和机器学习领域进行研究,并致力于构建能够以结构化和概率性方式理解世界的模型。
-
- 岚图加速上新,CEO曾否认“赶晚集”
-
2024-06-17 03:18:04
-
- 亚洲第一巨人:结婚20年没孩子,160妻子很无奈:生活很不方便
-
2024-06-17 03:15:48
-
- 横店影视城在哪里,浙江省东阳市(亚洲最大影视拍摄基地)
-
2024-06-16 10:00:21
-
- 鱼生全链条有标准!河源新立项10项农土特产地方标准
-
2024-06-16 09:58:04
-
- 衡水各区域新房房价走势 看看成交最好的小区在哪里?
-
2024-06-16 09:55:47
-
- watchOS 11 为苹果 Apple Watch 带来“实时活动”
-
2024-06-16 09:53:31
-
- 还是有很多不知道词根词缀小程序在哪里找……
-
2024-06-16 09:51:15
-
- 特斯拉押注 Optimus 机器人,明年超级工厂将部署超千台
-
2024-06-16 09:48:59
-
- 南宁市新民中学要搬迁?搬到哪里?校方发声明称……
-
2024-06-16 09:46:43
-
- 结束 14 年主机独占,PC 版《荒野大镖客:救赎》游戏已在路上
-
2024-06-16 09:44:27
-
- 骑士已经裁掉JR,他的下一站会是哪里?名记:不太可能是湖人
-
2024-06-16 09:42:10
-
- 微软将邀请社区成员再打磨 Win11 “回顾”功能
-
2024-06-16 09:39:53
-
- 丁凯乐退圈后成公司门面担当,录献礼MV稳当C位,长相却变糙了
-
2024-06-15 13:07:28
-
- 被黑洞吞噬的物体不会无缘无故消失,到底去哪里了?
-
2024-06-15 13:05:12
-
- 百年护校续写新辉煌
-
2024-06-15 13:02:55
-
- 取款需派出所同意?吉林银行回应:为了防范诈骗!该行今年屡遭监管处罚
-
2024-06-15 13:00:39
-
- 攻略:连云港不该错过的古镇老街在哪里
-
2024-06-15 12:58:22
-
- 山姆县城开店,布局下沉市场不过“虚晃一枪”
-
2024-06-15 12:56:05
-
- 端午楼市成交升温 “517新政”后市场热度提升
-
2024-06-15 12:53:48
-
- 现在的米莱,超级有意思
-
2024-06-15 12:51:31