分享好友 站长动态首页 网站导航

复原年传世名画,李彦宏要用颠覆内容行业

网友发布 2022-07-31 03:29 · 头闻号创业故事

如何实现“数字自由”,颠覆内容生产行业?一是通过标准化和平台化,吸引更多用户、企业、行业拥有数字人;二是基于平台的生态链服务,降低了数字人的高门槛和高投入。

作者|杨明

编辑|刘珊珊

305年,元代画坛巨匠黄创作的名画《富春》被誉为“中国传世十大名画”之一。

这幅画在民间流传已久,清朝顺治年间被烧。此后,它被分成了两卷。前一部分现在在浙江省博物馆,而较长的部分现在在台北故宫博物院。一幅名画,就这样遗憾的分开了几百年。

AI技术的迭代飞跃,让“组合”名作、重现江南形象成为可能——2022年世界大会上,600年前的富春山居图,利用文心大模的AIGC能力,一秒“重生”,富春山水进入全国观众的视线。

与老照片、电影、演唱会等其他二手AI修复技术不同的是,如果用户在App中搜索“富春山居图”,每个人都可以按照自己的想法“虚拟完成”自己的“富春山居图”。

从技术发展的角度来看,人人可补富春山居图是对下一代互联网Web3.0-Web3.0以去中心化、互动化理念的最好探索,可以让用户在共建共治的同时共享平台价值。

Web3.0又称Web3,是最近两年由加密货币和元宇宙共同推动的热词,被公认为互联网的下一个时代。在资本和互联网公司扎堆的情况下,Web3能否快速而现实地落地,一直被业界质疑。

答案出来了。从本届世界大会来看,除了著名的AI还原作品,AI数字人在不同场景的一系列应用案例,都是基于大众对Web3未来生活和数字人自由的想象。

无论是Web概念的祛魅到快速落地,还是数字人内容产业的迭代升级,都离不开AIGC赋予的强大生产力。“未来十年,AIGC将颠覆现有的内容生产模式。”创始人、董事长兼首席执行官李彦宏说。

01

人类进化的关键在AIGC。

“我今天起得太早了,又累又困。我想点一杯咖啡?”当央视主持人撒贝宁用“十级”粤语点咖啡时,杜潇潇能知道如何在几秒钟内下订单吗?

杜潇潇是目前这场大火中的人工智能数字人。在此之前,她和西蒙数码人共同演唱了《每一分每一秒每一天》这首歌,MV画面在全网刷屏。后来,她在写作、绘画、采访等方面表现出惊人的“天赋”。在各种场合。

相比唱歌、写字、画画,杜潇潇的挑战难度要高一倍——粤语本来就晦涩难懂,撒贝宁的个性化提问又极其棘手。她必须“听到”撒贝宁的话,快速“理解”这些话,实时转换成手语“动作”,直接在App上点单。

这意味着,与其他数字人相比,杜潇潇需要有更高强度的“大脑”运作,接近真人的情感理解,才能完成复杂的工作要求。

毫无疑问,数字人杜潇潇能否完成挑战,取决于她在AI技术上的迭代速度和“学习能力”。

人们最早可以追溯到2007年,那是在语音合成程序基础上开发的音源库“初音未来”。受限于技术,自此以后,数字人大多以二次形象出现。直到2016年,人工智能“绊爱”让虚拟主播热潮席卷全球。2021年元宇宙概念大火之后,数字人吸引了无数企业聚焦,资本追捧。

随着Web3大潮的涌动,数字人被赋予了更多的意义,已经从Web2世界“工具赋能”的辅助角色跃升为Web3世界不可或缺的基础设施——数字“原住民”。

因此,国内外互联网厂商往往通过数字人的“卡位”Web3的试验场和前哨来探索Web3。数字人的市场价值也在不断提升。IDC报告显示,中国AI数字人市场规模呈现快速增长趋势,预计到2026年将达到102.4亿元人民币。

打赢“卡战”并不容易。从技术角度来说,大部分数字人只能做简单的决策——大部分依靠“2D或3D模型+实时动作捕捉+声优配音”的模式,无法实现智能交互。他们在业内属于2.0阶段,在撒贝宁很难成功实现“十级粤式”咖啡点餐挑战。

作为继UGC和PGC之后的全新内容生产模式,不断进化的AIGC——顾名思义,即人工智能自动生成内容,已经成为业界的一种解决问题的思路。

AIGC不是一个新概念。近年来,许多人工智能虚拟数字人已经使用了AIGC功能。2015年国外有两个AIGC的案例,都是基于单点技术快速火起来的产品。但由于技术和成本的限制,大部分未能普及。

行业对AIGC功能的要求不断升级。最早的时候,AIGC只需要以假乱真,通过既定的画面或声音生成风格一致的内容。但在Web3时代,数字人用的是AIGC,不仅有基本的接近真实的需求,还拥有超强的创造力,学会了像人一样交流和工作。

为什么数字人对AIGC能力的要求越来越高?

“‘技术+应用+开发’三位一体,正在不断提升数字人类产业的‘天花板’。”市场研究机构IDC指出,PGC、UGC等生产模式已经不适合数字人本身的技术驱动和需求牵引。

从产品技术趋势来看,未来数字人将由AI驱动的内容生成,多模态AI技术是核心;交互会越来越智能;形象越来越逼真,从拟人到人形再到范,这只有才能实现。

按照行业趋势,未来几年人类和数字人将并存;从行业落地趋势来看,出行、工业、生活等千万个行业正在加速数字化转型和智能化升级——这意味着对AIGC能力的需求不仅限于数字人行业,而是应用于各行各业。

02

效率提升一千倍,颠覆现有生产模式。

就世界大会而言,AIGC能力的输出可以接近真人,甚至超过人类水平。

杜潇潇能在几秒内完成撒贝宁的“刁钻问题”,靠的是不断进化的AIGC能力——杜潇潇的“独立能力”在不断吸收海量数据的过程中呈指数级增长,不仅能准确捕捉和判断用户的搜索和服务需求,还能让与用户的互动更加生动有趣。甚至,她会问用户意想不到的问题。

这种逻辑化、个性化的交互和反馈,是杜潇潇在采用AIGC能力后,与其他数字人最大的不同。

《富春》最终“合山水”背后的核心技术,也来自于AIGC的“独立”修复能力——虽然原画被烧,后人无法知晓,但在黄纪念馆负责人毛传勇看来,“与现存原画风格一致,光色统一,山水脉络和谐,既符合原画的审美特征,又具有视觉欣赏价值”。

表演能力输出真假难辨。对AIGC来说更重要的是提高内容生产效率,让数字人的应用领域越来越广泛和深入。

目前,杜潇潇已经成为搜索能力的重要进化者。用户在App中搜索“你好”即可直接呼叫杜潇潇,通过“提问”快速匹配超过4万名受访者的专业回答,将技术连接到用户的最后一公里,进入“一人一个数字人”时代。

另一个AI数字人Hijiajia也会画画,写诗,作曲,会说多国语言,还会直播。在7月21日的发布会直播中,她还搭档撒贝宁担任AI的策划官和主持人,同时在现场几十秒内完成绘画。

在生产效率方面,AIGC有了明显的提高。比如一秒钟让一幅国宝名画变得完美,杜潇潇一秒钟写一篇散文,希佳佳在直播过程中几秒钟画一幅画——相比人类的生产效率,这是指数级的提升。

这是李彦宏认为AIGC将在未来十年颠覆现有内容生产模式的重要原因。“有可能以十分之一的成本,几百倍的制作速度,生成AI原创内容。”

在李彦宏看来,AIGC的自主学习能力也会创造出具有独特价值和独立视角的内容。

的确,在AI创作、AI绘画、AI构图、AI剪辑等内容创作领域,外界直观感受到的数字人的生产力早已远超普通人类。AI主播、AI创意、AI智能新闻播报等。也在进入应用场景深化。

所有这些都在推动AIGC的进一步发展。根据李彦宏的最新判断,AIGC将经历三个发展阶段:助手、协作和原创。

不断进化的杜潇潇和希加加人在很大程度上表明,AIGC能力正在加速从“协作”走向“原创”,推动数字人进入更加多元化的应用场景,迎来AIGC浪潮时代。

然而,从行业的角度来看,事实上,大多数AIGC能力输出仍处于“辅助”或“协作”阶段。

“数字人应该善用AIGC能力,这样就很难辨别真假了。技术难度非常大,成本非常高,最终导致制造成本更高,数字人生产效率低。”一位业内人士表示。

AIGC从业者陈宇恒在接受媒体采访时也提到,AIGC分为两部分:一部分是图像端AI,包括骨骼动画生成、面部表情生成、人物周围动作捕捉等技术;二是逻辑AI,包括语义理解、语言模型、对话机器人等围绕语言对话的技术。“无论哪一方,都面临着技术和成本门槛的问题。”

这方面的案例很多。刘利用了的能力,从去年10月开始以《捉妖记》短视频走红,10个月仅发布19部作品,远远不能满足用户的高频需求。2021年,英伟达使用34名3D艺术家和15名软件研究人员制作了21个版本的黄仁勋。才呈现出一个真伪难辨的“数字人”。

AIGC能力的差异已经成为引领数字产业的重要原因。最新数据显示,杜潇潇在“2022虚拟数字人商业价值潜力”榜单中排名第一;在更多第三方机构公布的榜单中,依托AI的全栈能力,位居数字人综合实力第一。

03

降低AI创作门槛,实现“数字人的自由”

是什么原因导致了AIGC的能力?

原因似乎很简单。无论是AI数字人,还是“完成”富春山居图,AIGC背后的技术支持都离不开搜索引擎海量数据的先天优势,工业级深度学习平台飞橹和工业级“知识增强”大模型文心的AI综合沉淀能力,以及由此带来的创作门槛和创作成本的大幅降低。

2016年,搭建了中国首个自主研发、开源开放的工业级深度学习平台Feipaddle。2019年,以飞桨为基础,开始深化前期训练模型的研发,从大规模知识和海量数据中整合学习,打造具有“知识增强”能力的大文学模型。

比如数字人的绘图能力,用的是文学心智的大模型——跨模态图形生成模型ERNIE-ViLG;;而人的对话能力用的是对话生成的大模型——文献柏拉图,柏拉图拥有接近真人水平的对话能力,对话效果达到了世界领先水平。

富春山居图的组合是文艺造型能力的完整体现:首先,它学习了大量的中国山水画,实现了从“小白”到“大师”的进阶,然后它能使完成的画作与现存的原作保持一致。

这就是“视觉生成大模型+单样本微调”的技术策略,意味着这种模型可以在更多书画文物的修复和普通人的书画艺术创作中发挥重要作用。

除了AIGC方向,文心大模型还广泛应用于搜索、信息流、智能音箱等互联网产品。,并通过飞桨开源平台,智能云赋能工业、能源、金融、通信、媒体、教育等行业,帮助成千上万个行业降本增效、智能化升级。

这就是大脑、飞桨、文模等综合AI技术的核心价值——降低生产成本,实现大规模应用。

在数字人行业中,帮助解决落地难问题是关键——产业链碎片化、服务场景与演艺场景缺乏有效沟通、满足高频需求成本高,是当前行业公认的数字人落地难题,也是实现“数字人自由”的最大障碍。

这些问题归根结底就是数字生活的生产力和生产成本。解决问题的思路是,通过AI的底层技术支持和成熟实践,打造了一个数字人平台“智能云西岭”,大大降低了数字人的生产成本和生产周期。

目前,“西岭”已经形成了“AI数字人家庭”,拥有数十万像晓晓这样能力的数字人。最重要的是,普通用户也可以通过“日出”快速生成自己的数字人像——只需上传一张照片,你就可以在几分钟内生成一张可以由AI驾驶的2D数字人像。过去需要两三个月制作的3D数字模型现在可以压缩到一两周。而且这些数字人的AIGC能力非常成熟,ASR准确率可以达到98%以上。

不少业内人士认为,这是实现“数字人自由”的重要方向:一方面,通过标准化和平台化,吸引更多用户、企业、行业拥有数字人;另一方面,基于平台的生态链服务降低了数字人的高门槛和高投入。

这给了我们更大的机会在数字人行业领先。“AI数字人家庭”最初集中在金融、银行、供应商客户,现在增加到广播、互联网娱乐、传统行业等众多B端客户。此外,对C端的需求也在增加——比如很多品牌的虚拟代言人合作需求。

04

敲开Web3.0,体现中国实力

“未来,每个企业、每个人都会有一个甚至更多专属的数字人。”2019年4月,李彦宏在与浦发银行的数字人合作会上如此表示。

近两年来,随着B端和C端并驾齐驱,以及更多数字人在各种场景中的应用,这一愿景逐渐成为现实。

所有这一切都源于人工智能领域的压力和马拉松式的RD投资。公开数据显示,在RD投资方面,2021年核心研发支出221亿元,RD投资强度位列中国民营企业500强第一。

如今,AI早已成为引擎之一。很多AI相关的技术,比如oar,文心大模型,深度语音系统,大脑,secret,Apollo自动驾驶平台等。,都是不计成本的注脚。

这将为未来的元宇宙和Web3时代打下坚实的基础——web 3衍生出的三大基础设施是数字人、数字馆藏和元宇宙。除了AI数字人,其他两个方面都是基于AI能力的深度布局。

数字馆藏是支撑Web3经济体系的核心要素。2017年,区块链技术部成立,2022年,超链数字产品平台上线。如今,超链已经推出了30多个全场景、全行业、全领域的解决方案,创造了众多标杆案例。

今年6月,我国探月航天以数字集合的形式发布了首艘数字载人飞船“梦想号”,并招募了1万名“Tai 空数字乘客”登上Tai 空,依托超级链技术。

宇宙是一个开放的Web3数空。去年12月,在AI开发者大会上发布了超宇宙产品“西让”。智能汽车品牌“杜畿”的首款汽车机器人概念车在西让全球首发。

这些都让它在大厂打造Web3的竞争中处于行业领先地位——相比“社交+Web3”、“支付+Web3”、“电商+Web3”等模糊概念,它无疑是第一个敲开Web3大门的。

“相对于直接与消费者交互的‘前端’,正在布局的是能够支撑Web3的‘后端’,即从底层技术到产品再到标准化解决方案的基础设施。”品牌负责人曹雨欣曾这样介绍。

如今在业内,互联网大公司Web3情绪火热,争夺下一代互联网的话语权。包括meta、谷歌、亚马逊、阿里、腾讯、字节跳动、华为、Twitter、易贝、网飞等。,已经全部冲进了游戏。但无论怎么竞争,都需要让用户和行业真正感受到实实在在的变化。

这还是需要依靠AI的全栈能力。至少在没有直播无人驾驶技术的时候,因为频繁提及“驾驶”被直播系统判定为非法,从而断了直播的“梗”。

从这个角度看,当出行、工业、生活等千万个行业都在加速数字化转型、智能化升级——AI digital等基础设施上的大规模应用,是内容生产模式的颠覆性变革,也是Web3中国重要力量的体现。

免责声明:本平台仅供信息发布交流之途,请谨慎判断信息真伪。如遇虚假诈骗信息,请立即举报

举报
反对 0
打赏 0
更多相关文章

评论

0

收藏

点赞