0
0
在微信中打开

零门槛用AI画漫画,跨模态内容创作进入next level

零门槛用AI画漫画,跨模态内容创作进入next level 深响
2024-04-23
1298
导读:这些需求很普遍,但在以前很难实现。大部分人没接受过绘图、分镜训练,即使能想象出精彩画面,创意也无法落地。但借助百度文库,一切都变得可行。
AI这把火,烧了一年多。现在,有AI可以帮你写PPT,有的会写歌,有的能帮公司批量生成营销素材,有的擅长“量子速读”提炼长文本。总之,几乎每个月都有AI热点出现。

各种热点背后,有两个事情值得注意:

第一,实践证明,AI落地一定是贴近已有需求,用原先无法想象的效率,完成用户想做或必须做的事;第二,已有的AI应用涉及文本、音频、图像等多种形式,但大多处于分散状态。如果它们能被整合成一个多模态一站式AI应用平台,AI落地会更加广泛。

 百度文库是“跨模态+一站式“内容创作的AI原生应用代表。在Create2024百度AI开发者大会上,百度创始人、董事长兼首席执行官李彦宏介绍了百度文库的新成果——智能漫画和智能画本功能。李彦宏表示:“百度文库的智能漫画能力,极大地提高了创作漫画的效率,降低了漫画创作的成本和门槛,可以让更多有想法、有创意的人实现自己的漫画创作梦。”

 除了生成漫画和画本,用户还可以在百度文库生成研究报告、PPT、文档、思维导图,还能进行拍图生文等等。百度集团资深副总裁、百度移动生态事业群组总经理何俊杰表示:“大语言模型重新打开了文库的想象空间,它已经进化为一站式AI内容创作平台。”

创意如何轻盈落地

如何理解百度文库的新成果?我们不妨从直观的体验开始讲起。

如果你爱看漫画和小说,肯定有过这样的时刻——这部漫画剧情太精彩了,可是作者更新好慢,真想替他画下去;作品里这两人CP感好强!好想做二创;这部玄幻小说设定有意思,要是文字能变成漫画就更好了。

如果你是家长,在给孩子讲故事时肯定也有过这样的想法:孩子对故事里的场景和动物有些陌生,理解起来有困难,有对应的绘本就简单多了。

这些需求很普遍,但在以前很难实现。大部分人没接受过绘图、分镜训练,即使能想象出精彩画面,创意也无法落地。但借助百度文库,一切都变得可行。

例如,《周处除三害》是一个在《晋书》和《世说新语》里都有记载的历史故事。用户可以借百度文库,用简单几个步骤,把年代久远的文字转变为生动的画面:

  • 在百度文库上,只需要输入《周处除三害》相关的「一句话」主题,百度文库将检索相关内容,自动生成完整的故事分镜和脚本

  • 用户进行内容调整后,可以选择多种漫画风格,设定多种角色形象;

  • 设置完毕后,百度文库AI将自动生成完整漫画作品,自动匹配丰富的人物对话文本,用户可继续在编辑器中进行精调。


《周处除三害》智能漫画创作全过程

 漫画是风格化的,画本则更广泛通用。大会上,百度演示的智能画本案例《小明不爱洗澡》,在画风上明显更“包容”,适用于更低年龄段读者的需求,可以有效填补家庭教育场景里的“绘本空白”。

《小明不爱洗澡》智能画本生成结果

 「深响」近期试用了百度文库的智能漫画和智能画本功能,如大会演示的那样,两个功能易上手、速度快、效果好——只需输入主题即可生成故事大纲,选择“制作画本”后稍加等待就能获得完整结果。

 试用过程中,「深响」也把百度文库生成的绘本发给有娃的朋友,这位年轻妈妈对绘本的反馈是“画面质量、阅读体验和市面上的亲子绘本很接近”。看完后她还发来一些需求,比如“能不能以‘吃饭前要洗手’为主题做个绘本”,“小朋友刚跟我说了一些奇思妙想,能不能把它们变成绘本”。

 和之前的体验一样,这两个需求同样都只需“一句话”主题输入,就能变成绘本输出(输入“吃饭前要洗手”,可以获得《小猫咪咪学洗手》的绘本),整个操作过程几乎是“傻瓜式”,它可以发生在亲子互动的各个环节,家长和孩子的交流也因此变得更有趣生动。


在百度文库APP上生成“饭前洗手”绘本。全程操作简单,画面生动可阅读性强

录屏:深响

 当然,如果想更精细地编辑故事文本,百度文库也给了相应的选项。你可以对生成的故事大纲进行编辑,也可以对分镜脚本进行修改。或者,你也可以和孩子一起,在百度文库的智能文档里,利用AI交互,把孩子的创意变成一个完整的故事,然后再把这个故事变成好看的漫画或绘本。正好423世界读书日马上要到了,利用百度文库,家长和孩子都能实现“绘本自由”,读书这件事会因为AI变得更易得、更有趣。


百度文库根据“机器人和人类一起保卫地球”主题生成故事大纲和分镜后,用户可以做进一步调整

截图来源:百度文库

 

这样的交互体验和交付质量是开创性的。目前,行业在“AI绘制漫画”上仍存在一定痛点,多数工具只能生成单图、四宫格图片,在场景关联性、人物一致性、剧情还原度上都有待完善,且通常需要大量后期工作来调整。

 

而百度文库不只是解决“绘制”环节的难点,还将AI封装于整个工作流程,在“指令生成故事”等方面进行优化提升,同时强化多场景及多人物处理、人物一致性、故事完整性、画面细腻度、图文与剧情匹配度等方面的专业表现,这使得其生成的作品达到能“直接交付”的水平。

“跨模态+一站式”内容创作的价值

就体验而言,智能漫画和智能画本都是帮助用户零门槛落地创意的好工具,但它们并不仅仅是两款“创意工具”。两款产品是“结果”,共同成长于百度文库的跨模态和一站式能力之上。

跨模态指的是,百度文库能够处理各种文字、语音、图像信息,能把不同模态的信息综合起来,实现更精确的情境理解和输出。在此基础上,用户可以在百度文库一个平台上,一站式实现不同类型的内容创作。

简言之,跨模态和一站式能力让百度文库有更广泛的落地可能。它可以横向进入更多场景,纵向进入更多环节。

 “进入更多场景”指的是,在工作生活中,你可以利用百度文库完成更多需求,比如生成思维导图、做研究报告、智能合成多个文档、写PPT和年终汇报,或者直接发一张图,让文库帮你生成小红书文案。基于自然语言交互,你的产出过程会简便得多、高效得多。


百度文库AI解图创作小红书文案

 

以研究报告和PPT为例,一份研究报告涉及大量文字和图表,一份精美的PPT需要用户不断调整样式、文字、排版,传统内容编辑工具操作起来又很繁琐,完成相应的产出往往要耗费大量精力。

 借助百度文库,用户能轻松实现原本繁复操作才能达到的效果——做个研究报告,只需输入报告主题,或者用简单的语音交互,几分钟内便能获得一份结构严谨、图表清晰、内容翔实的报告。基于这份报告,用户还能进行精细化的编辑调整,选择不同风格的模版封面及导出格式。

百度文库“智能生成研究报告”演示

 

类似的,用户只需要输入主题或上传文档,或者简单“动动嘴”,就能利用百度文库在几十秒内生成一份逻辑清晰、配图准确的PPT。此外,百度文库也支持模版上传、文档生成PPT、PPT内生成专业图表、PPT在线调整编辑、一键生成演讲稿和思维导图等功能,能够做到多格式、多文档的生成、编辑全能力打通。

 全能力打通破解的是当前AI应用的核心痛点。一直以来,市场关于AI有种“矛盾”的态度,大家都觉得AI很强,但实际应用体验总是“不尽人意”。目前,AI在工作生活中的落地还是处于“分散”状态,大部分人只用AI解决点状需求,没能把它融入工作流程中。如果想用AI完整、顺畅地解决需求,则需要专门搭建一套AI工作流,整个过程费时费力。

 百度文库的升级打破了僵局。从“头脑风暴”、“写大纲”,到生成和编辑文档,再到PPT生成、思维导图等文件的生成,各个场景的需求用户都可以基于百度文库解决。重要的是,百度文库“进入更多环节”的同时,用户操作门槛低,且体验顺滑,无需在文件传输和转换等问题上多花费精力。

 而百度文库的全场景指令创作和编辑,意味着用户仅需简单的语音指令,即可不受地点限制地高效完成工作中的常见需求。低门槛操作+全场景覆盖+灵活编辑+PC移动双端操作,百度文库带来的是新的办公体验。百度文库并非只解决单一环节的问题,而是成长为一个完整的生产力平台。

百度文库全场景指令创作和编辑演示

从趣味工具,到生产力革新

新技术发展总遵循这样的规律:最开始,它是少数爱好者的“趣味工具”,但随着技术能力的完善以及用户的增长,它会越来越快地渗透到大众的工作和生活中,渗透到千行百业里。

 早年,在图形界面交互出现前,计算机交互靠的是各种指令和参数,学习门槛高,只有少数极客玩得转。但随着计算机交互方式和技术的发展,大众经过简单学习就能操作个人电脑,PC和互联网时代得以到来。

 今天的AI技术也是如此。一年多以前,大家都在钻研怎么写Prompt,精调一张绘画作品需要不断测试提示词。随着技术和产品的发展,繁琐和专业的操作被不断简化,AI生成结果变得稳定且高质,外加自然语言本身就是“零门槛”的交互方式,AI正在加速往更大众化的方向渗透。

 AI时代的叙事渐渐从“趣味技术工具”转向“生产力革新”。用户和行业都将从中受益——用户侧,原先无法实现的需求变得触手可及;行业侧,随着以智能漫画和智能画本为代表的多模态AI能力的成熟,影视文娱行业、家庭教育行业、出版行业都能从中找到提效空间。

 仅仅一年多,AI的发展就又进入了新的阶段。“跨模态+一站式”趋势正在推动AI内容创作进一步落地,而百度文库和趋势同频,且是趋势中的领先者。

 这是多重因素共同造就的——百度文库在文本理解与数据分析领域有丰富积累,能准确抓取并分析文字中的数据信息,再转换生成适合的图表;文心大模型又为百度文库注入了新活力。据悉,相比一年前,文心大模型的算法训练效率提升到了原来的5.1倍,周均训练有效率达到98.8%,推理性能提升了105倍,推理的成本降到了原来的1%;叠加百度文库多年来对用户需求的洞察,百度文库得以重构为“一站式AI内容创作平台”。

 大会上,李彦宏提到,AI正在掀起一场创造力革命。“未来开发应用就像拍个短视频一样简单,人人都是开发者,人人都是创造者”。

 百度文库的进展,正在让“零门槛、一站式”创作落地现实。从过往的技术变革经验来看,新技术的发展和渗透常常是指数级的,智能漫画和智能画本将推动AI大众化进程。AI时代的增长曲线,显然越来越陡峭了。

【声明】该内容为作者个人观点,大数跨境仅提供信息存储空间服务,不代表大数跨境观点或立场。版权归原作者所有,未经允许不得转载。如发现本站文章存在版权问题,请联系:contact@10100.com
海外广告投放

海外广告投放

大数自营,全平台投放

深响
挖掘增长密码,探解生意本质。
内容 2727
粉丝 1
咨询
关注
加入大数社群!和众多大卖交流
扫描右侧 二维码,添加微信后可免费领取跨境资料包
头图

营销推广专区

借助各大平台带来新流量,增强品牌曝光

广告图

Google广告

谷歌一级代理

广告图

Facebook营销

FB核心代理

广告图

TikTok ADS

快速开通高质量账户,支持全球投放

广告图

Bing广告开户

直连Microsoft Ads官方渠道

标签图片 推特广告标签图片 Criteo标签图片 Yandex标签图片 VK广告标签图片 拼趣
深响 挖掘增长密码,探解生意本质。
总阅读408.5k
粉丝1
内容2.7k
咨询
关注
加入卖家交流群
  • 平台社群
  • 城市社群
  • 品类社群
  • 推广营销社群
  • 其他跨境社群
文章目录
各种热点背后,有两个事情值得注意:
创意如何轻盈落地
“跨模态+一站式”内容创作的价值
从趣味工具,到生产力革新
企业会员