以下是关于人物生成的 AI 相关内容:
一、7 大方向快速生成合心意的 AI 人物形象
在工作中,为完成 Banner 设计常涉及人物素材,作者对 Midjourney 进行 AI 人物生成的相关测试并分享经验。
刚开始使用 Midjourney 时,生成人物图片存在人物位置、大小和视角无法保证,固定动作需垫相同动作图片等问题,后通过摄影知识和咨询 ChatGPT 确定了 7 个生成方向并进行实验:
二、生成式 AI 在游戏领域的机会(市场假设+预测)
市场生态概述:
原文地址:https://www.uisdc.com/character-synthesis作者:解决师Blue[heading2]一、前言[content]由于在工作中,经常会涉及到使用人物素材完成Banner设计的工作,于是最近开始探索关于[Midjourney](https://www.uisdc.com/tag/midjourney)进行AI人物生成的相关测试,同时将这一段时间的经验分享出来。刚开始接触和使用Midjourney的时候,最大的问题在于生成的人物图片无法保证人物位置的大小和视角,想要固定某一种动作,只能通过垫相同动作的图片的这种方式去解决。后来经过一些了解摄影的朋友,通过他们了解到这些都是可以通过摄影的知识来补充的这方面短板的。后来我去咨询了ChatGPT,它确实给了我一些很有用的方向。根据ChatGPT的建议,我这里将生成AI人物类型图片的方向确定为一下7方面:1.人物构图的视角选择2.人物角度的选择3.人物距离的选择4.人物表情的选择5.人物氛围感的选择6.人物服装的选择7.人物风格的选择通过这7个方向,我们来进行了实验。
视角可以按照相机相对于被拍摄对象的位置,分为正面、背面和侧面。当然,拍摄角度不仅限于这三个方向,还可以有更多不同的角度选择,这需要根据被拍摄对象和拍摄需求来选择合适的角度。测试:不加入关键词的AI生成的图片会是什么样子?生成思路:年轻的女孩生成咒语:young girl,--ar 16:9通过随机生成的8张来看,由于没有其他关键词的约束,目前随机出来默认的人物形象偏欧美风,人物视角的比例偏差也都保持在了正面和侧面,那么我们现在可以通过增加构图视角的关键词来限定人物呈现的视角。我们来看看增加不同视角之后的样子吧。1.正视角正视角是指在人像构图时,拍摄对象正对着相机的姿态,使人像呈现出正面的视角。咒语关键词:Front view生成思路:正视角的年轻女孩生成咒语:young girl,front view,--ar 16:9通过随机生成的图片来看,由于受到正视角关键词的约束,目前随机出来人物都是偏正面的,结果相对来说是较好的,那么我们就继续来看一看其它的视角。2.后视角后视角是指从被摄对象的背后拍摄的视角,也就是以被摄对象的背部为主要构图元素的拍摄方式。这种视角可以营造出一种神秘或者引人遐想的氛围。咒语关键词:Back view angle & Back angle生成思路:后视角的年轻女孩生成咒语:young girl,back view angle,--ar 16:9
现在,有许多创业公司正在尝试创造人工智能生成的音乐,如Soundful、Musico、Harmonai、Infinite Album和Aiva,尽管目前的很多工具,如Open AI的Jukebox,是高度计算密集型的,还不能实时运行,不过,一旦初始模型成功建立,实时运行将成为可能。对话&语音(Speech and Dialog)很多公司试图为游戏中的人物创造逼真的声音,当然,由于计算机的语音合成历史悠久,这并不少见,这些公司包括Sonantic、Coqui、Replica Studios、Resemble.ai、Readspeaker.ai等等。将生成式人工智能用于语音有多种优势,当然,这个赛道竞争也比较激烈。即时对话生成。通常情况下,游戏中的语音是由配音演员预先录制的,但这些都仅限于死板的演讲稿。有了生成式人工智能对话,角色可以说任何话,这就意味着可以对玩家的行为做出充分的反应。角色扮演。许多玩家希望扮演与自己现实世界身份几乎没有相似之处的虚拟人物。然而,只要玩家用自己的声音说话,这种幻想就会破灭,使用与玩家的化身相匹配的生成的声音可以保持这种幻觉。控制音效。通过AI生成语音时,我们可以控制声音的细微差别,比如它的语调、转折、情感共鸣、音素长度、口音等等。本地化(方便翻译和国外推广)。对话可以翻译成任何语言,并以同样的声音说话,像Deepdub这样的公司专门专注于这个细分市场。NPC&玩家角色