版权说明:本文档由用户提供并上传,收益归属内容提供方,若内容存在侵权,请进行举报或认领
文档简介
人工智能应用通识导读名言导读名言:“艺术是人类想象力的延伸,而人工智能正在成为这种想象力的新画笔。”——克里斯托弗·诺兰(ChristopherNolan)人工智能应用通识
项目三
画布新次元:AI视觉智创全链路2思政引领本项目围绕“科技赋能创意、智能拓展人文”的理念,引导学生从动漫人物创作实践中体会人工智能对艺术表达与文化传播的深远影响。通过图像理解、提示构建、风格融合等环节的体验,激发学生的科技兴趣与审美创造力。项目强调“以人为本”的科技伦理立场,倡导学生关注AI创作过程中的版权归属、数据来源、审美偏见等问题,树立责任意识和法治观念。同时,鼓励跨学科融合与合作精神,培养学生用AI表达中国故事、弘扬优秀传统文化的能力,助力形成具有民族审美和国际视野的数字创作价值观。人工智能应用通识
项目三
画布新次元:AI视觉智创全链路3学习目标知识目标:了解图生文、文生图、风格融合等主流图像AI技术的基本原理与应用场景;·熟悉常用图片AI平台(如SeaArt、DALL·E3、Artbreeder)的功能特点与使用流程;理解提示词设计原则以及视觉风格融合的操作逻辑。能力目标:能将图像信息转化为结构化文本描述,构建适用于图像生成的提示词;能综合使用多种AI工具完成动漫人物形象的设计与风格优化;能比较不同生成平台的风格差异,并对AI输出结果进行判断与调整。素质目标:激发对AI艺术创作的兴趣,增强审美表达与创意思维能力;·增强对AI图像生成中伦理、风格偏见等问题的认知与判断;培养团队协作能力、表达能力与跨模态融合意识。人工智能应用通识
项目三
画布新次元:AI视觉智创全链路4项目要点人工智能应用通识
项目三
画布新次元:AI视觉智创全链路5思维导图人工智能应用通识
项目三
画布新次元:AI视觉智创全链路6任务3.1图片AI工具介绍3.1.1常见图片AI工具介绍3.1.2使用步骤教程3.1.3任务总结7目录任务3.1图片AI工具介绍在传统观念中,内容创作往往依赖灵感的迸发与文字的反复打磨。然而在人工智能时代,写作方式正悄然改变。生成式人工智能以前所未有的速度推动着内容生产革新,其中的文本AI工具逐渐融入学习、科研和日常工作,成为不可或缺的助手。与过去单向的“输入—修改”不同,文本AI使写作成为人与机器的动态对话。它不仅提供即时反馈,还能参与协同创作,让文字成为“思维的延伸”,帮助人们更自由地组织想法、探索表达,并不断优化语言和结构。面对种类繁多的AI工具,初学者常会疑惑:该如何选择?哪些功能更适合自己?本章将从工具分类、功能解析与案例演示三个角度出发,帮助大家系统认识文本AI的能力与应用场景。希望通过学习,你能够掌握高效使用这些工具的方法,在学习、科研与创作中提升生产力。人工智能应用通识
项目三
画布新次元:AI视觉智创全链路8任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路93.1.1常见图片AI工具介绍一、图文转换任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路103.1.1常见图片AI工具介绍二、图像风格处理任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路113.1.2使用步骤教程一、文生图在“文生图”任务中,提示词是驱动图像生成的核心要素。与文字类AI(如ChatGPT、写作猫)中用于提问、指令或语言表达的提示词不同,图片AI中的提示词更像是一种“视觉语言”,其本质是将图像的构图、风格、细节、氛围等视觉要素用文字编码描述出来。它不强调句子是否通顺或语法是否规范,而是关注信息是否全面、表达是否具体、结构是否清晰,最终目的是帮助AI还原用户心中的画面。(一)任务简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路123.1.2使用步骤教程(二)提示词设计“文生图”是图片AI工具中最具代表性和想象力的任务之一,其核心目标是根据用户输入的自然语言提示词生成相应的图像。用户无需具备绘画能力或图像处理经验,只需通过文字描述就可以让AI生成高质量的视觉内容。这类任务打破了传统图像创作依赖专业软件和绘画技能的壁垒,使图像创作变得更为民主化和低门槛。1.提示词设计原则任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路133.1.2使用步骤教程1.提示词设计原则文生图的提示词通常由多个视觉要素组成,推荐采用“主体+环境+动作/姿态+风格修饰+技术参数”的结构,由核心对象逐步扩展到整体画面。例如:一只趴在古老书堆上的橘猫,背景是温暖的图书馆,阳光从窗户洒入,油画风格,细节丰富,8K高清任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路143.1.2使用步骤教程1.提示词设计原则提示词的写法应当由“点”到“面”,逐层展开。优先描述清楚图像的主体是什么,再补充所处场景、动作状态、风格气质等,最后可添加一些对图像技术质量的要求,如清晰度、尺寸、构图等。比如:一个穿着银色盔甲的中世纪骑士,站在断崖之上,背景是黄昏的战场与燃烧的村庄,史诗风格,电影光效,超高细节1)层层展开,构建画面结构任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路153.1.2使用步骤教程1.提示词设计原则越具体的描述越能帮助AI聚焦主题,生成质量也会更高。避免使用“漂亮的”、“好看”等模糊形容词,应以颜色、材质、动作、情绪等细节词语取而代之。与其说“一个美丽的女孩”,不如说:一个黑发长直、穿着蓝色和服的年轻女孩,站在樱花树下,脸上带着微笑,动漫风格,阳光透过花瓣洒在脸上2)描述具体,减少生成误差任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路163.1.2使用步骤教程1.提示词设计原则不同的风格词能够让AI输出完全不同的画面美感。提示词中可以参考表3-1的修饰词来实现艺术控制。但需要注意,过多叠加可能导致画面杂乱或风格冲突,一般建议选择1~2个风格词和2~4个修饰词进行组合,最后再搭配分辨率和构图要求。3)善用风格词与修饰语,调控视觉效果任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路17风格分类关键词示例绘画艺术风格水彩风格、赛博朋克风、国风插画、像素风、洛可可风格、油画风格、素描风格、水墨风、手绘风格、日系插画、蒸汽波风格、涂鸦风格、波普艺术风、极简主义风、抽象表现主义风、超现实主义摄影风格词特写镜头、广角镜头、低视角、鱼眼镜头、俯拍视角、虚化背景、柔光效果、胶片质感、街头摄影、肖像摄影、工业风摄影、夜景摄影、颗粒感、电影感等光影与氛围修饰语柔光效果、强对比光、蓝调夜色、阳光投射、光雾弥漫、梦幻氛围、沉静感、神秘感、冷峻风、温暖调、科幻氛围、幻想感、黑暗风、童话感、复古色调细节与技术参数修饰语高细节、精细纹理、4K高清、8K分辨率、逼真材质、超写实、电影感、清晰锐利、HDR光效、色彩饱满、无文字、水印移除、背景虚化、物体居中、对称构图、图像锐化、色差矫正、无背景杂物、无模糊、轮廓清晰情绪与风格语气修饰语宁静、忧郁、孤独、温柔、浪漫、激昂、悲壮、空灵、童趣、神秘、梦境感、史诗感、反乌托邦、未来主义、高级感、极简风、抽象风、古典神话风、机械感、自然主义表3-1风格关键词汇总任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路183.1.2使用步骤教程1.提示词设计原则提示词虽然不需要完整句子,但可以通过“在……中”、“被……包围”、“背景是……”等中文连接词增强语义连贯,帮助AI理解画面层次。例如:一个身披白色斗篷的法师,站在冰封的山巅,手持蓝色法杖,背景是极光照耀下的雪原,幻想风格4)使用逻辑连接增强画面连贯性任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路193.1.2使用步骤教程1.提示词设计原则文生图提示词建议使用顿号、逗号等自然停顿符号,将不同信息单元隔开,有助于模型分块解析。例如:东方古风庭院,夜晚,下雪,少女撑伞,身穿红色披风,仰望天空,写意风,水墨质感5)使用逗号分隔,理清语义层次任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路203.1.2使用步骤教程1.提示词设计原则某些图片AI工具支持添加负向提示词,用于明确指出哪些内容不应出现。这类词语通常单独列出,也可以写成:“不要出现……”、“去除……背景”等形式,以提高图像整洁度与专业感。例如:不含文字、不含马赛克、不含模糊背景、不含水印、不要出现红色6)高阶补充:负向提示词的使用任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路21(三)工具演示1.通义万相通义万相是由阿里巴巴通义实验室推出的一款多模态AI图像生成平台,支持用户通过自然语言提示词快速生成风格丰富、内容精准的图像。作为一款面向中文用户设计的AI绘图工具,通义万相在提示词解析、中文语义理解、画面构图等方面均有良好表现,尤其适合用于中文环境下的内容创作与视觉表达。1)简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路222)界面布局任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路233.1.2使用步骤教程A.模型选择通义万相提供多种创作模型以适应不同生成需求,包括:万相2.1专业版:画面质感细腻,适合表达复杂内容,具备较强的视觉表现力;万相2.1极速版/万相2.0极速版:生成速度快,语义理解能力较强;万相1.0通用版:风格覆盖广泛,生成稳定,适合日常使用。用户可根据生成目标,在画质、速度、风格控制等维度上灵活选择合适模型。模型选择按钮右侧还提供“使用指南”,内含提示词词典,便于参考提示词写法。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路243.1.2使用步骤教程B.提示词输入通义万相支持中英文提示词输入,并内置两项辅助功能来优化生成效果:智能扩写基于通义千问自动丰富用户的简短输入,增强语义层次与画面描述,默认开启;咒语书提供结构化的提示词词库,涵盖风格、光线、材质、渲染、色彩等维度,便于用户快速构建完整描述。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路253.1.2使用步骤教程B.提示词输入一只趴在古老书堆上的橘猫,背景是温暖的图书馆,阳光从窗户洒入,油画风格,细节丰富,8K高清油画风格的超精细作品,一只慵懒的橘色猫咪正蜷缩在一堆泛黄的古籍之上。猫咪的毛发柔软细腻,每一根毛都清晰可见,仿佛可以感受到它的温暖。它的眼睛半闭,似乎正在享受这份宁静与舒适。书籍的封面各具特色,有的磨损,有的破旧,但都透露出历史的厚重感。图书馆的背景充满了温馨的气息,木质的书架上摆满了各种书籍,一束束阳光从高大的窗户洒入,照亮了这个知识的殿堂。阳光在空气中形成了细小的尘埃,增加了画面的立体感和深度。整个画面以暖色调为主,营造出一种安静而祥和的氛围,让人仿佛能闻到书籍和木材的香气。8K高清分辨率,每一个细节都被完美捕捉,无论是猫咪的毛发还是书页的纹理,都栩栩如生,令人赞叹。智能扩写任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路263.1.2使用步骤教程B.提示词输入智能扩写任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路273.1.2使用步骤教程C.创意模板与参考图任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路283.1.2使用步骤教程C.创意模板与参考图一只趴在古老书堆上的橘猫,背景是温暖的图书馆,阳光从窗户洒入,油画风格,细节丰富,8K高清”可爱涂鸦“模板任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路293.1.2使用步骤教程C.创意模板与参考图一只趴在古老书堆上的橘猫,背景是温暖的图书馆,阳光从窗户洒入,油画风格,细节丰富,8K高清”四格漫画“模板任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路303.1.2使用步骤教程C.创意模板与参考图一只趴在古老书堆上的橘猫,背景是温暖的图书馆,阳光从窗户洒入,油画风格,细节丰富,8K高清参考图任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路313.1.2使用步骤教程D.灵感模式灵感模式任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路32(三)工具演示2.SearArtSeaArt是近年来在全球AI绘图领域迅速崛起的一款强大图像生成平台,由国内人工智能创业团队极睿科技(SeaArt.ai)开发与运营。团队成员大多具备图像生成、大模型研发与产品本地化优化的背景,致力于打造一款操作友好、模型强大、社区活跃的全能型图片AI平台。1)简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路332)界面布局任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路343.1.2使用步骤教程左侧参数调节区域A.模型和风格设置SeaArt内置多种高质量的StableDiffusion衍生模型,支持用户一键切换使用,涵盖写实风、动漫风、插画风、国风、水墨等多种视觉风格。用户在选择模型后,系统会智能推送“灵感库”作品,展示使用该模型生成的优秀图片,并提供“同款提示词”供一键调用,帮助用户快速获取创作灵感。此外,SeaArt还提供“附加风格”功能,用户可以选择一种或多种附加风格,并通过“风格强度滑块”或“手动添加触发词”的方式对提示词进行调整,从而影响最终图像的画面风格和细节表现。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路353.1.2使用步骤教程B.生成设置生成设置模块允许用户根据需求选择不同的生成策略,包括:生成模式:提供“标准模式”和“质量模式”两种选项。前者兼顾速度与效果,适合日常使用;后者偏重画质表现,适合追求高精细图像的创作。图像比例:可选择常见画幅(如1:1、3:4、16:9等),适应不同使用场景。生成张数:一次性生成1~4张图像,便于进行多方案比较。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路363.1.2使用步骤教程C.高级设置高级设置提供更深层的参数控制,适合中高级用户进一步调优生成效果。主要包括:采样方法:用于指定AI在“扩散过程”中绘制图像的策略。可理解为AI绘图时“怎么画”的方式,不同方法对应不同的绘画节奏和图像风格。初学者可采用默认设置,进阶用户可根据图像目标尝试不同方法。采样步数:表示模型在绘图过程中的迭代次数。步数越高,图像细节越丰富,但生成时间也更长;步数过低则可能导致图像粗糙或偏离提示词。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路373.1.2使用步骤教程C.高级设置文本强度:控制图像与提示词之间的贴合程度。数值越高,图像越接近提示词描述;数值越低,AI发挥空间更大、图像更有“创意偏差”。官方建议调整范围为3~15。VAE(变分自编码器):可调整图像色彩分布,增强画面通透感或风格细节。ClipSkip:控制文本特征的提取层数,用于减少提示词对图像色彩的干扰。建议设置为2,可提升生成图像的稳定性。引擎版本:可选SeaArtAI2.0或2.1,适用于SD1.5文生图模型,仅在非质量模式下生效。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路383.1.2使用步骤教程C.高级设置高清修复:支持图像后处理优化,可选择如4x-Ultrasharp、R-ESRGAN4x+等高清增强模型,实现放大图像同时保持清晰度与锐利细节。支持面部修复与人物还原,优化面部、手部、身体结构生成效果。负向标签:开启后可在提示词中加入“不想要的内容”,帮助过滤图像中不希望出现的元素(如模糊、畸形、水印等)。固定种子:控制生成的随机性。当其他参数一致、使用同一“种子值”时,即可反复生成相同图像,适合复现或精调作品。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路393.1.2使用步骤教程右侧图片生成区域A.提示词输入与智能辅助在该区域顶部,用户可以输入提示词进行图像生成,并结合多种智能辅助功能提升生成效率与质量,如:引用图片:支持以图片为参考素材进行生成,如:在原图基础上进行风格或构图优化;以图为引导生成相似风格的新图像;设定结构或主体条件,引导生成符合要求的内容。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路403.1.2使用步骤教程A.提示词输入与智能辅助提示词:为人物戴上墨镜“,为动漫人物形象戴上墨镜。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路413.1.2使用步骤教程A.提示词输入与智能辅助优化提示词:使用AI对用户输入的简略提示词进行语义丰富与结构优化;系统随机生成创作主题与描述,激发用户灵感。提示词:一只可爱的腊肠狗,身穿兜帽卫衣,站在繁华的城市街道,涂鸦风格,冷蓝色调的夜晚。提示词:高质量,4k,高细节,写实风格,专业级,可爱的腊肠狗,身穿兜帽卫衣,站在繁华的城市街道,冷蓝色调的夜晚,涂鸦风格,夜色,建筑,街道,路灯,霓虹灯,航拍。优化提示词任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路423.1.2使用步骤教程A.提示词输入与智能辅助优化提示词任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路433.1.2使用步骤教程B.图片操作在提示词下方,系统会展示每次生成的图像结果,并提供一系列管理与后期优化功能:图像管理功能:支持实时显示生成图像、查看历史生成记录、一键保存下载图片、复用已生成图像的提示词与参数、对生成失败的图像进行重新生成等功能;后处理操作功能:支持对生成图像进一步操作,包括视频生成、智能改图、高清修复、去除背景、智能消除、局部重绘、图像扩展等功能。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路443.1.2使用步骤教程二、图生文图生文(Image-to-Text)是人工智能多模态生成任务中的重要分支,指的是通过AI模型对图像进行分析和理解,自动生成相应的文字描述、关键词或摘要信息。与“文生图”任务从文字生成图像不同,图生文的过程是“从图像到文字”的反向转换,核心在于模型对图像中元素、场景、结构等视觉内容的语义理解与语言表达能力。(一)任务简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路453.1.2使用步骤教程二、图生文图生文任务与文生图在提示词设计逻辑上有显著不同。文生图的核心是“写出明确且精细的提示词以控制生成图像”,而图生文的重点则是“通过输入图像+上下文信息,引导AI生成符合需求的文字内容”。因此,在图生文任务中,提示词不再是主角,图像本身的内容质量、配套信息的组织方式,才是影响输出结果的关键变量。(二)提示词设计任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路463.1.2使用步骤教程(二)提示词设计上下文补充文本是图生文中影响输出风格与结构的重要手段。尽管大多数图生文模型支持“直接上传图像
→
输出描述”的零输入方式,但为了让输出结果更符合特定使用目的,我们可以在输入框中补充如下信息:明确任务目标,例如“请为这张图片写一句简洁的标题”;提供语体要求,如“生成一段适合微博的口语化文案”;添加格式约束,如“输出格式为:图像内容+情绪表达”,通过这种“图+上下文提示”的复合输入方式,用户可以更有效地引导AI输出满足特定用途的文本内容。1.输入与上下文设计原则任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路473.1.2使用步骤教程2.表达目标控制要点在图生文任务中,我们常常面临这样的问题:同一张图片,可以生成多种不同风格或用途的文字。为此,在操作前明确“我们希望生成什么样的文本”是至关重要的。以下是常见的表达目标类型:标题类:如新闻图配图标题、公众号封面语、海报标题;描述类:如社交配文、图片讲解、产品说明;摘要类:如图片内容归纳、图示要点提炼;讲解类:如教学解说、图片导览语、PPT配解词;关键词类:如图像标签、搜索关键词、数据库标注词。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路483.1.2使用步骤教程2.表达目标控制要点此外,我们还应考虑是否希望输出中包含图像的情绪氛围(如温馨、宁静、激烈)、视觉风格(如复古、梦幻、写实)或结构要素(如人物数量、动作关系、空间构图)。这些细节虽然无法直接写进“提示词”,但可借助上下文输入进行提示。同样上传一张“猫趴在窗边的照片”,上下文若搭配“请生成小红书文案”或“请为中学生写一段图像讲解”,输出内容风格则完全不同。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路493.1.2使用步骤教程2.表达目标控制要点任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路503.1.2使用步骤教程2.表达目标控制要点任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路51(三)工具演示1.BLIPBLIP(BootstrappingLanguage-ImagePretraining)是由SalesforceResearch研发的一款开源图像理解与生成模型,专注于“图像到文本”的自然语言生成任务。作为当前图生文方向的重要模型之一,BLIP能够基于用户输入的图像自动生成描述性语言,涵盖图像字幕、图像问答(VQA)、关键词提取等多种能力,是视觉语言领域的重要代表工具。其生成文本通常具备结构清晰、用词准确、描述客观等特点,适合应用于科研、教育、图像归档、数据标注等对语言质量与图像理解要求较高的场景。1)简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路522)界面布局任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路53(三)工具演示2)界面布局用户可通过多种方式导入图像作为输入素材,包括三种方式:从电脑文件中选择图片;通过电脑摄像头实时拍摄照片;将复制到剪贴板中的图片粘贴上传。A.图片上传区任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路54(三)工具演示2)界面布局图像标题生成(ImageCaptioning):为图像生成一句简洁、客观、描述性的自然语言标题,准确传达图像的主要内容或场景。它不涉及情绪渲染、夸张文风或过多主观性,因此属于技术性图像描述任务,更偏向“标注”而非“创作”。如图3-16,我们为一格插画生成标题”animageofawomaneatingasliceofpizza(一位女士正在吃披萨的图片)“。B.文字互动区任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路55(三)工具演示2)界面布局视觉问答(VisualQuestionAnswering,VQA):用户在上传图片后提出具体问题,模型根据图像内容回答。例如我们使用图3-16向模型提问“图中女孩吃的披萨是什么口味?”,模型会基于视觉信息给出回答,如图3-17所示。B.文字互动区任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路56(三)工具演示C.高级设置区高级设置区允许用户对生成文字的行为方式进行细致调控,是影响输出效果的重要参数模块。如图3-18所示,用户可以根据具体任务需求,对文本生成的长度、随机性、重复率等进行调节,以获得更符合预期的输出结果。相关参数及其作用可参考表3-2。对于初学者而言,使用系统默认设置即可满足大多数基础任务;而在更高阶的应用场景中,用户可逐步调整参数,以实现更精准的文本控制和生成质量优化。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路57参数名称(英文)中文翻译说明Textdecodingmethod文本解码方式控制生成文字时采用的策略,如贪心解码、采样、多束搜索等。不同方式会影响文本的多样性与稳定性。Temperature温度系数控制输出的随机性。值越高,生成结果越随机;值越低,越保守稳定(常设为0.7-1.0)。Lengthpenalty长度惩罚系数调节输出文字长度的倾向。值大时倾向生成较短句子,值小时更偏向于生成长句。Repetitionpenalty重复惩罚系数抑制重复词语的生成,值越大,生成文本越不容易出现重复内容。Maxlength最大生成长度限定输出文字的最大字符数,避免生成过长。Minimumlength最小生成长度限定输出文字的最小字符数,确保内容完整。Numberofbeams束搜索宽度用于“束搜索”解码方法时设置候选路径数量,数值越高,生成更准确但耗时更久。Top-p椒率采样阈值控制生成结果采样范围,值越小输出越集中,越大则输出更多样。一般设置在0.8-0.95.任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路58(三)工具演示2.豆包豆包是字节跳动推出的通用型对话式AI工具,支持文本生成、图像理解、多轮对话等多种功能。在图生文任务中,豆包相较于偏专业、偏学术风格的BLIP,更注重轻量化表达与社交风格生成,生成的文字常带有口语化、情绪化和网络化色彩,适合用于生成小红书、微博、朋友圈等平台的配图文案。如果说BLIP擅长图像结构还原、细节描写和精准客观的描述输出,豆包则更像一个懂你情绪的“内容搭子”,能将图片背后的情感氛围转化为富有温度的语言表达。1)简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路59(三)工具演示2)功能任务简介:对图像中可见内容进行客观、简洁的描述,强调“看到什么就说什么”,不加入情绪与想象,适合用于图像标注、图文对齐训练等基础任务。提示词示例:请根据这张图片,生成一句简洁的画面描述,突出主要人物或物体,以及他们正在做什么。A.画面描述任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路60详细描述这张JOJO漫画图的画面内容,包括场景布局、人物动作、画面中的文字信息,用文字完整复现视觉细节。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路61(三)工具演示2)功能任务简介:在客观描述基础上,加入对图像氛围、情绪、场景风格等主观感受的解读,适合用于艺术创作、社交文案、情感写作等场景。提示词示例:请为这张图片生成一段带有情绪氛围的描述,可以加入画面的感觉、情绪和你对它的理解。B.意境解读任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路62分析这张JOJO漫画图传递的氛围与情感,从场景、人物互动等角度,解读画面营造的情绪基调。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路63(三)工具演示2)功能任务简介:将图像内容提取为关键词、标签或简短短语,适合用于图片分类、索引、搜索优化等任务。提示词示例:请提取这张图片中的核心关键词或标签,格式为3~5个词,每个词不超过5个字。C.标签提取任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路64提取这张JOJO漫画图的关键词标签,涵盖作品名称、核心角色、关键情节、场景类型、独特元素,用简洁词汇概括。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路65(三)工具演示2)功能任务简介:以图像为创意跳板,延伸故事、脑洞情节、设计灵感,让静态图像“生长”出更多可能性,激发创作火花。提示词示例:基于这张图片,进行创意拓展,可延伸后续故事、脑洞平行情节、提取设计灵感,为创作提供新素材。D.创意拓展任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路66基于这张JOJO漫画图,进行创意拓展,延伸后续故事,为创作提供新素材。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路67(三)工具演示2)功能任务简介:对图像中包含的信息进行归纳整理,以较清晰的结构表达图中要素,适合用于教学讲解、图解说明、PPT内容生成等任务。提示词示例:请对这张图片进行结构化说明,从“人物/物体—场景—动作/状态—氛围”四个方面进行归纳描述。E.信息归纳任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路68梳理这张JOJO漫画图的关键信息,包括结构、人物行为、信息关联,用清晰逻辑整合内容。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路693.1.2使用步骤教程三、风格融合风格融合是一类以“合成新图像风格”为目标的图像生成任务,其核心在于将两张或多张图像的视觉特征进行混合,创造出既保留原图结构又具备独特审美风格的全新图像。与风格迁移不同的是,风格融合并非单纯地“套用”某种已有艺术风格,而是更强调多源风格的融合演化,通过细节权重调节和特征混合,生成具有“中间态”或“变体感”的视觉作品。(一)任务简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路703.1.2使用步骤教程三、风格融合风格融合的主要生成逻辑依赖于用户选择的多张参考图像,通过滑动条调节不同图像在合成过程中的特征权重,从而得到兼具多个源图风格的新图像。在这一过程中,提示词的加入更多用于微调图像风格倾向、补充情绪语境或增强细节表现。例如,在Artbreeder的Splicer模式中,用户可在图像融合完成后输入简短提示词,以进一步影响最终输出的整体氛围与细节渲染。(二)提示词设计任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路71类别示例用途说明风格类animestyle、oilpainting、pixelart控制图像整体视觉语言情绪类melancholic、dreamy、mysterious设置画面情感基调与氛围光影类softlighting、backlight、dramaticlighting影响光照方向与画面明暗表现场景类inaforest、onacitystreet增强环境特征与背景提示文化/风格参照cyberpunk、steampunk、vintage融合特定文化或审美系统元素任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路723.1.2使用步骤教程(三)工具演示:ArtbreederArtbreeder的界面设计简洁直观,适合初学者快速上手。在首页界面中,点击图3-24中的Splicer2即可进入风格融合功能模块。此外,平台还提供其他创意功能,包括:Composer(画面构图器):支持多图组合布局;Collager(拼贴生成器):用于拼贴风格图像生成;Prompter(提示词生成器):基于提示词进行图像生成;Animator(动画生成器):将静态图像转换为动态效果;Director(场景导演器):控制多人物和场景图像的生成逻辑。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路73任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路74任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路753.1.2使用步骤教程参数调节人物特征(PortraitFeatures):可调节如性别、年龄、眼部造型、头发长度等人物基础特征,用于塑造人物形象的基础外貌;面部表情(Expression):可控制笑容、惊讶、悲伤等面部情绪状态,使人物呈现不同的情绪氛围;构图元素(Composition):包括画面对称性、拉近远镜头、动态感等,对整体画面结构产生影响;任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路763.1.2使用步骤教程参数调节风格与氛围(Style&Mood):如现代风、机械风、生物风、可爱风、卡通风、诡异风等视觉风格;视觉质量(VisualQuality):用于控制图像的清晰度、整洁度、复杂度、秩序感、和谐美等,提升整体画面质感;色彩与光影(Color&Lighting):包括色彩饱和度、亮度、光照方向、冷暖色调等参数,帮助用户打造特定的色彩环境与光影氛围。任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路773.1.2使用步骤教程四、图像修复与增强图像修复与增强是一类基于已有图像进行内容优化、结构补全或视觉美化的AI图像任务,主要目标是在不改变图像主体的前提下,提升图像质量、修复缺损区域或增强视觉效果。相较于“文生图”和“图生图”等从零生成任务,图像修复与增强更侧重于图像内容的局部处理与细节优化,常用于图像清洁、质量提升、结构修复、尺寸调整等场景。(一)任务简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路783.1.2使用步骤教程(二)工具演示:ClipdropClipDrop是一款集成多种图像增强与编辑功能的AI图像平台,支持网页在线使用,界面直观,功能模块丰富。进入ClipDrop官网后,点击上方“Tools(工具)”按钮即可看到各类功能入口,主要包括:Cleanup(目标移除)、ImageUpscaler(高清放大)、Relight(重设光照)、RemoveBackground(去背景)、ReplaceBackground(换背景)、Reimagine(图像变体生成)、GenerativeFill(智能填充)、Texttoimage(文生图)、TextRemover(去除图中文字)、Uncrop(智能扩图)、UniversalResizer(格式与尺寸适配)1.简介任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路793.1.2使用步骤教程2.核心功能介绍击进入Cleanup功能后,界面中央的蓝色方框支持从本地上传图片,或通过剪贴板直接粘贴图像。如图3-31所示,图片上传成功后,工作区上方提供常用操作按钮,包括撤销、恢复、隐藏修改、提交正负反馈等;右上角则可下载图片或快速跳转至其他功能模块,如背景替换、背景移除和高清放大等。1)目标移除任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路80擦除后任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路813.1.2使用步骤教程2.核心功能介绍在ImageUpscaler页面,用户可通过蓝色方框上传图片,如图3-34所示。下方菜单栏允许选择放大倍数(2x、4x、8x、16x),并在两种放大模式中切换:Smooth(平滑模式):适用于图像整体柔化与去噪;Detailed(细节模式):更注重保留纹理与细节,适合高精度图像处理,但处理时间较长。2)高清放大
任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路82高清放大任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路833.1.2使用步骤教程2.核心功能介绍在GenerativeFill(智能填充)
页面,上传图片后,可使用画笔工具圈选需填充的图像区域。选中区域后,在下方文本框中输入提示词(建议使用简洁的英文短语),然后点击“Generate”按钮即可触发生成。3)智能填充任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路84智能填充提示词:redlip(红嘴唇)任务3.1图片AI工具介绍人工智能应用通识
项目三
画布新次元:AI视觉智创全链路853.1.3任务总结本任务围绕图片AI的主要应用场景,系统介绍了文生图、图生文、风格处理与图像增强等核心工具类型,帮助学生建立清晰的使用认知与操作路径。覆盖四类主流任务:文生图、图生文、风格融合、图像修复对每类任务从定义
→
工具
→
操作流程三方面展开强调提示词构造、图像细节、风格控制的关键技巧对比分析不同工具的输入方式与交互逻辑引导学生理解图片AI的跨模态特性与创作能力要求下一阶段,我们将通过综合实战项目,整合所学技能,提升AI图像创作的实操水平。任务3.2实战项目3.2.2项目要求2.1.3使用步骤教程8686目录3.2.3项目目标3.2.4项目实施3.2.5项目总结3.2.1项目背景介绍任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路873.2.1项目背景介绍我们设计了本阶段的实战项目——“AI辅助动漫人物创作”。在本项目中,你将以一张动漫人物插画或一段人物设定文本为起点,使用图生文工具提取或撰写角色描述,再结合角色设定,利用文生图工具生成新的角色形象,并通过风格融合工具,进一步调整人物画风或尝试不同风格变体。本实战项目将围绕以下四个关键能力展开训练:如何借助图生文工具,高效提取动漫人物的外貌特征、风格属性与设定信息?如何将人物设定转化为高质量提示词,引导AI生成符合要求的角色图像?如何选择合适的风格融合方式,实现角色形象的个性化呈现与风格统一?如何在AI辅助下完成“设定—生成—优化”的完整创作流程,形成具有辨识度与美感的人物形象?任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路883.2.2项目要求在本项目中,你需要完成如下任务链:图生文描述:任选一张动漫人物图像,使用图生文工具(如BLIP、讯飞星火、百度文心图说等),自动生成人物描述文本。你可以对文本进行人工润色、扩展,形成完整的角色设定,包括外貌、性格、服饰风格等基本要素。也可以反向操作,先写人物设定,再寻找匹配图像。文生图创作:将你构建的人物设定转化为提示词,借助文生图工具(如通义万相、SeaArt、StableDiffusion等)生成新的动漫人物形象。鼓励你尝试不同风格(如古风、赛博、学院、Q版等)和构图设定(如半身像、动作姿态、表情特写等),以增强角色的视觉辨识度和表现力。风格融合重构:使用风格融合工具(如LensaAI、Artbreeder、PrismaAI等),将生成的人物图像与其他特定风格(如水彩画风、油画风、插画风、像素风等)进行融合转化,探索风格变化对人物表达效果的影响,提升整体美术效果与创意张力。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路893.2.2项目要求最终,你将完成一个“从设定到形象”的动漫人物AI创作作品,包含以下要素:原始人物图像或初始文本设定;图生文、文生图、风格融合工具设定参数;基于提示词生成的人物图像;完成风格融合处理后的图像;一份创作说明文档(约300字),介绍你的创作思路、提示词构建逻辑、风格处理策略以及整体设计理念。作品成果可整理为图文集、创作展示PPT或短视频形式,参与课堂展示与交流。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路903.2.3项目目标能够根据图片AI的生成风格选择自己需要的工具,并灵活运用于图像创作各环节;能够围绕角色图像提取关键信息或撰写人物设定文本,并将其转化为适用于图像生成的提示词;掌握图生文、文生图与风格融合等AI工具的基本操作,形成完整的“角色设定—图像生成—风格优化”创作闭环;能够分析、评估AI生成图像在人物形象、风格一致性与创意表现上的优劣,并进行针对性调整;能独立完成一个原创动漫人物的AI创作作品,包括文字设定、角色形象、风格融合效果与创作说明。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路913.2.4项目实施一、阶段一:图生文描述(一)AI工具选择我们使用豆包和chatgpt两种工具,来对比查看两款工具的图生文能力,并且择优选用。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路923.2.4项目实施一、阶段一:图生文描述(二)提示词设计在“两阶段动漫人物创作”任务中,图生文阶段的提示词设计非常关键,它直接影响后续文生图生成的人物是否真实还原、形象饱满、风格一致。我们可以主动干预或重构生成文本,以提高后续文生图阶段的效果。生成角色的描述文本不仅应该关注人物的外貌特征、服饰风格,还应该关注角色的身份设定、姿势与动作、背景与风格,更生动的提示词,可以使得人物生成更加具体更加生动。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路933.2.4项目实施一、阶段一:图生文描述(三)生成内容展示我们使用漫画《JOJO的奇妙冒险:石之海》的人物空条徐伦的形象,如图3-38所示,并使用如下提示词:请你从人物身份设定、外貌特征、服饰风格、姿势与动作、背景与风格等角度描述这位动漫人物,不要提及JOJO元素,并总结成图生文的提示词形式。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路94豆包生成的角色描述任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路95ChatGPT生成的角色描述任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路96二、阶段二:文生图创作(一)AI工具选择本项目采用两种文生图生成方案,分别是:豆包+SeaArt组合:SeaArt平台集成了多种StableDiffusion(SD)引擎,具备丰富的动漫人物风格模型,适合进行二次元风格角色的创作。配合豆包生成的中文提示词,可无缝衔接至SeaArt使用,整体流程自然、风格契合度高。ChatGPT+DALL·E3组合:DALL·E3与ChatGPT集成,适用于英文提示词的创作场景。用户可以直接在ChatGPT界面中设计和调整提示词,并实时生成图像,特别适合从阶段一的ChatGPT图生文输出过渡到图像生成的场景。任务3.2实战项目人工智能应用通识
项目三
画布新次元:AI视觉智创全链路97二、阶段二:文生图创作(二)提示词优化为了提升生成效果,读者需要将图生文阶段获得的人物描述文本进一步结构化、视觉化,以适配文生图模型的输入逻辑。这一过程可借助项目二中介绍的AI文字工具(如豆包、ChatGPT等),对原始文本进行提示词优化,明确角色的性别、发型、服装、动作、背景与画风等要素,从而生成更具可控性的图
温馨提示
- 1. 本站所有资源如无特殊说明,都需要本地电脑安装OFFICE2007和PDF阅读器。图纸软件为CAD,CAXA,PROE,UG,SolidWorks等.压缩文件请下载最新的WinRAR软件解压。
- 2. 本站的文档不包含任何第三方提供的附件图纸等,如果需要附件,请联系上传者。文件的所有权益归上传用户所有。
- 3. 本站RAR压缩包中若带图纸,网页内容里面会有图纸预览,若没有图纸预览就没有图纸。
- 4. 未经权益所有人同意不得将文件中的内容挪作商业或盈利用途。
- 5. 人人文库网仅提供信息存储空间,仅对用户上传内容的表现方式做保护处理,对用户上传分享的文档内容本身不做任何修改或编辑,并不能对任何下载内容负责。
- 6. 下载文件中如有侵权或不适当内容,请与我们联系,我们立即纠正。
- 7. 本站不保证下载资源的准确性、安全性和完整性, 同时也不承担用户因使用这些下载资源对自己和他人造成任何形式的伤害或损失。
最新文档
- 燃气管网运行工安全文明竞赛考核试卷含答案
- 防渗墙工岗前工艺规程考核试卷含答案
- 粗纱工安全实践竞赛考核试卷含答案
- 木管乐器制作工核心知识考核试卷含答案
- 铸轧熔炼工安全操作知识考核试卷含答案
- 矿井测风工安全宣教强化考核试卷含答案
- 船舶过闸及升船机调度员岗前诚信品质考核试卷含答案
- 棉胶液制备工岗中突破考核试卷含答案
- 焊接专机装配工安全宣贯知识考核试卷含答案
- 棉胶液制备工岗位责任考核试卷含答案
- 义诊-我们做对了么?当义诊的流量入口碰上学科建设的“孤岛”
- 江苏省南京市2026-2027学年高三语文上学期开学模拟考试文言文详解:《王徽之传》、《任诞》、苏轼《墨君堂记》
- 2026宁夏文化发展集团有限公司第一批社会招聘45人笔试备考试题及答案详解
- 2026新特种设备焊工考试题库1000题(含标准答案及详细解析)
- 2026年贵州省中考英语试题(含答案)
- 2026广东广州白云金科控股集团有限公司“AI赋能投资”岗实习生招聘2人笔试题库含答案详解【巩固】
- 生活垃圾焚烧工技师考试试卷及答案
- 2026年安全员之江苏省C1证(机械安全员)通关考试题库带答案解析
- 文化墙改造施工组织设计方案
- 【中考真题】云南省2026年初中学业水平考试语文真题试卷(含答案)
- 2027届新高考语文精准突破复习:2026年高考作文-全国1卷“词语变化”作文讲评
评论
0/150
提交评论