)
Qwen-Image-2.1信息图提示词大全学术信息图、科普卡与时间轴附整合包下载SEO关键词Qwen-Image-2.1、Qwen-Image-2.1信息图、AI生成信息图、学术信息图、科普图、AI时间轴、信息可视化提示词、Qwen Image提示词文章摘要本文整理 Qwen-Image-2.1 生成信息图的官方完整提示词包含学术信息图、建筑讲解图板、人物风格信息图、祈年殿拆解科普卡、AI 进化时间轴五个案例覆盖文生图和图像编辑两种用法提示词保持原文不变文首附整合包下载地址文末附信息图提示词写法要点与常见问题。大家好 这里是「代码简单说」欢迎大家关注同名公众号,不定时更新更多实用有趣的教程 也欢迎大家在评论区一起讨论交流!~这篇文章主要分享一下 Qwen-Image-2.1 生成信息图的提示词写法。信息图是 Qwen-Image-2.1 的强项场景官方示例里从多面板学术信息图、建筑讲解图板到中文科普卡、时间轴都有效果很完整的案例文字渲染能力比大多数文生图模型可靠。我把这些官方提示词原样整理出来做论文配图、科普内容、自媒体长图都可以直接复制改写。一、整合包下载如果不想自己配置环境可以直接使用 Qwen-Image-2.1 整合包支持文生图 图片编辑6GB 及以上显存可用适合本地直接体验。项目地址整合包下载Qwen-Image-2.1整合包支持文生图图片编辑二、生成信息图前的准备模式选择学术信息图、建筑图板、科普卡、时间轴属于文生图人物风格信息图需要先上传一张人物照片属于图像编辑。智能改写复现精选案例时关闭智能改写复现中文文生图案例时与页面按钮保持一致开。分辨率横版信息图用2K 横屏 2688×1536竖版科普卡和时间轴用1440×28809:16这类竖版比例。三、学术信息图示例文生图示例学术信息图Academic infographic参考输出完整提示词智能改写关这是一张白色背景的学术论文式多面板信息图整体以黑色无衬线标题、浅蓝色圆角模块、灰色坐标轴和柔和色彩的数据可视化构成。页面左上区域标题为 (a) Overall Architecture of UniMind展示 UniMind 的整体架构流程。该区域左侧有标题 Multimodal Inputs下面按纵向排列四种输入标签 Image、Text、Audio、Depth。第一行是一个小型写实照片内容为一只浅黄色狗正面张嘴坐着或站着右侧箭头指向浅蓝色圆角框框中文字为 Vision Encoder (EvT)第二行是浅蓝色文本卡片内部写着 A dog is playing in the park.箭头指向浅蓝色圆角框 Text Encoder (RoBERTa)第三行是浅绿色音频卡片包含绿色波形、左下角播放三角形和右下角 3s箭头指向浅绿色圆角框 Audio Encoder (AST)第四行是浅紫色深度图卡片画面为灰紫色人物剪影深度图箭头指向浅紫色圆角框 Depth Encoder (ResNet)。四个编码器右侧各有一组小圆角方块 token顶部标注 Modality Tokens颜色分别为蓝色、浅蓝色、绿色和紫色并由连线汇入中央大型浅蓝色圆角矩形。中央上方写有 × N Layers矩形内部文字为 Cross-Modal Transformer (Shared)下方有一条虚线弧形箭头指向 token 区域并标注 Cross-Modal Alignment。中央模块右侧以箭头连接到任务头区域顶部写着 Task Heads纵向四个圆角框分别写有 Image Understanding、Text Generation、Audio Captioning、Depth Estimation颜色与不同任务类型相呼应。页面右上区域标题为 (b) Zero-shot Transfer across Tasks是一张分组柱状图右上角图例依次为灰色 Single-Modal SOTA、蓝色 Multi-Modal SOTA、红色 UniMind (Ours)纵轴标题为 Performance (Zero-shot)刻度标有 20、40、60、80、100横轴五组任务标签依次为 VQA (v2)、Text→Image (Gen)、Audio→Text (Cap)、Depth (Est)、Retrieval (Image↔Text)。每组都有三根柱红色 UniMind 柱最高并在上方以红字标注提升值 7.6、10.2、8.9、6.1、9.3。页面左下区域标题为 (c) Qualitative Results是一个三列表格表头为 Image、Text Prompt / Input、UniMind Output。第一行左侧是金门大桥夕阳照片橙色天空与平静水面构成风景中间提示语为 Describe the scene.右侧浅蓝输出框写着 A beautiful sunset over the Golden Gate Bridge with orange sky and calm water.。第二行左侧是彩色音频频谱图呈现紫蓝绿色竖向频谱纹理中间文字为 What is happening in the audio?右侧浅绿色输出框写着 People are cheering and clapping in a stadium.。第三行左侧是灰色深度图画面中有多个人形剪影中间文字为 Estimate depth and objects.右侧是带检测框的深度估计结果画面上覆盖多个半透明矩形框与标签包括三处 person 和一处 tree背景呈紫橙色深度渐变。第四行左侧是狗在草地上奔跑的写实照片中间文字为 Generate a caption.右侧浅橙色输出框写着 A happy dog running on the grass in a park.。页面下方中部标题为 (d) Efficiency Comparison是一张折线图右上角图例显示灰色 OpenFlamingo、蓝色 LLaVA、红色 UniMind (Ours)纵轴为 Performance (Average)刻度标有 50、60、70、80、90横轴为 Training FLOPs刻度标注 10^19、10^20、10^21。三条带圆点的折线随训练 FLOPs 增大而上升红色 UniMind 曲线整体高于蓝色和灰色曲线图中红色注释写着 Better Performance with Fewer FLOPs旁边有红色向上箭头。页面右下上半部分标题为 (e) Ablation Study是一张浅灰网格表格表头依次为 Model Variant、VQA、Cap、Depth、Avg。表格行内容为 Vision Only、62.4、-、-、62.4 Text、68.1、57.3、-、62.7 Audio、70.2、64.5、-、67.4 Depth、71.5、65.8、60.1、69.1w/o Alignment、66.3、59.1、55.2、60.2最后一行以红色强调 UniMind (Full)、74.0、67.8、64.3、68.7。页面右下下半部分标题为 (f) Cross-Modal Alignment Visualization是一张二维散点嵌入可视化图左侧标注 Aligned Semantics 并有黑色弧形箭头指向点云区域。点云由多个颜色簇组成周围有彩色虚线椭圆轮廓右侧图例标注红色点为 Image、蓝色点为 Text、绿色点为 Audio、紫色点为 Depth散点簇之间部分重叠表达跨模态语义对齐。底部是一整段论文图注开头加粗样式为 Figure 1:斜体标题为 UniMind: A Unified Multimodal Foundation Model.以下为完整正文(a) The overall architecture of UniMind, which employs modality-specific encoders to extract tokens from heterogeneous inputs and a shared cross-modal transformer to learn aligned representations for multiple tasks. (b) Zero-shot transfer performance on five representative tasks. UniMind consistently outperforms single-modal and previous multi-modal baselines. (c) Qualitative results on dense prediction, captioning, and generation across different modalities. (d) Performance-efficiency trade-off. UniMind achieves better performance with fewer training FLOPs compared to strong baselines. (e) Ablation study showing the contribution of each modality and the importance of cross-modal alignment. (f) Visualization of the learned cross-modal embeddings, where semantically related samples from different modalities are well aligned in the joint space.四、建筑讲解图板示例文生图示例建筑讲解图板Architecture presentation board参考输出完整提示词智能改写关这是一张横向展开的建筑讲解图板整体以米白羊皮纸质感背景、砂岩色与深棕色线稿为主画面边缘和各分区使用细深棕色实线框与分割线组织版面。左上角是盾形城堡徽章标志深棕色线框内有三座塔楼剪影和下方波浪纹旁边的大标题为“奥拉维城堡”下方英文副标题为“OLAVINLINNA CASTLE”。标题下方是一段说明文字以下为完整正文“奥拉维城堡建于1475年是芬兰中世纪 防御建筑的代表作。城堡位于萨翁林纳 湖中的岩岛上三面环水地势险要 具有重要的历史与战略价值。”画面主体是一幅大型俯视透视建筑插画约占页面上半部大部分宽度表现奥拉维城堡坐落在湖中岩岛上周围是淡灰蓝色水面和岩石岸线城堡由多座圆形石塔、厚重环墙、内庭院、桥梁和入口组成线稿细密石材纹理、窗洞、箭孔和屋顶铜板分缝清晰可见。主视觉上有深棕色圆形编号点与虚线引导标注桥梁入口处标注“1 主入口”左侧内院标注“2 第一庭院”中央内院标注“2 第二庭院”中央高大的圆形主塔上方标注“4 圣奥拉夫塔 主塔”右侧圆塔标注“5 小塔楼”右侧外墙区域标注“6 环墙”。主视觉右上方还有一个简洁罗盘圆形细线外框内是深棕色北向指针上方文字为“N”。右侧竖向信息栏由多个矩形框组成顶部框标题为“基本信息”内部每行左侧配有线性小图标依次是钟表、城堡、建筑山墙、立方体材料图标和面积立方体图标对应文字为“建造时间1475年”、“建筑类型水上城堡”、“建筑风格中世纪防御建筑”、“建筑材料当地花岗岩”、“建筑面积约1,780㎡”。其下方框标题为“平面概览”包含一幅小型平面图使用深棕线条描绘三个圆塔、连墙、入口桥与内部建筑轮廓下方有比例尺刻度文字为“0”、“10”、“20”、“30m”右下角还有一个小圆形方向符号。再下方框标题为“立面比例分析”展示一幅小型立面比例示意虚线水平标尺旁标有“1.0”、“2.2”、“1.0”用以比较塔顶、塔身和基座等高度关系。页面中部偏下是一幅大型南立面建筑线稿标题为“南立面图 1:200”立面显示三座圆塔与连接墙体、入口桥、岩石基座和细小人群尺度塔顶为锥形铜色屋面塔身为浅砂岩色块石墙面。立面上方有水平尺寸标注“18.2m”、“24.6m”、“18.2m”左侧有竖向高度标注“32.8m”、“21.6m 塔身”、“11.2m 墙体”。立面右侧用虚线引出编号说明依次为“1 塔顶 铜质尖顶便于排水”、“2 射击孔 圆形孔洞用于防御”、“3 拱形窗 竖向狭长窗节奏均匀”、“4 墙体开窗节奏 小窗与箭孔交替布置 形成稳定的律”、“5 墙体材料 当地花岗岩砌筑厚实 坚固适应水上环境”、“6 基座 依岩而建直接与基岩 结合增强稳定性”。右侧中下部是“局部放大详图”区域采用三个横向分隔的细框卡片每个卡片左侧是放大的构造线稿右侧是引线文字。第一项标题为“1 塔顶构造 1:20”图中放大圆塔顶部标注“铜板屋面”、“木构基层”、“砖石檐口”。第二项标题为“2 拱形窗构造 1:20”展示拱形窗节点标注“花岗岩拱券”、“花岗岩侧壁”、“木质窗框”、“铁制格栅”。第三项标题为“3 墙体与箭孔构造 1:20”展示块石墙体与狭长箭孔标注“花岗岩块石”、“箭孔”、“内侧抹灰”。页面底部左侧是“入口人流分析”模块左边为图例深棕实线箭头代表“主要人流动线”深棕虚线箭头代表“次要人流动线”深棕圆点代表“停留节点”实心箭头代表“人流方向”右侧小插图以俯视方式表现桥梁、入口门楼、岛屿平台和众多微型人物剪影箭头沿桥面与门楼前广场组织人流方向。底部中间是“材料图例”模块使用五个圆形材质样本展示石材、砖、铜板、木材和铁件的纹理文字分别为“花岗岩 主要墙体材料”、“砖砌 拱券及局部构造”、“铜板 屋面覆盖材料”、“木材 门窗及结构构件”、“铁件 门窗格栅及构件”。底部右侧是“构造剖面示意 1:100”展示塔楼剖面与连接墙体塔顶木屋架、楼板、塔身空间、墙体厚度和岩石基础以剖切方式呈现右侧编号引线标注为“1 塔顶结构”、“2 木质屋架”、“3 塔身空间”、“4 楼板结构”、“5 墙体厚度 3.5~4.5m”、“6 基岩基础”。整体图面像专业建筑展示板线条清晰、图例完整、编号系统统一带有历史建筑手绘测绘图与信息可视化结合的风格。五、人物风格信息图示例图像编辑这个案例需要先上传一张人物照片模型会把照片转成杂志风人物信息图海报。示例信息图Character style infographic输入参考图按编号顺序提示词中可引用「第 1–1 张图」#1参考输出完整提示词智能改写关将输入图片转化为日系杂志风的「人物风格信息图」海报**严格保持输入人物的面容、五官与气质不变**。版面采用月白底与浅灰线网格整体清冷、高级、通透。 【版面与文字位置】 - 顶部留出一条**独立的横向标题栏**贯穿画面顶部的空白留白带大标题“月白纱语”置于此标题栏内左中位置右侧副标题“VOL.05 · 清冷艺术”最右端椭圆徽标内“写真特辑”。 - 中央人物立绘**整体适当下移并居中**人物含头顶发髻**不得进入顶部标题栏、不得遮挡或压住任何文字**人物头顶与标题之间保留明显空白。 - 各信息卡片沿左右两栏与下方排布文字均在各自卡片内不被人物遮挡。 - 排版精致、留白充足、有呼吸感。 【字体】所有文字采用清晰、精致、美观的字体大标题使用优雅的中文衬线/艺术字体笔画利落、有设计感、精致高级正文用清秀易读的黑体字形端正、无错字无乱码。 【中央人物】身着白色欧根纱一字肩荷叶边长裙、腰间黑色缎带高扎发气质清冷优雅左侧标注“168cm”、“身姿修长 — 天鹅颈优越”。 左上“个人档案”逐行“风格定位 清冷高级感艺术女性”、“适合色系 月白/雾灰/裸粉”、“避免色系 荧光色/高饱和撞色”、“身材优势 天鹅颈/肩颈线/纤细四肢”、“穿搭关键词 纱质/透视/垂坠/解构”。 左中“配饰细节”四项“珍珠耳饰 优雅点睛”、“黑色缎带 束腰点缀”、“细链项链 锁骨修饰”、“银质戒指 精致细节”。 左下“人物时间线”四段“晨间护肤”、“精致妆发”、“棚拍写真”、“艺术观展”。其下“搭配建议”“方案一 清冷极简 #F2ECE9”、“方案二 艺术编辑 #C9BBB2”。 右上“属性卡片”三头像“凝视 | 冷白皮妆 | 高扎发 时尚大片”、“侧颜 | 雾面裸妆 | 湿发感 艺术写真”、“慵懒 | 水光裸妆 | 低盘发 杂志封面”。 右中“服饰细节”四项“欧根纱质”、“一字露肩”、“荷叶边饰”、“波点透纱”。 右中“服饰色卡”标题“月白冷调”6色块依次“#FFFFFF 月白”、“#F2ECE9 珍珠白”、“#E5DED9 雾灰白”、“#D8CEC7 浅灰驼”、“#BFB2A8 裸棕”、“#2E2C2D 缎带黑”。 右下“性格标签”雷达五维“高级感 92%”、“清冷感 88%”、“艺术感 90%”、“氛围感 85%”、“松弛感 80%”。 右下“场景推荐”四条“美术馆 · 静谧午后”、“摄影棚 · 时尚大片”、“高级料理 · 微醺夜”、“艺术展 · 光影漫步”。 底部“风格关键词”词云仅含“高级感”、“清冷风”、“氛围感”、“纱感”、“艺术感”、“杂志风”、“松弛感”、“仙气”、“编辑风”。 【文字要求】画面中所有文字必须是以上明确指定的中文逐字准确、清晰可读、无错字无乱码不要生成任何未指定的多余文字。六、中文科普卡与时间轴示例文生图示例祈年殿拆解科普卡Temple architecture infographic参考输出已生成完整提示词智能改写开竖版祈年殿拆解科普卡纯白色宣纸底色左竖排书法祈年殿、小字天坛与红印章附线稿和简介主体从上到下分层拆解全建筑构件右侧虚线序号标注名称中式手绘配色棕、深蓝、朱红、米白。生成参数模型 pre-qwen-image-2.1-eval-preprocess-0917 · seed 42 · 1440×2880 · 智能改写 开示例AI 进化时间轴AI evolution timeline参考输出已生成完整提示词智能改写开生成一张计算机/技术主题的AI进化历程时间演化卡采用线性顺序的时间轴/编年结构风格为手绘/涂鸦。背景用大地棕褐色系单色渐变搭配手绘涂鸦元素与统一科普插图。版式采用卡片网格、上图下文图文留白清晰。标题用粗黑标题体正文用中文手写体重点文字采用渐变色填充字与双色调文字文字信息整体规整易读完整呈现AI发展节点。生成参数模型 pre-qwen-image-2.1-eval-preprocess-0917 · seed 42 · 1664×2496 · 智能改写 开七、信息图提示词写法要点先定版式框架开头写清楚是「多面板信息图」「图板」还是「科普卡」再定底色、字体、主色调让模型先有排版骨架。按面板分区描述每个面板用「页面左上区域标题为 xxx」这种方式定位面板内部再按行描述模块位置关系不会乱。所有文字逐条写明标题、标签、刻度、图例、表格内容全部写进提示词这是文字渲染准确的前提没有指定的文字就不要让它出现。图表类型单独说明柱状图、折线图、表格、散点图分别描述坐标轴、刻度、图例和数据不要混在一起写。人物信息图要锁脸上传照片转信息图时开头第一句就写「严格保持输入人物的面容、五官与气质不变」再约束人物不能遮挡文字。八、常见问题1、信息图里的文字出现错字怎么办先关闭智能改写保证提示词原文发送再减少一次性要求的长文字量优先保证标题和关键标签准确最后多生成几次挑选错字集中在小字区域时可以用图像编辑局部修正。2、图表数据是真实的吗不是。提示词里给出的数值会被当作「要渲染的文字」画进图里数据本身需要自己提供和核实模型只负责把内容排进版面。3、面板数量太多会失败吗面板越多、文字越多出错概率越高。官方最复杂的学术信息图有 6 个面板建议复杂信息图控制在 46 个面板超出时拆成多张生成。4、人物照片转信息图时脸变了怎么办检查提示词开头是否有「严格保持输入人物的面容、五官与气质不变」这类锁定语句并确认只上传了一张人物参考图避免多图干扰身份。九、总结以上就是 Qwen-Image-2.1 生成信息图的完整提示词教程覆盖文生图和图像编辑两种用法。核心思路是先定版式框架、按面板分区描述、所有文字逐条写明、图表类型单独说明把这套结构套到自己的主题上就能生成对应的信息图。本系列其他文章Qwen-Image-2.1 官方提示词分场景整理UI 界面篇AI 生成 App 界面角色立绘篇透明背景立绘与三视图试卷生成篇AI 生成数学试卷商品图篇电商产品图与广告摄影人像篇发型表情编辑与老照片修复分镜篇漫画分镜与广告故事板多图合成篇多人合照、换装与局部重绘