这些图片和视频全部由一条 prompt 生成。点击任意卡片,查看它背后的完整提示词。
ERNIE-Image 采用单流扩散 Transformer 架构,专门处理生成模型常见的薄弱环节:清晰可读的文字、严格的版面排布、多对象提示词遵从,以及中英双语指令。内置的轻量 Prompt Enhancer 会把简短输入扩写成结构化描述,你无需钻研 prompt 工程也能拿到可用结果。
ERNIE-Image 是一款 8B 单流 DiT 模型,搭配 Prompt Enhancer 和 Turbo 蒸馏版本。下面是这套架构真正擅长的事。
内置 Prompt Enhancer 会把一句话想法扩展成详尽的结构化提示。你专注创意,模型接管 prompt 工程那一层。
海报上的长段正文、信息图的标题、漫画里的对话气泡、UI 稿里的按钮标签——字形清晰可辨,不会像其他扩散模型那样糊成一团或者拼出乱码。
多对象、明确的空间关系、知识密集的长提示词,模型都会按你写的来,而不是退化成一张通用的"好看图"。
海报、漫画、故事板、UI 稿、信息图——模型会推理整个页面的版式和分格,而不只是主体和风格。
完整 8B 模型以 Apache 2.0 协议发布,单张 24GB 显卡即可本地运行。
为每项任务选择合适的工具和模型,调整可用参数,并在统一的资产记录中管理完成的作品。
根据文字描述生成图像
改造与增强已有图像
根据文字描述生成视频
让静态图像动起来
查看生成状态,并从共享资产库中重新打开已完成的图像或视频结果。
生成开始前即可查看模型名称、积分成本和支持的参数,明确每次生成的预期。
关于 ERNIE-Image 你想知道的一切