GptImage4 - GPT Image 2 AI Image Generator and API
Explore public GPT Image 2 image generation examples from GptImage4. GptImage4 is independent and GPT Image 4 access is not currently available.

GPT-Image-2 Image Generation
根据这个动漫人物的镜头拆解图,生成一个视频,视频内容是这个人物走进图书馆去找到一本书,然后坐到位置观看

GPT Image 2 - Image To Image
我想做AI动漫视频,请帮我把图片的动漫人物,做一个人物多镜头的拆解

GPT Image-2 - Text to Image
Generate a detail page for beauty e-commerce

GPT Image-2 - Text to Image
故事板提示词 故事=在三角洲行动航天基地总裁浮力室玻璃长廊尽头,疾风开启技能紧急回避装置,放置锚点后,迅速向在另一侧奔跑突进,在玻璃长廊另一端的比特,释放出寻猎蜘蛛,进行阻拦,疾风即将靠近比特时,被寻猎蜘蛛的捕网命中,无法移动并被比特使用冲锋枪击倒 00-03S (疾风第一人称视角)干员疾风手持m14突击步枪,沿玻璃长廊向前奔跑,开启技能 紧急回避装置,放置锚点,迅速向长廊另一侧的比特突进,眼前的比特正手持p90冲锋枪漫不经心的巡逻 03-06s (全景拉近)此时可以看到玻璃长廊尽头,手持p90冲锋枪的比特突然发现正向自己急速奔跑而来的疾风 06-08s (比特第一人称视角) 眼见疾风越来越近,比特连忙用左手抛出精灵球 08-10s 一阵蓝白色的闪光过后,精灵球打开,从里面跑出一直机械蜘蛛 (近景) 镜头跟随,机械蜘蛛贴地迅速向奔跑而来的疾风靠近,机械触手敲击地面,传出紧张急促的哒哒声 10-13s 镜头拉远 比特手持冲锋枪向奔跑而来的疾风开火。 镜头拉近 镜头跟随 慢镜头 疾风利用翻滚躲开向自己射来的子弹 13-15s (仰拍近景) 疾风据枪姿势,高高跃起,即将靠近比特 镜头切至脚下 机械蜘蛛迅速从身上发射出捕网,命中疾风 仰拍,疾风被捕网控制,从空中掉落,在地上翻滚几圈后,挣扎 避免场景过于相似,创建一个电影制作板/视觉规划表,比例16:9,展示短片或商业广告的完整概念。布局应简洁、基于网格,配色贴合主题颜色,并分为清晰标记的部分。

GPT Image-2 - Text to Image
生成一张吃苹果的图片

Google - Nano Banana Pro
帮我把图片框里的一些细节省去,只保留关键的模块名字,比如文本 token id / text embedding /MTP等,同时尽可能保障图里面的文字在框框中央

GPT Image-2 - Text to Image
故事板提示词 故事=在雾气氤氲的寒潭孤石间,清冷白衣剑客遭遇墨影刺客突袭,几番凌厉近身交锋后,剑客挥出剑气击溃刺客,最终归于水墨寂静。 00-03S(远景)缓慢推镜、轻微下沉 寒潭孤石,白雾弥漫;白衣剑客背身伫立, 剑尖垂地,衣袍被冷风横向吹动,周身雾气暗流涌动,蓄势戒备。 剑客:“既已现身, 何必藏形?” 四角暗角,浮散墨尘,零气晕染 03-06s (全景)横移快拍、轻微抖动 石侧黑雾炸开,墨影刺客弓腰贴地疾冲,反 手短刀斜勞腰侧:剑客轻点石面,腰腹扭转横向飘逸闪避,白袍拉出飞白残影。 刺客: “取你性命,无需多言!” 06-08s (中景) 刀风墨线,地面溅起墨点 定点定格、近距离拍摄 刺客劈空瞬间转腕上挑刀尖,屈 膝顶击小腹;剑客沉马步抬剑横格,刀剑相撞,僵持承压,手臂筋骨紧绷。 剑客:" 就凭你?“ 08-10s 撞击爆墨,点状里花飞溅 (近景) 小幅环绕、动态跟焦 二人借力同时腾空后跃,身体悬空滞空,衣 袂反向炸开,身形拉扯出水墨拖影,潭水被劲风掀起波纹。 刺客:“受死!“ K白残影,墨滴慢速拖尾 10-13S(仰拍全景) 急速拉远、广角撑开 半空之中,剑客沉肩转腰,挥剑 竖向斩击;浓重墨气缠绕剑身,刺客慌忙横刀格挡,身体僵滞无法卸力。 剑客:“ 墨落,定生死。 13-15s 浓墨剑气,白雾被强行吹散 (中景) 缓慢回正、平缓抬镜 刺客受击化作漫天墨累消散;剑客单脚洛石 ,剑尖轻点潭水,缓缓收剑,脊背挺直,神色清冷平静。 终归入里。” 里架淡化,雾气重新聚拢,暗角收尾 剑客:“尘缘一缕, 避免场景过于相似,创建一个电影制作板/视觉规划表,比例16:9,展示短片或商业广告的完整概念。布局应简洁、基于网格,配色贴合主题颜色,并分为清晰标记的部分。

GPT Image-2 - Text to Image
结合这个图,帮我画一个qwen3.5的前向结构图flowchart TB %% ============ ① Embedding & Multimodal Fusion ============ TXT(["文本 token ids<br/>(B, L_t)"]) IMG(["图像 patches<br/>(N_p, 3, 16, 16)"]) VID(["视频 patches temporal=2<br/>(N_v, 3, 16, 16)"]) subgraph EMB["① Embedding & Multimodal Fusion"] direction TB TE["text Embedding lookup<br/>248320 × 4096 (BF16)"] VE["Vision ViT 27L + 2×2 Merger<br/>1152 → 4096 (见 §8, BF16)"] FUSE["在 <|image_pad|> / <|video_pad|><br/>占位符位置 scatter 视觉 token"] TE --> FUSE VE --> FUSE end TXT --> TE IMG --> VE VID --> VE FUSE --> POS["② M-RoPE position ids<br/>section = [11, 11, 10] (T, H, W)<br/>仅生成 ids,实际旋转在 §6 内做"] POS --> X["x ∈ (B, L, 4096)"] %% ============ ③ 60-Layer Hybrid Backbone ============ X --> STK["③ 60 × Hybrid Decoder Layer (见 §3–§7)<br/>[ GDN × 3 → GAttn × 1 ] × 15<br/>每层 = RMSNorm → Mixer → ⊕ → RMSNorm → MoE → ⊕"] STK --> FN["④ Final RMSNorm"] FN --> H["h ∈ (B, L, 4096)"] %% ============ ⑤ Output heads ============ H --> LMH["⑤ LM Head 4096 → 248320 (tied = false)"] H -. speculative .-> MTP["⑤′ MTP Block ×1 → 复用 LM Head (见 §9)"] LMH --> OUT(["next-token logits (B, L, 248320)"]) MTP -. -> OUT

GPT Image 2 - Image To Image
我需要生成一份宣传海报,我们是贵州猛龙篮球俱乐部,主场位于贵州遵义。海报需要体现贵州和篮球的有关元素,体现好戏开场的效果。我提供的图片是我们的logo,可以放在合适位置,也可以根据logo进行演变元素。

GPT Image-2 - Text to Image
活动主题“荔创未来·湾聚英才”——广州市荔湾区第四届创新创业大赛 为统一赛事品牌形象、强化赛事辨识度,本次大赛将搭建专属、规范、适配区域特色的品牌视觉识别体系,全程贴合荔湾区岭南文化、西关特色元素,打造专属赛事视觉标识,所有视觉物料风格统一、规范统一、调性统一。 本次赛事视觉体系核心设计围绕大赛主题“荔创未来·湾聚英才”展开,主视觉融合荔湾区地域符号、岭南建筑元素、创新科技意象,兼顾文化底蕴与现代创新质感。同步规范赛事专属LOGO、主色调、标准字体、视觉版式等基础视觉元素,统一应用于海报、推文、展板、证书、现场布置、媒体报道配图等全部赛事物料与宣传载体。 所有视觉设计内容严格遵循官方宣传规范,杜绝低俗化、同质化设计,突出荔湾本土特色与创新创业内核,形成系统化、标准化的赛事品牌视觉体系,保障赛事整体形象统一、专业、大气,持续沉淀赛事品牌资产。

GPT Image-2 - Text to Image
生成一个乐高城市夜景图片

GPT Image-2 - Text to Image
帮忙做一张电影票,幼儿园要用 电影:哪吒之魔童闹海 举办方:碧湖幼儿园 时间:5月27日 座位:VIP专座 影厅:多功能厅 持票人:熊顾铭