图像

  • 谷歌发布Nano Banana 2 Lite:轻量级图像生成模型的”甜点球”

    核心看点 Google悄然推出Nano Banana 2 Lite,这是一款面向端侧和轻量级场景的图像生成模型。名字虽然有点”萌”,但背后的信号很清晰:谷歌正在加码AI图像生成的普及化,试图让手机也能跑高质量文生图。 详细解析 “Lite”不是简配,是精准定位 Nano Banana 2 Lite的核心卖点是小体积+高效率。与动辄…

    Google Gemini 2026年7月5日
  • Google推出Nano Banana 2 Lite:4秒内生成图像,成本大幅降低的Gemini图像模型

    核心看点:7月1日,Google AI宣布推出Nano Banana 2 Lite,这是迄今为止最快且最具成本效益的Gemini图像模型,可在不到4秒内生成文本到图像输出。 创意工作流迎来革新 Google此次推出了两大重要更新,旨在简化创意工作流程: Nano Banana 2 Lite:最快的Gemini图像模型,不到4秒生成图像 支持使用一个模型快速生成图像,然后立即使用…

    Google Gemini 2026年7月3日
  • OpenAI发布ChatGPT Images 2.0:单次可生成8张连贯图像,画质达2K

    核心看点 ChatGPT Images 2.0发布:引入推理规划功能,图像生成更符合逻辑 单次8张连贯图像:适用于漫画创作和设计工作流 画质升级至2K:分辨率大幅提升,细节更丰富 多语言文本优化:中文等语言文字生成效果更佳 详细解析 OpenAI推出的ChatGPT Images 2.0在图像生成领域带来了多项重要升级。最引人注目的是新加入的推理规划功能——这意味着AI在生成图…

    openai-gpt 2026年4月25日
  • 爆改漫画师!OpenAI 发布 ChatGPT Images 2.0,单次可生成8张连贯图像

    OpenAI 近日正式发布 ChatGPT Images 2.0,这是一次针对图像生成能力的重大升级。新版本引入了推理规划功能,让 AI 生成图像时能够更好地理解和遵循逻辑,大幅提升成图质量。 核心升级亮点 🧠 推理规划功能:Images 2.0 内置了类似 CoT(思维链)的推理规划能力,AI 会在生成图像前进行逻辑推理,使最终效果更符合用户意图,减少”幻觉&#8…

    应用 2026年4月22日
  • 全新的图像生成模型Reve Image

    Reve公司于2025年3月21日发布了全新的图像生成模型Reve Image。这款模型以其卓越的美学表现、精确的提示遵循以及优秀的排版能力脱颖而出,成为图像生成领域的一颗新星。 核心优势 应用场景 Reve Image在品牌设计、广告宣传、社交媒体内容创作等多个领域具有广泛的应用前景。它可以帮助品牌方快速生成符合品牌形象的视觉素材,提升品牌知名度和美誉度;也可以帮助广告商制作…

    2025年3月21日
  • PhotoDoodle:让你的照片跳脱现实,在虚实间起舞

    “PhotoDoodle”是一种艺术化图像编辑工具,由新加坡国立大学、上海交通大学、北京邮电大学、字节跳动和 Tiamat 团队联合推出。它可以通过文本提示词向写实照片添加涂鸦元素,实现虚实结合的图片效果。以下是其主要特点和功能: 主要特点 主要功能 应用场景 使用方法 项目地址 体验地址: https://huggingface.co/spaces/ameerazam08/P…

    2025年3月2日
  • 基于 Flux.1-Dev 模型的免费且无限制的 AI 图像生成工具:Raphael AI

    Raphael AI 是世界上首个完全免费且无限制的 AI 图像生成器,由 Flux.1-Dev 模型提供支持。以下是其主要功能和特点: 主要功能 使用场景 Raphael AI 以其免费、高效、隐私保护等特点,成为创作者和专业人士的有力工具。 地址: https://raphael.app/zh

    2025年2月19日
  • 谷歌推出AI图像生成工具Whisk 支持多张图片提示以图生图

    Google实验室的Whisk工具是一款AI创意生成工具,它的核心功能和特点如下: Whisk工具的设计理念是简化创意过程,使用户能够快速地将想象转化为视觉现实,无需深入复杂的文本提示或专业的图像编辑技能。它适用于艺术创作、广告营销、社交媒体内容等多个领域,为用户提供了强大的创意和视觉设计工具。 体验地址: https://labs.google/fx/zh/tools/whi…

    2024年12月18日
  • Leffa:Meta开源的AI试衣模型

    Meta开源的AI试衣模型名为Leffa,它是一个用于生成可控人物图像的统一框架,能够精确操控人物的外观(如虚拟试穿)和姿势(如姿势转移)。Leffa通过在注意力层中引导目标查询关注正确的参考键,显著减少了细粒度细节的失真,同时保持了高图像质量。此外,Leffa的损失函数是模型无关的,可以用于提高其他扩散模型的性能。 Leffa的主要功能包括: Leffa的效果确实非常好,可以…

    2024年12月16日
  • 谷歌“最强文生图模型”Imagen 3 正式上线

    谷歌的“最强文生图模型”Imagen 3已经正式上线,这标志着AI图像生成技术的一个新纪元。以下是Imagen 3的一些核心特点和功能: Imagen 3的上线不仅是谷歌在AI创作领域的重要布局,也是对现有图像生成技术的一次重大升级,为用户提供了更高质量的图像生成服务。 体验地址:https://gemini.google.com/

    2024年12月14日