小红花·文摘
  • 首页
  • 广场
  • 排行榜🏆
  • 直播
  • FAQ
Dify.AI
ICLR 2026 | 基于视觉自回归模型的前馈式主体驱动图像生成算法 EchoGen

中国科学技术大学与淘天集团提出的EchoGen是首个基于视觉自回归模型的前馈式主体驱动图像生成框架。通过双路径主体注入策略,EchoGen在生成质量与效率上取得平衡,生成1024×1024图像的延迟仅为5.2秒,较现有扩散模型加速2-18倍,适用于实时应用场景。该研究在ICLR 2026上发表,展示了EchoGen在主体保真度和图像质量上的优势。

ICLR 2026 | 基于视觉自回归模型的前馈式主体驱动图像生成算法 EchoGen

实时互动网
实时互动网 · 2026-07-08T09:49:23Z

谷歌推出了Nano Banana 2 Lite和Gemini Omni Flash两个新模型,旨在加速图像生成和视频编辑。Nano Banana 2 Lite是高效的图像模型,适合高吞吐量需求;Gemini Omni Flash支持高质量视频生成和对话式编辑,允许用户通过自然语言修改视频。这两个模型结合使用,可实现快速的多媒体创作。

开始使用Nano Banana 2 Lite和Gemini Omni Flash进行构建

Google DeepMind Blog
Google DeepMind Blog · 2026-06-30T16:02:40Z

谷歌推出了Nano Banana 2 Lite和Gemini Omni Flash两个新模型。Nano Banana 2 Lite是一款高效的图像生成工具,适合快速原型设计;Gemini Omni Flash则支持视频生成和编辑。两者结合可提升多媒体创作的开发效率。

开始使用Nano Banana 2 Lite和Gemini Omni Flash进行构建

The Keyword
The Keyword · 2026-06-30T16:00:00Z
Nano Banana 2 Lite(Gemini 3.1 Flash Lite图像)现已在AI Gateway上线

谷歌的Nano Banana 2 Lite现已在AI Gateway上线,支持快速、低成本的图像生成,生成时间少于4秒,且编辑现有图像的成本降低至每张1K图像0.034美元,约为Nano Banana 2的一半。用户可通过AI SDK使用该模型,支持文本和图像的多模态生成。AI Gateway提供统一的API,便于调用模型和跟踪使用情况。

Nano Banana 2 Lite(Gemini 3.1 Flash Lite图像)现已在AI Gateway上线

Vercel News
Vercel News · 2026-06-30T00:00:00Z

Gemini应用通过个人智能技术,为用户提供个性化的图像生成体验。用户只需输入提示,如“设计我的梦想房子”,即可生成图像,无需上传照片。该应用与Google工具连接,自动提取用户信息,提高创作效率,用户可随时调整连接设置。

Gemini应用将个性化图像创作带给更多用户。

The Keyword
The Keyword · 2026-06-29T17:30:00Z
Nano Banana Images API 对接说明

本文介绍了Nano Banana Images API的对接与使用,包括图像生成和编辑功能。用户需申请API Token,通过HTTP请求调用接口,支持异步回调。示例代码展示了如何生成和编辑图片,返回结果包含任务ID和生成的图片链接。注意事项包括必填参数和图片可访问性要求。

Nano Banana Images API 对接说明

静觅
静觅 · 2026-06-28T20:45:58Z
GitHub 热门项目周刊 · 第 16 期 · 2026 年第 26 周

本期GitHub热门项目周刊精选了10个开源项目,涵盖AI、开发工具和云原生等领域。重点项目包括Vercel的eve框架、Cowart框架、codexpro和Boogu-Image,分别简化代理管理、便于Web服务开发、支持本地开发与ChatGPT集成,以及提供高效图像生成与编辑功能。这些项目帮助开发者快速了解趋势与新工具。

GitHub 热门项目周刊 · 第 16 期 · 2026 年第 26 周

浅时光博客
浅时光博客 · 2026-06-22T01:06:32Z
Codex CLI 对接 Flux MCP

本文介绍了如何在Codex CLI中接入Flux MCP,使用AceData Cloud的11个开源图像模型。用户需注册并获取API Token,配置后可直接在对话中调用图像生成和编辑工具,示例包括生成赛博朋克风格城市夜景和水彩画风格图像。

Codex CLI 对接 Flux MCP

静觅
静觅 · 2026-06-20T06:28:35Z
用了两天 iOS 27,我「AI」上了 Siri

苹果在WWDC 26上发布了iOS 27,重点升级了Siri AI,提升了其沟通能力和多模态功能。新Siri能更自然地理解和执行复杂指令,支持图像生成和编辑,整体体验显著改善,标志着苹果在AI领域的重要进步。

用了两天 iOS 27,我「AI」上了 Siri

爱范儿
爱范儿 · 2026-06-12T07:00:11Z
OpenAI Images Generations API 申请及使用

OpenAI图像生成API支持多种模型,如gpt-image-2,具备优越的指令遵循和文字渲染能力。用户需注册获取凭证,首次申请有免费额度。API允许用户通过指定参数生成高质量图像,支持多种尺寸和风格,并可选择同步或异步回调机制以处理长时间请求。文中还提供了调用示例和错误处理方法。

OpenAI Images Generations API 申请及使用

静觅
静觅 · 2026-06-10T20:46:47Z
Midjourney Imagine API 申请及使用

本文介绍了Midjourney Imagine API的申请与使用流程。用户通过输入关键字生成图像,申请API后可使用授权和描述生成所需图像。API支持图像放大、变换和局部重绘等操作,用户可通过Webhook接收生成结果,流式输出功能提升了实时查看生成进度的体验。

Midjourney Imagine API 申请及使用

静觅
静觅 · 2026-06-07T21:14:51Z
Midjourney MCP 对接指南

Midjourney MCP 是由 Anthropic 推出的模型上下文协议,允许 AI 模型通过标准接口调用外部工具。用户可以在 AceData Cloud 的 Midjourney MCP Server 上生成和编辑图像,核心功能包括图像生成、编辑、变换、混合和描述。使用前需获取 API Token,并可选择托管或本地运行,配置完成后可通过自然语言调用这些功能。

Midjourney MCP 对接指南

静觅
静觅 · 2026-06-06T06:17:38Z
微软首款高级推理人工智能问世

微软在2026年Build大会上发布了多款新AI模型,旗舰模型MAI-Thinking-1是其自主开发的重要进展,表现优异,基于干净数据训练。此外,还推出了图像生成、转录、语音和编码等模型,提升了处理速度和语言支持。

微软首款高级推理人工智能问世

The Verge
The Verge · 2026-06-02T18:12:44Z
JetBrains 对接 Seedream MCP

JetBrains 与 Seedream MCP 的对接使用户能够在 IntelliJ IDEA、PyCharm 和 WebStorm 中直接调用图像生成和编辑功能。用户需注册 AceData Cloud 平台并获取 API Token,配置后可生成中国风山水画或国潮插画等。

JetBrains 对接 Seedream MCP

静觅
静觅 · 2026-06-01T07:58:42Z
今天起,无限期免费!全球首个全模态API开放,Top 10 AI Lab出手

Agnes AI正式向全球开发者免费开放文本、图片和视频API,旨在降低使用门槛,促进创作与开发。其模型能够生成高质量的交互稿、图像和视频,支持多种应用场景,简化操作以推动AI技术的实际应用。

今天起,无限期免费!全球首个全模态API开放,Top 10 AI Lab出手

量子位
量子位 · 2026-06-01T07:57:16Z
OpenClaw v2026.5.28更小更快、支持Claude Opus 4.8

OpenClaw 2026.5.28版本更新显著提升了性能和稳定性,支持Claude Opus 4.8模型,启动速度加快14.5%,安装体积减半。子任务管理和聊天通道的稳定性得到改善,确保消息准确送达。新功能包括Krea图像生成和MiniMax音乐回复,整体优化使系统在复杂任务处理时更可靠,用户体验更流畅。

OpenClaw v2026.5.28更小更快、支持Claude Opus 4.8

极道
极道 · 2026-05-30T21:40:00Z
Adobe的对话式AI助手是一名平庸的设计实习生

Adobe的Firefly AI助手是一款设计辅助工具,旨在减轻创作负担并提供创意控制。虽然其编辑效果不如专业设计师,但用户可以通过对话式界面与其互动,了解编辑过程。助手能够执行图像生成和调整等多种任务,但在处理复杂请求时表现有限。总体而言,它适合希望简化设计流程的用户,但对于专业人士来说,效果仍显稚嫩。

Adobe的对话式AI助手是一名平庸的设计实习生

The Verge
The Verge · 2026-05-29T10:00:00Z
OpenCode + Seedream MCP

本文介绍了如何在 OpenCode 中使用字节跳动的 AceData Cloud MCP 图像模型。用户可以获取 API Token,配置后直接调用图像生成和编辑工具,生成中国风山水画或国潮风插画。提供了详细步骤和示例以供参考。

OpenCode + Seedream MCP

静觅
静觅 · 2026-05-29T06:21:56Z
Claude.ai + Midjourney MCP:一句话调出 4 张高清概念图,亲测全流程

Claude.ai与Midjourney MCP结合,用户可通过简单的英文提示生成高清图像,操作简便。MCP协议支持Claude调用外部工具,实现图像放大和变体生成。用户只需登录AceData Cloud并授权,生成的图像链接稳定,适合用于博客和设计。

Claude.ai + Midjourney MCP:一句话调出 4 张高清概念图,亲测全流程

静觅
静觅 · 2026-05-26T21:23:42Z
全新生图模型 Anima V1 发布:专注动漫风格的图像生成;MemLens 多模态长程记忆评估数据集:涵盖跨会话图文推理与知识更新机制

Anima V1 是 CircleStone Labs 于 2026 年推出的动漫风格图像生成模型,支持通过文本描述快速生成角色立绘和插画,用户可在 Gradio 界面中调整参数以提升创作效率。

全新生图模型 Anima V1 发布:专注动漫风格的图像生成;MemLens 多模态长程记忆评估数据集:涵盖跨会话图文推理与知识更新机制

HyperAI超神经
HyperAI超神经 · 2026-05-22T08:35:01Z
  • <<
  • <
  • 1 (current)
  • 2
  • 3
  • >
  • >>
👤 个人中心
在公众号发送验证码完成验证
登录验证
在本设备完成一次验证即可继续使用

完成下面两步后,将自动完成登录并继续当前操作。

1 关注公众号
小红花技术领袖公众号二维码
小红花技术领袖
如果当前 App 无法识别二维码,请在微信搜索并关注该公众号
2 发送验证码
在公众号对话中发送下面 4 位验证码
小红花技术领袖俱乐部
小红花·文摘:汇聚分发优质内容
小红花技术领袖俱乐部
Copyright © 2021-
粤ICP备2022094092号-1
公众号 小红花技术领袖俱乐部公众号二维码
视频号 小红花技术领袖俱乐部视频号二维码