DALL·E 3
PulseAugur coverage of DALL·E 3 — every cluster mentioning DALL·E 3 across labs, papers, and developer communities, ranked by signal.
5 天有情绪数据
-
AI图像生成用户怀念旧模型和技术
Reddit上的r/StableDiffusion板块发布了一个帖子,邀请用户分享他们对早期AI图像生成模型和技术的体验和回忆。讨论旨在记录该领域的快速发展,突出可能因技术进步而过时的细微或不寻常的方法。鼓励用户回顾他们在使用Stable Diffusion、SDXL等模型以及Midjourney、DALL·E 3等竞争对手,以及ControlNet等工具和各种定制方法(Loras)过程中的个人经历。
-
开源AI工具在用户体验上超越商业视频模型
一位Reddit用户分享了他们使用Qwen进行图像生成和Minimax H3进行视频连续性等开源AI模型组合,在单块RTX 4080 GPU上创建4K视频项目的经验。他们发现这种方法比商业视频生成模型更快、更有效,并怀疑商业模型故意引入错误以鼓励用户消耗积分。整个演示场景,从概念到最终放大,都在一个晚上完成。
-
OpenAI推出AI驱动的广告工具和Sponsored Agents
OpenAI推出了新的AI驱动广告工具,包括可以代表品牌与用户互动的Sponsored Agents。这些工具旨在创造更具吸引力和个性化的广告体验。该公司还将这些功能与HubSpot和Shopify等平台集成,以简化营销工作流程。
-
Text-to-image AI systems show cultural bias from hidden prompt revisions
一项新发表在arXiv上的研究指出,提示词修订是文本到图像生成系统中文化偏见的一个重要来源。研究人员开发了一个名为WORLDVIEW的基准,包含15种语言的8,960个提示词,以审计这种偏见。他们对DALL·E 3、Imagen-4和GPT-Image-1.5的分析显示,这些系统严重标记和刻板化非西方和非英语语境,这种偏见源于提示词修订层本身,而非核心生成模型。研究强调,需要审计部署中的系统,包括其隐藏的修订过程,以有效解决文化偏见。
-
OpenAI推出ChatGPT Work数据代理,以增强业务洞察力
OpenAI在ChatGPT Work中推出了一款新的数据代理,旨在帮助企业更有效地利用其数据。该代理允许用户连接公司特定数据,通过自然语言查询获得洞察,并构建由AI驱动的交互式仪表板。该工具旨在使数据分析对组织而言更易于访问和高效。
-
OpenAI论文用AI解决了纳维-斯托克斯方程,用于流体动力学
OpenAI的最新论文展示了一种解决纳维-斯托克斯方程(流体动力学中的一个基本挑战)的新颖方法。这一突破使得高度逼真且高效的流体模拟成为可能,可能对从科学研究到视觉特效的各个领域产生影响。该方法利用先进的人工智能技术,在模拟复杂流体行为方面取得了前所未有的准确性和速度。
-
AI生成的食物图片和菜单见解走红
生成式AI工具越来越多地被用于为餐厅菜单创建图片,导致出现不诱人且怪异的视觉效果,并在网上走红。虽然一些强大的AI模型可以生成逼真的食物图片,但许多餐厅使用的是能力较弱的工具,导致了明显令人反感的审美。除了图像,AI还在影响菜单决策,TasteGPT等工具分析海量数据集,帮助食品和饮料公司识别趋势口味和机会缺口。
-
Anthropic在Claude 3文本中嵌入隐形水印
Anthropic正在实施一种新的方法来识别AI生成的文本,通过在其Claude模型的输出中嵌入隐形、统计上可检测的水印。这种方法旨在区分AI生成的内容和人类创作的文本,为快速发展的AI领域中的真实性和归属权问题提供潜在的解决方案。
-
OpenAI CFO 详解“丰富智能”战略
OpenAI 的首席财务官 Sarah Friar 详细阐述了公司实现“丰富智能”的战略。这包括在硬件(芯片)、计算能力、模型开发和产品集成等多个方面取得进展。目标是以更低的成本、更大的规模提供更强大的 AI,并旨在超越 Google 和 Anthropic 等竞争对手。
-
新AI模型增强了跨多种生成方法的深度伪造检测能力 · 跟踪3个来源
研究人员正在开发先进的深度伪造(deepfake)检测方法,重点是提高跨不同生成技术的泛化能力。一种名为DF-MoE的方法,利用具有预训练模型的多模态专家混合(Mixture-of-Experts)骨干网络来提取多样化的视听线索,在多个基准测试中取得了优越的性能。另一种方法AdaptPrompt,采用视觉-语言模型(VLMs)的参数高效适应,并引入了一个新的数据集Diff-Gen,以更好地检测来自扩散模型以及Midjourney和DA…
-
经济实惠的 AI 图像生成器为昂贵的工具提供替代方案
Midjourney 和 DALL-E 3 等高级 AI 图像生成器的高昂成本对小型企业和个人创作者来说是一个重大障碍。本文探讨了仍能产生高质量结果的更经济实惠的替代方案,解决了创意 AI 工具可访问性的核心问题。
-
Stable Diffusion 用户寻求图像生成一致性建议
Reddit 的 r/StableDiffusion 版块上一位用户正在寻求关于如何在图像生成中实现特定构图控制和产品一致性的建议。他们正在比较包括 ChatGPT、Krea 2、Grok、Z Image 和 Flux.2 Klein 9B 在内的各种模型的生成结果,并指出在复制预期结果方面遇到的困难。该用户正在询问是应该使用 LoRA、更改文本编码器,还是问题主要在于提示词、条件设置或工作流程。
-
AI图像生成器利用先进工具探索“黑客帝国”主题
该集群关注AI图像生成工具的创意潜力,特别是引用了“黑客帝国”及其标志性的“红色药丸/蓝色药丸”选择。讨论中重点介绍了各种AI艺术平台和技术,包括Stable Diffusion、Midjourney、DALL·E 3,以及ControlNet、ComfyUI和AUTOMATIC1111 Stable Diffusion Web UI等高级界面,表明人们对利用AI探索复杂视觉概念的广泛兴趣。
-
OpenAI弃用DALL·E 3 API,由改进版GPT Image 2取代
OpenAI已于2026年5月12日正式弃用其DALL·E 3 API,此前Azure OpenAI Foundry和内部ChatGPT已提前退役。尽管被弃用,Bing Image Creator仍将DALL·E 3列为选项,与GPT-4o和MAI-Image-2.5-Flash等更新的模型并列,可能将请求路由到不同的后端或在单独的合同下运行。其继任者GPT Image 2于2026年4月发布,与前代产品相比,在原生2K分辨率、灵活的…
-
OpenAI 的 ChatGPT 图像生成限制是动态的,而非固定的
OpenAI 更新了其 ChatGPT 图像生成功能,提供两种模式:Instant(即时模式),所有用户可用;Thinking(思考模式),仅限 Plus、Pro 和 Business 订阅用户。思考模式提供更高分辨率(最高 2K),每次请求最多可生成八张图片,近期测试表明其比即时模式更具照片写实感。OpenAI 不公布固定的生成限制,而是在界面内显示一个动态横幅,反映当前的服务器负载,使得社区来源的数字不可靠。
-
生成式AI和基础模型革新医学影像
一篇新发表在arXiv上的论文探讨了生成式AI和基础模型对医学影像的影响。文章详细介绍了这些技术(例如DALL·E 3、Stable Diffusion、ChatGPT和Gemini等服务)如何改变包括医疗保健在内的各个领域。论文讨论了扩散模型和大语言模型的基本原理、它们在医疗支持中的应用,以及在医学领域中基础模型的构建和使用。
-
OpenAI 弃用 DALL-E 3 API,敦促迁移至 GPT Image API
OpenAI 已将其 DALL-E 3 API 标记为已弃用,并指示用户使用新的 GPT Image API。此更改不仅仅是简单的名称更新,因为它会引入有关生产环境数据保留策略和响应合同的潜在风险。建议开发人员在迁移任何实时流量之前,彻底测试 GPT Image API 的各个端点、数据处理和输出格式,以确保合规性和功能性。
-
OpenAI 的 DALL-E 图像生成工具详解
OpenAI 开发了 DALL-E、DALL-E 2 和 DALL-E 3,这些是人工智能驱动的软件工具。这些程序旨在根据用户提供的文本描述生成图像。
-
AI工具使创意产业格局多元化
随着AI工具的激增,创意产业正在经历重大变革。OpenAI、Google、Microsoft、Meta和Midjourney等公司正在开发先进的AI模型,如DALL·E 3、Claude 3和Gemini,它们能够生成高质量的创意内容。这一转变正导致创意格局的多元化,Stability AI的Stable Diffusion和Open Assistant等新工具和平台的出现,挑战了单一创意产业的传统观念。
-
OpenAI 的 GPT Image 2 简化图像编辑,取代复杂工具
OpenAI 的 GPT Image 2,也称为 ChatGPT Images 2.0,提供了一种简化的图像编辑方法,取代了对 Stable Diffusion 等复杂本地设置的需求。用户现在可以通过简单的 POST 请求进行单帧编辑,例如修复面部或更改对象。这项基于多模态 GPT-5 主干构建的新功能简化了以前需要复杂工作流程和多种工具的任务。