文章来源:放心AI网发布时间:2025-05-06 16:09:36
来自纽约大学、麻省理工学院和谷歌的研究团队近日提出了一个创新框架,旨在解决扩散模型在推理时间扩展方面的瓶颈问题。这一突破性研究超越了传统简单增加去噪步骤的方法,为提升生成模型性能开辟了新途径。
该框架主要从两个维度展开:一是利用验证器提供反馈,二是实施算法以发现更优的噪声候选。研究团队以256×256分辨率的预训练SiT-XL模型为基础,在保持250个固定去噪步骤的同时,创新性地引入了专用于搜索操作的额外计算资源。
在验证系统方面,研究采用了两个Oracle Verifier:Inception Score (IS)和Fréchet Inception Distance (FID)。IS基于预训练的InceptionV3模型选择最高分类概率,而FID则致力于最小化与预先计算的ImageNet Inception特征统计之间的差异。
实验结果显示,该框架在多个基准测试中表现出色。在DrawBench测试中,LLM Grader评估证实了搜索验证方法能持续提升样本质量。特别是ImageReward和Verifier Ensemble在各项指标上都取得了显著进步,这归功于它们精确的评估能力和与人类偏好的高度一致性。
这项研究不仅证实了基于搜索的计算扩展方法的有效性,也揭示了不同验证器的固有偏差,为未来开发更专业化的视觉生成任务验证系统指明了方向。这一发现对于提升AI生成模型的整体性能具有重要意义。
上一篇: Perplexity收购专业社交平台Read.cv
近期,人工智能搜索引擎 Perplexity 宣布收购了与 LinkedIn 竞争的专业社交平台 Read cv。随着这一收购协议的达成,Read cv 将在本周五开始逐步停止运营,用户将有机会在5月16日前导出他们的数据,包括个人资料、
下一篇: 字节跳动推出针对中文开发者AIIDE产品Trae性能对标Cursor
字节跳动近日推出了一款针对中文开发者的 AI 集成开发环境(IDE)——Trae。这一产品旨在与 Cursor 和 Windsurf 等国际知名工具竞争,特别是在中文开发者的使用体验上,Trae 希望能填补现有工具的短板。在编程的日
相关攻略 更多
最新资讯 更多
淘天推出创新对齐方法,解决视觉大模型中的幻觉问题
更新时间:2025-05-06
OpenAI几周内发布o3-mini,性能略逊于o1-pro
更新时间:2025-05-06
Runway推全新AI图像生成器Frames,打造电影级视觉表现
更新时间:2025-05-06
微软推出WindowsAI搜索功能测试,提升文件查找体验
更新时间:2025-05-06
OpenAI专家:社交媒体上的AI炒作远比你想象的复杂!
更新时间:2025-05-06
AI始祖重生:世界首个聊天机器人ELIZA在60年后重获新生
更新时间:2025-05-06
大型出版公司Dotdash与OpenAI达成合作,裁员百余人
更新时间:2025-05-06
阶跃星辰上线Step-2mini、Step-2文学大师版语言模型
更新时间:2025-05-06
MiniMax海螺语音全球同步上线包含T2A-01-Turbo等模型
更新时间:2025-05-06
MIT、DeepMind研究揭示视觉语言模型无法理解否定表达的原因
更新时间:2025-05-06