ChatGPT 上线虚拟试穿和商品收藏两项购物功能
OpenAI 在 ChatGPT 中全球推出虚拟试穿和商品收藏两项购物功能。虚拟试穿允许用户上传自拍或全身照来预览服装与配饰效果,购物结果中会出现 Try On 按钮;商品收藏功能则可将发现的产品保存到应用内的收藏页。
OpenAI 在 ChatGPT 中全球推出虚拟试穿和商品收藏两项购物功能。虚拟试穿允许用户上传自拍或全身照来预览服装与配饰效果,购物结果中会出现 Try On 按钮;商品收藏功能则可将发现的产品保存到应用内的收藏页。
Ideogram 4.5 只改动用户指定区域而保持其他部分不变,相比 GPT-Image 2.5 和 Nano Banana 在多次编辑后更少产生伪影。该模型原生 2K 分辨率,提供四个质量档位,单张费用 0.8 至 22 美分,现已通过 Ideogram 平台与 API 上线,并与 Picsart、Runway、Pika、Leonardo AI 达成合作。
Google Research 提出 Diffusion Controller 框架,将扩散模型去噪过程重构为连续控制问题,通过一个轻量级"转向阻尼器"附加网络引导生成、保持基础模型冻结不变。其白盒微调版本在 Stable Diffusion v1.4 上对基线模型取得 90% 胜率,并支持对无法修改内部权重的闭源模型进行控制。
Google DeepMind 发布基于 Gemini 3 Pro 的高保真图像生成模型 Nano Banana Pro(Gemini 3 Pro Image),已在 Gemini API、Google AI Studio 与 Vertex AI 启动付费预览。
推荐理由:作为 Nano Banana 的高保真升级,Gemini 3 Pro Image 在分辨率、文本渲染与本地化上给出了具体能力边界,方便开发者对照 2.5 Flash Image 评估取舍。
HF 博客给出在 Flux.1-Dev 上加速 LoRA 推理的方案,结合 Flash Attention 3、torch.compile 与 TorchAO FP8 量化,并借助 Diffusers 的 hotswap 机制避免换 LoRA 时触发重新编译。
推荐理由:这篇博客把 Flash Attention 3、torch.compile 与 FP8 量化组合成可复用的 LoRA 推理加速配方,并给出 H100 与 RTX 4090 上的实测对照。
1. It's from Hugging Face Blog 2. Title: "AI for Game Development。