WonderJourney 是斯坦福与谷歌打造,而且这个项目有点厉害啊,只需要1张图片就可以创建3D场景动画,从用户提供的任何位置(通过文本描述或图像)开始,并通过一系列不同但连贯的 3D 场景生成一个旅程。从演示效果来看非常流畅,3D游戏或者影视的场景创建要变简单了。
主要能力: ◆ 从任意位置(由文本或图像指定)开始,WonderJourney 沿着相机轨迹生成一系列多样化但连贯连接的 3D 场景。 ◆ 从同一个地点开始,WonderJourney 可以生成一组不同的“奇妙旅程”,并在不同的目的地结束。使用相机姿势的轨迹渲染下面的每个视频。 ◆ WonderJourney 还可以根据一系列文本描述(例如诗歌、俳句和故事摘要)生成受控的奇妙旅程。
大家关注了吗?今天凌晨的时候,OpenAI在官网宣布,在今年10月份将通过API向ChatGPT Plus和企业版用户提供全新文本生成图片产品——DALL·E 3。
官方是这样介绍的: “ DALL·E3 原生构建于 ChatGPT 之上,让您可以使用ChatGPT作为集思广益的合作伙伴并完善您的提示。只需询问 ChatGPT您想看到什么,从简单的句子到详细的段落。
ChatGPT中的 DALL·E3当提出想法时,chatGPT 将自动为DALL·E3生成定制的详细提示,将您的想法变为现实。如果您喜欢某个特定图像,但它不太正确,您可以要求 ChatGPT 只需几句话即可进行调整。”
这是否意味着,ChatGPT在DALL·E 3加持下将开启久违的多模态输出模式呢?还会带来哪些其他的变化?我们拭目以待吧!
想必大家今天都刷到GPT-4o模型能直接生成各种场景的图片了,朋友圈里、群内都在热议,这是图像生成领域的重大突破,以后我们都无需额外工具就能在ChatGPT内直接生成各式各样的高质量图片。
具体来说主要有以下几点:
功能描述:GPT-4o的图像生成功能允许用户通过简单的文本描述生成逼真的图片,包括但不限于漫画、手绘、LOGO、品牌宣传海报等。这些图片不仅清晰度高,还能精准渲染文字内容,例如制作带文字的LOGO或菜单。
技术优势:GPT-4o通过大量多样化的数据训练,具备生成高分辨率、具有一致性和细节丰富图像的能力。它支持多轮交互式生成,可以根据用户需求调整细节,例如宽高比、色号或透明背景等。
应用场景:GPT-4o的图像生成功能被广泛应用于创意设计、品牌宣传、教育等领域。例如,它可以将照片转换为素描风格的手绘作品,或者根据描述生成科学示意图和餐厅菜单。
限制与改进:尽管功能强大,但目前仍存在一些局限性,例如在密集文字或非拉丁文字图像生成方面可能表现不佳,角色一致性方面也还有待完善。OpenAI计划在未来几周内逐步优化这些功能。
Adobe Photoshop 引入了全新的 Firefly Image 3 图像 AI 模型,这一更新是在2024年4月23日宣布的。这个新模型是基于 Adobe Firefly Image 3 Foundation Model 开发的,旨在为创意专业人士和设计师提供更多的AI图像编辑功能和改进。
Firefly Image 3 模型不仅增加了生成式AI特性,还对Photoshop现有的所有功能进行了改进,使得生成的图像和输出看起来更加逼真、详细。
Firefly Image 3 模型通过提供更多的控制、改进图像生成以及使编辑过程更直观,大幅提升了图像编辑的深度与灵活性。这些新功能包括但不限于根据文本提示制作基于AI的图像,以及在Photoshop中引入的新的人工智能功能,如Reference Image等。
Adobe Firefly Image 3 模型的引入,标志着Adobe在AI图像生成领域的一个重要进步,它不仅增强了创意专业人士和设计师的工作效率和创造力,也为用户提供了更加丰富和强大的图像编辑工具。这些更新预计将在今年晚些时候通过Photoshop的beta桌面应用向公众开放。
原文地址戳这里!
如果你正在使用 chatgpt ,对 prompt 指令不太熟悉。那么这两个辅助工具将是你的得力助手。它们可以让你的 chatgpt 使用效率瞬间提升n个档次,让你成为chatgpt高手。第一个工具:Learn prompt ,这里有很多关于ChatGPT的基础知识,还有很多进阶的高级知识。 第二个工具:Snackprompt,这个提供很多实用的指令可以直接使用,都是网友自己亲测然后上传的。这两个工具可以让你更轻松地使用chatgpt进行自然语言处理,让你的工作效率得到大大提高。所以,如果你想成为chatgpt高手,一定要抓紧收藏这两个工具!