谷歌发布的一个名为 VLOGGER 的项目。这个项目能够根据输入的图片和音频生成对应人物讲话的视频。但是个人感觉 VLOGGER 看起来没有阿里巴巴发布的 DreamTalk 和 EMO 自然,大家觉得呢?
VLOGGER 主要特点: 1. 3D运动的扩散模型:它可以根据一张人物图像生成由文本和音频驱动的说话人视频。 2. 创新的架构:项目包含一个创新的基于扩散的架构,通过时间和空间控制来增强文本到图像模型的能力。 3. 高质量视频生成:能够生成高质量、可变长度的视频,并通过人脸和身体的高级表示进行便捷控制。 4. 广泛的适用性:与之前的工作相比,VLOGGER不需要为每个人单独训练模型,不依赖人脸检测和裁剪,能生成完整的图像(包括脸部和身体),适用于广泛场景,如躯干可见或身份多样化,这对于正确合成具有沟通能力的虚拟人至关重要。
项目地址:https://enriccorona.github.io/vlogger/
近期,Stability AI 推出的一款创新性视频生成模型 Stable Video 4D
模型下载:https://huggingface.co/stabilityai/sv4d
Stable Video 4D 的主要特点: - 高质量视频内容:Stable Video 4D 能够处理和生成高质量的视频内容,满足专业应用的需求。 - 合成数据集训练:虽然目前主要基于合成数据集进行训练,但 Stability AI 正在优化模型以适应真实世界的视频场景。 - 相关模型:除了 Stable Video 4D,Stability AI 还发布了 Stable Video Diffusion 和 SV3D 等模型,它们支持从图像或文本生成视频,并在多视图合成和高分辨率视频生成方面表现出色。
个人感觉这个模型还挺强的,大家觉得有哪些实际应用场景啊?
最新消息:OpenAI 宣布,GPT-4 API 现已对所有付费 API 客户开放!现在所有已经付款的 API 开发者都可以使用 GPT-4 API,该 API 允许使用高达8K tokens的上下文。
对于新的开发者,OpenAI 计划在本月底向他们开放访问权限,并根据计算资源的可用性逐步提高速率限制。
GPT-4 模型的发布将极大地提升基于 GPT 模型的产品性能。OpenAI目前已经向开发者们开放了GPT-3.5 Turbo、DALL·E和Whisper的APIs。而且OpenAI还在进行GPT-4和GPT-3.5 Turbo的微调功能的测试,并计划在今年晚些时候开放。
现在OpenAI还在开发新的模型,用于Chat Completions API,该API具有结构化界面和多轮对话能力,可以帮助开发者构建对话体验和完成广泛的任务,并降低了提示注入攻击的风险。
就在刚刚,著名生成式 AI 音乐平台 Elevenlabs 在官网发布了全新功能,文本可直接生成各种逼真音乐特效。
这项技术对于电影、游戏、短视频等行业非常有帮助,因为它可以简化寻找音效的过程,并且多数音效已经获得了 Shutterstock 的商业授权。
Elevenlabs 的这个新功能允许用户通过描述来生成音效,例如汽车呼啸而过的声音、刀剑碰撞的低沉声音或小提琴划过空气的尖锐声音。用户可以登录 Elevenlabs 的官网,选择 “Sound Effects” 并使用该功能。在生成音效之前,用户可以设置音效的时长和文本提示的还原程度。Elevenlabs 还提供了一些示例音效,如雷雨天气的声音和模仿兽人声音的摇滚音乐。
Elevenlabs还提供了语音克隆和文本转语音的功能,但目前对中文的支持较差,生成英文的效果则非常棒。
现在所有用户都可以免费试用 Elevenlabs 的这个新功能。大家可以访问 Elevenlabs 官网了解更多详情。
大家还记得 Sora 是什么时候发布的吗?2 月份,当时 OpenAI 发布之后,一夜之间就把 AI 视频生成界搅得天翻地覆啊,但是现在一点消息都没有了,反倒是其他平台遍地开花,特别是这个月,简直太爆炸了~
昨天深夜,Runway 放出酝酿了半年的全新版本 Gen-3 Alpha,也让我们再次见证了这些巨头的底蕴。
Runway Gen-3 Alpha 特点如下: 高保真视频生成:能够生成接近真实世界质量的视频内容,具有高度的细节和清晰度。 精细动作控制:模型能够精确控制视频中对象的动作和过渡,实现复杂场景的流畅动画。 逼真人物生成:特别擅长生成具有自然动作、表情和情感的逼真人类角色。 多模态输入:支持文字转视频、图像转视频、文字转图像等多种创作方式。 先进工具:支持运动画笔、相机控制和导演模式等专业创作工具。 增强的安全措施:引入新的内部视觉审核系统和 C2PA 标准,确保内容的安全性和可靠性。 高质量训练:使用高描述性的、时间密集的字幕进行训练,使模型能够理解和生成具有丰富时间动态的视频。
现在还在内测中,后期可以体验的时候再给大家分享地址!
10个月干完3年活!这款AI导图让团队脑暴像开挂一样爽——Nike、PepsiCo抢着用的协作神器,免费解锁顶级咨询公司思维武器库
✅ 一键激活AI脑洞:输入中心词,瞬间生成多维度分支! ✅ 开会不再鸡同鸭讲:10人同时拖拽节点改方案,实时看到彼此的脑回路碰撞! ✅ PPT杀手级替代:直接导出带动画的思维导图!
Miro 的思维导图工具是一款轻量级、易用且高度协作的AI赋能工具,适合个人或团队进行创意发散、逻辑梳理和知识管理。其核心价值在于将AI的自动化能力与人类思维的灵活性结合,同时依托Miro平台的协作生态,提升工作效率。
基本功能 - AI智能思维导图生成 :用户只需输入关键词,AI就能快速生成结构化的思维导图框架,为用户提供更高效的创作起点,节省时间和精力。 - 智能内容建议系统 :在用户绘制思维导图的过程中,AI会实时提供相关主题节点建议,补充案例数据,帮助用户拓展思路,丰富思维导图的内容。 - 会议内容自动摘要 :能够快速提炼会议记录和讨论要点,将其转化为简洁明了的摘要,方便用户记录和回顾会议内容,提高会议效率。 - AI辅助文档优化 :提供语法检查、文本润色和多语言翻译等功能,帮助用户提升文档质量,使其表达更加准确、流畅和专业。
协作功能 - 实时多人协作 :支持多人同步编辑、评论和版本历史追溯,团队成员可以在同一张思维导图上同时工作,实时看到彼此的修改和反馈,实现无缝协作,提高工作效率。 - 无限画布与信息整合 :白板可无限延伸,能容纳大量的内容和想法,方便团队进行头脑风暴和创意拓展,将各种零散的信息整合到一起,形成完整的知识体系。
工具地址:https://miro.com/mind-map/
ChatGPT发布以来一直备受关注,相信很多设计师也和我一样,期待国内也能有更多团队去研发AI人工智能。这不就来了嘛,2月20日,复旦团队发布国内首个类ChatGPT模型MOSS,但是由于瞬时访问压力过大,MOSS服务器当晚被网友挤崩。2月21日,MOSS官网发布公告称,MOSS还是一个非常不成熟的模型,距离ChatGPT还有很长的路需要走。
MOSS可执行对话生成、编程、事实问答等一系列任务,打通了让生成式语言模型理解人类意图并具有对话能力的全部技术路径。大家可以看看这个回答,国产的AI工具是不是也值得大家期待呢?
这次整理了一套「9 张动漫机车规格海报」提示词,整体走日系赛车杂志、角色设定集和产品信息图结合的风格。
9 张分别用了不同车型主题和配色,但版式、字体、人物、参数卡和装饰元素都保持统一,做成整套会很有系列感。
我把每一张的完整提示词都整理好了,车型、颜色、文案和参数都可以直接替换。喜欢这种动漫机车海报风格的朋友,可以收藏下来慢慢试。
工具:GPT-image 2 提示词: # 动漫机车规格海报通用提示词
请生成一张竖版 4:5 的日系动漫机车规格信息图海报,属于统一的原创摩托视觉企划系列。
整体融合日系赛车杂志、动漫角色设定集、潮流产品信息图和复古印刷海报风格。画面明亮、精致、留白充足,层级清晰,具有收藏级设计感。
---
## 一、画面主题
本张海报主题为:
【主题名称,例如:赛道粉焰 / 雨战蓝闪 / 电能脉冲】
表现一台:
【摩托类型,例如:封闭赛道超级摩托 / 城市街头格斗摩托 / 未来电动超级摩托】
整车设计特点:
【车型特征,例如:低矮车头、锐利整流罩、短尾结构、大尺寸刹车盘、轻微定风翼】
摩托车必须是完全原创的虚构车型,不对应任何现实品牌,不模仿任何现有厂商的标志性外观。
车身主要使用:
【车身主色,例如:亮黑色、珍珠白】
搭配本张专属强调色:
【专属强调色,例如:赤红色 / 电光青柠绿 / 钴蓝色 / 紫罗兰色 / 日光橙色 / 青绿色 / 冰蓝色 / 樱花粉紫色】
专属强调色只用于车身局部、轮圈边缘、人物服装细节和少量图形装饰,不能覆盖整个画面。
---
## 二、固定版式
左上角放置大型型号标题:
【型号代码,例如:PX-01】
标题使用粗黑、紧凑、略微倾斜的赛车字体,具有强烈速度感。
型号下方放置一句短宣传语:
【英文宣传语,例如:CHASE THE APEX】
宣传语放在热粉色或洋红色倾斜色带中。
右上角放置一层骑手的洋红色半调网点剪影,作为淡化的视觉回声。剪影只能作为背景图形,不得形成第二名完整人物。
画面中下部放置一台原创摩托车,采用低机位前侧 3/4 视角。
摩托车车头朝向:
【方向,例如:画面左侧 / 画面右侧】
前轮和后轮必须完整出现,车身不能被人物或信息框大面积遮挡。
摩托车和骑手共同占画面约 55%,顶部标题区约占 20%,底部参数卡约占 15%,四周保留清晰安全边距。
---
## 三、动漫骑手
在摩托车:
【人物位置,例如:右侧 / 左侧】
站立一名原创女性动漫骑手。
人物必须从头到脚完整显示,双脚自然落地,不遮挡摩托车的车头、油箱、车轮和主要结构。
骑手整体气质为:
【人物气质,例如:冷静自信 / 神秘克制 / 活力大胆 / 未来科技感】
人物穿着专业骑行服或赛车服,主色使用珍珠白、黑色、热粉色和洋红色,并加入本张车型的专属强调色:
【服装强调色,与车型专属色一致】
服装可以加入护肩、护膝、骑行靴、手套和简洁机能结构,但不能过度裸露,也不能穿裙装、高跟鞋或不适合骑行的服装。
骑手采用干净利落的二维赛璐璐动漫风格,人物面部精致、比例自然、手脚结构正确。
---
## 四、三个细节特写框
在主体左侧或周围设置三个尺寸统一、排列整齐的黑色细边框特写框。
三个特写框分别展示:
### 特写框 1
展示内容:
【前部细节,例如:前整流罩与头灯 / 前灯面罩 / 狭长灯带】
显示标签:
【标签 1,例如:FRONT COWL】
### 特写框 2
展示内容:
【轮组细节,例如:前轮、刹车盘与卡钳 / 电驱轮毂 / 湿地轮胎纹理】
显示标签:
【标签 2,例如:BRAKE SET】
### 特写框 3
展示内容:
【尾部细节,例如:车尾与排气结构 / 后摇臂与短尾 / 封闭式后车身】
显示标签:
【标签 3,例如:TAIL UNIT】
三个特写框必须展示不同部位,不能重复同一个角度或相同零件。
---
## 五、底部参数信息卡
底部设置一块横向黑色规格参数卡,占画面高度约 15%。
参数卡使用白色粗体数字、热粉色图标和细分隔线,信息排列整齐,具有专业赛车数据面板的感觉。
请准确显示以下参数:
POWER 【功率数值,例如:214 HP】
TORQUE 【扭矩数值,例如:118 NM】
WEIGHT 【重量数值,例如:198 KG】
TOP SPEED 【极速数值,例如:312 KM/H】
0–100 【加速数值,例如:3.1 S】
DRIVE 【驱动形式,例如:CHAIN / DIRECT】
数值可以是虚构数据,但必须合理、统一,并与摩托车型定位匹配。
---
## 六、统一配色系统
整个系列固定使用以下配色结构:
暖奶油色背景 #F7F0EC,占画面约 65%。
热粉色 #E95A91 与洋红色 #C93470,占画面约 20%,作为系列统一识别色。
墨黑色占画面约 10%,用于标题、边框、文字和底部参数卡。
本张车型专属强调色:
【专属颜色名称与色值,例如:钴蓝色 #245CFF】
专属色占画面约 5%。
无论车型专属色是什么,热粉色和洋红色都必须保留,不能被车型颜色替代。
---
## 七、渲染方式
摩托车采用半写实、高精度、高光泽的产品渲染。
需要清楚表现以下材质:
* 金属机械零件 * 碳纤维车身部件 * 橡胶轮胎 * 刹车盘和卡钳 * 透明挡风罩 * 光泽漆面 * 可信的车架与悬挂结构
骑手采用干净的二维赛璐璐动漫风格。
人物与摩托车必须共享相同的光线方向、透视关系和地面阴影,让两种渲染风格自然融合在同一张海报中。
背景叠加轻微纸张颗粒和复古印刷质感,但不能影响文字清晰度和摩托细节。
---
## 八、图形装饰
加入少量以下赛车视觉元素:
* 半调网点 * 棋盘格微型条带 * 三道倾斜斜杠 * 赛车编号框 * 倾斜色带 * 细速度线 * 小型闪光符号 * 简洁几何装饰
所有装饰必须克制、疏朗、有秩序。
装饰主要放在画面边缘、标题附近和信息区,不能覆盖人物脸部、摩托主体或参数文字。
还可以根据主题加入少量专属图形:
【主题装饰,例如:抽象雨滴 / 能量脉冲线 / 樱花瓣 / 热浪线 / 冰晶图形】
主题装饰只能少量出现,不能变成复杂场景背景。
---
## 九、必须准确显示的文字
型号:
【型号代码】
宣传语:
【宣传语】
三个细节标签:
【标签 1】
【标签 2】
【标签 3】
规格参数:
POWER 【数值】
TORQUE 【数值】
WEIGHT 【数值】
TOP SPEED 【数值】
0–100 【数值】
DRIVE 【驱动形式】
所有文字必须拼写正确、清晰锐利、排列整齐。
除以上指定文字外,不要生成任何额外文字、伪文字、品牌名称、日文字符、网址或乱码。
---
## 十、严格限制
画面只能出现一台摩托车和一名完整动漫骑手。
右上角半调剪影只能作为背景图形,不算第二名角色,不得生成第二个彩色完整人物。
不要出现:
* 现实摩托品牌标志 * 制造商名称 * 赞助商标识 * 复制的真实赛车涂装 * 真实车队编号系统 * 二维码 * 水印 * 网址 * 多辆摩托车 * 多名完整人物 * 真实摄影人物 * 复杂城市或自然风景 * 拥挤的信息排版
避免以下生成错误:
* 人物肢体融合 * 多余手指或手臂 * 人物脚部裁切 * 人物遮挡摩托车主体 * 前后轮裁切 * 车轮悬空 * 轮胎结构变形 * 重复车轮 * 重复排气管 * 错误刹车结构 * 透明或断裂车架 * 摩托机械结构不合理 * 特写框内容重复 * 文字模糊或拼写错误 * 过度写实的纪实摄影效果 * 画面过暗或装饰过满
最终效果应像一张收藏级日系动漫摩托规格海报,兼具角色设定、产品展示、赛车信息图和潮流杂志设计感。