

人工智能领军企业 OpenAI 今日正式推出新一代语音模型 GPT-Live,旨在让 AI 语音交互突破机械感,实现接近真人的自然对话体验。
1. 架构升级实现连续自然的双向交互
传统的语音 AI 系统由于采用级联或轮次式架构,常常导致响应生硬或因背景噪音误判而打断用户。GPT-Live 彻底打破了这一限制,引入了“全双工(Full-Duplex)”架构。该架构能够让模型在接收输入的同时持续生成输出,实现每秒多次的交互决策。这也意味着它拥有边听边说、支持插话、提供“嗯嗯”等积极倾听反馈的能力,让用户可以随时停下来整理思绪或要求其放慢语速,带来了流畅且高度拟真的人际对话体验。

图源:openai.com
2. 任务委托机制与智能卡片的可视化升级
GPT-Live 在智能表现上实现了重大突破,它将“实时连续交互”与“深度任务处理”进行了架构解耦。当用户提出需要联网搜索、复杂逻辑推理或智能体协助的深度问题时,语音模型会在后台默默将任务委托给最新前沿模型(首发支持 GPT-5.5),同时保持与用户的语音交谈流。此外,全新的 ChatGPT 语音不仅在科学推理和搜索能力上远超以往版本,还新增了针对天气、股票和体育等主题的可视化卡片展示功能,让回答一目了然。

图源:openai.com
3. 专为实时语音打造的安全保障体系
由于语音对话具有实时展开的特性,OpenAI 为其构建了专用的音频原生评估与多维度安全测试,重点防范自伤、情感依赖、暴力及性内容等关键风险。系统内置了“说话时触发”的防御保障,一旦检测到不安全输出,会引导模型切换至安全回应或在必要时直接终止对话。针对青少年,模型经过了适龄行为训练并提供了家长控制功能;针对语音伪造风险,模型内置防护防止模仿真人,且严格限制只能使用预定义的九种 ChatGPT 声音。
业界分析认为,此次更新显著提升了 ChatGPT 语音功能的实用性与沉浸感。OpenAI 强调,这项技术突破将为未来执行长周期、高复杂度的智能体任务奠定基础,标志着语音交互从“指令响应”迈向“智能协作”的关键一步。
1. GPT-5.6三档登场,OpenAI 把模型做成了一个"家族"
OpenAI 正式发布了 GPT-5.6 系列模型(包含旗舰模型 Sol、均衡模型 Terra 和高性价比模型 Luna),该系列的核心特点是“默认高效运作,按需释放强劲性能”。

图源:Openai.com
GPT-5.6 实现了更高的“单位成本性能提升”。Sol 在编程、知识工作、网络安全和科学领域刷新了多项行业 SOTA(最高水平),且比前代及竞品消耗更少 Token、成本更低。提供更长推理时间的 max 选项。更引入了 ultra 模式,以更短的延迟和更高的 Token 投入解决极高难度的长周期任务。在设计审美上大幅跃升,可完成生成界面并自主校验修饰等复杂计算机操作。
2. Grok 4.5亮相:编程基准测试全球第一
Grok 4.5 是迄今最智能的混合专家(MoE)模型。它不仅深耕软件工程,还全面扩展至数据科学、金融和法律等长周期、高难度的多领域端到端知识工作。模型融入了数万亿 Token 的 Cursor 真实开发与智能体交互数据,使其极其擅长跨多文件的大型代码库理解、工具自主调用和长任务处理。针对其强悍的计算机交互和工程能力,模型同步升级了严密的分层网络安全防护机制。

图源:Cursor.com
月之暗面发布新一代模型 Kimi K3,重点展示了 AI 在设计与创作流程中的新能力。它不只是回答问题,而是可以参与前端页面、3D 场景、游戏原型、动态图形视频、交互式报告等内容的生成与优化。

图源:Kimi.com
从产品设计角度看,Kimi K3 的核心亮点是“视觉闭环”和“交互式输出”。它可以结合截图、视频和运行结果持续调整页面布局、动画效果、图表表达和视觉细节;同时,Kimi Work 中的小组件与看板能力,也让 AI 输出不再停留在聊天记录里,而是沉淀为图表、状态卡片、数据面板、动态报告等可持续使用的界面资产。

图源:Kimi.com
这代表 AI 产品设计正在发生变化:未来的设计交付物不只是静态稿或文字方案,而会越来越多地变成可运行、可交互、可持续更新的系统。对设计师来说,AI 的价值也不再只是辅助出图或写文案,而是参与“生成—观察—反馈—再优化”的完整设计流程。

图源:Kimi.com
近日,字节发布新一代图像模型 Seedream 5.0 Pro,并已在火山引擎上线。根据相关测评体验,该模型在图像质量、提示词理解和综合生成能力等方面表现突出,整体能力已接近 GPT-Image 2.0 水平。

图源:Arena.AI
1. 图像生成质量进一步提升
Seedream 5.0 Pro 在画面完整度、细节表现和提示词理解方面都有提升。用户只需用自然语言描述需求,就能生成较高质量的图片内容,适用于公众号配图、营销素材、创意草图等场景。

图源:X.com
2. 图像编辑门槛明显降低
相比单纯生成图片,Seedream 5.0 Pro 更强调图像编辑能力。用户可以通过文字指令完成元素替换、背景调整、风格变化和细节优化,让图片修改变得更简单。

图源:X.com
对于内容创作者、设计师和品牌运营人员来说,这类模型的进步意味着 AI 图像生成与编辑正在从“技术尝鲜”走向更实用的日常生产工具。
OpenAI 与 Work Louder 联名推出的一款名为 Codex Micro 的实体机械键盘控制台(售价 230 美元)。它是专门针对 AI 智能体(Agent)和 Codex 开发流程设计的硬件指挥中心。按键自带 RGB 灯光,能实时直观显示智能体处于空闲、思考、运行或等待等不同状态。

图源:Openai.com
Codex Micro 配备 13 个机械轴、拨杆、触摸传感器及旋转编码器(旋钮)。用户可以通过拨动摇杆快速启动审查 PR、调试或重构代码等工作流;旋转旋钮可实时调节 AI 的推理级别;命令键则能一键执行接受、拒绝或新建聊天等核心操作。

图源:Openai.com
OpenAI 推出 Codex Micro 这款硬件产品,看似是和潮流外设品牌的“跨界联名”,但实际上深刻反映了 AI 从“网页对话框”走向“全自动智能体(Agent)”时代后,人机交互逻辑的底层变革。这绝对不是为了赚硬件钱,而是 OpenAI 在为接下来的“智能体大爆发”铺设新型的人机接口(HCI)。它在做一场实验:当 AI 成为你的数字员工,人类需要什么样的工具来轻松驾驭它们?Codex Micro 就是给出的第一个实体答案。
在2026年世界杯期间,亨氏通过非官方赞助的极简营销成功出圈。其联合创意热店打造了“想赢的薯条,蘸亨氏”系列海报,仅用弯曲的波浪薯条和红色番茄酱,就传神地还原了足坛“倒挂金钩”、“贴地斩”等经典破门瞬间。同期还推出了将酱包化身裁判红黄牌的趣味创意,用低成本的视觉巧思引爆了球迷的共鸣。
1. 想赢的薯条,蘸亨氏
亨氏(Heinz)这套“想赢的薯条,蘸亨氏”世界杯营销海报由知名创意热店 Heaven & Hell 打造。 该系列完全遵循极简主义,仅用弯曲程度不同的波浪薯条和一抹红色的番茄酱,就高度还原了足球场上的各种燃情瞬间。利用了波浪薯条天然的弯曲弧度,完美模拟了球员在空中舒展身体、狠狠一脚将“番茄酱足球”抽入网窝的动感瞬间。



图源:SocialBeta.com
2. 亨氏「罚下」所有无味之物
除了国内地铁站刷屏的薯条系列,亨氏在海外同期还推出了“Penalty Packets(惩罚酱包)”创意。将足球文化中广为人知的判罚符号与消费者长期抱怨的「小包装调味品不够用」问题相结合,特别推出 Penalty Packets(罚牌酱包),向平淡无味的食物出示红牌。将番茄酱和芥末酱包设计成足球裁判手中的红牌与黄牌,让看球吃热狗、薯条的球迷会心一笑。


图源:SocialBeta.com
Rerun 是一款让机器人团队可视化机器"看到"的数据、并用于日志查询和模型训练的物理 AI 数据层工具。Studio Gruhl 围绕"机器人如何看世界(How do robots see?)"这一命题展开设计,刻意摒弃传统深科技品牌冰冷临床的刻板印象,转而从真实的机器人作坊——螺栓、烙铁、熔化的芯片——汲取灵感,追求理性分析感与人本温度并存的双重气质。


图源:studiogruhl.com
字标取自螺栓头部几何形,中心小写 e 做切面处理,其余字母沿用相同棱角逻辑并有意微熔连笔以增添手工触感;色彩体系基于机器人可视化常用的 Jet Colormap 及其平滑变体 Turbo 构建高饱和渐变,辅以 Noir、Sandpaper、White 做基底平衡;字体采用 Basis Grotesque 搭配 Reddit Mono,通过严谨网格贯穿所有数字与实体触点,形成既系统严谨又具表现力的品牌视觉语言。

图源:studiogruhl.com
以上是[A's Trend] 32期周刊的内容,我们会持续为您带来最新设计&科技趋势~~
复制本文链接 文章为作者独立观点不代表优设网立场,未经允许不得转载。








发评论!每天赢奖品
点击 登录 后,在评论区留言,系统会随机派送奖品
2012年成立至今,是国内备受欢迎的设计师平台,提供奖品赞助 联系我们
用户体验增长
已累计诞生 795 位幸运星
发表评论 为下方 3 条评论点赞,解锁好运彩蛋
↓ 下方为您推荐了一些精彩有趣的文章热评 ↓