刚刚,OpenAI 官方账号发布的一支由 Sora 制作的MV(Music Video)——《Worldweight》
这支 MV 的音乐是由艺术家 AugustKamp 作曲,而画面内容则是通过 Sora 来生成的。AugustKamp 表示,Sora 使得他能够将原本只存在于他心中的想象转化为可以与他人共享的艺术形式。这并非他首次使用AIGC技术来制作MV,他之前已经在 Instagram 上分享过由 Sora 生成的 MV 片段。
但是和以往不同的是,全球知名的艺术家,包括麻辣鸡(NickiMinaj)、水果姐(KatyPerry)、碧梨(BillieEilish)等,联名抗议AIGC技术的使用。他们认为AIGC技术在未经补偿的情况下使用艺术家的声音、作品来训练AI模型,并稀释支付给艺术家的版税池,这些问题不仅损害了艺术家的经济利益,也对他们的创作自由和艺术价值构成了威胁。
科技的发展与创造力的边界在哪里?从 MV 到音乐剧。AI如何重塑我们的音乐体验呢?欢迎在评论区留言讨论!
这绝对是人工智能领域再迎里程碑式突破!阿里巴巴旗下Qwen团队今日宣布,其对话平台Qwen Chat正式上线"AI前端工程师"功能(Web Dev模式),用户可通过自然语言指令一键生成完整网页应用,涵盖HTML、CSS、JavaScript三大核心技术栈。
该功能展现出五大核心创新: 1. 全栈代码智能生成 用户输入如"创建水果电商网站"等指令,系统即可生成基于React框架的生产级代码,默认采用Tailwind CSS样式与.jsx单文件结构,实现像素级精准渲染。实测显示,个人主页、客服表单等基础页面生成仅需数秒。 2. 跨模态界面复刻 支持"复刻Twitter/X界面"等指令,AI可精准还原目标网站布局与视觉元素。开发者社区已有成功复刻GitHub等复杂界面的案例,代码结构清晰且具备语义化特征。 3. 动态交互实现突破 突破传统静态页面限制,可生成含商品轮播、交互动画等元素的电商展示页面。官方演示中,防晒产品网站的动态视觉呈现达到专业前端工程师水准。 4. 智能解析增强开发 支持网页文件上传解析,AI自动识别内容结构并生成适配展示方案,大幅降低原型设计到代码实现的门槛。 5. 双模式协同优化 搭配"深度思考"模式可提升生成质量,系统通过延长推理时间优化代码健壮性与兼容性,满足企业级应用需求。
当前该功能已全面接入Qwen Chat平台(chat.qwen.ai),支持平台内所有大模型调用,感兴趣的小伙伴可以试玩一下!
近日,苹果公司与瑞士洛桑联邦理工学院(EPFL)联合开源了一款名为4M-21的多模态视觉模型。该模型具有广泛的通用性和灵活性,尽管只有30亿参数,但它可以执行数十种任务,包括图像分类、目标检测、语义分割、实例分割、深度估计和表面法线估计等。
4M-21模型在21种不同的模态下进行训练,能够处理包括图像、文本、音频等多种模态的任务。这种多模态能力使其在跨模态检索、可控生成和开箱即用性能方面表现出色。
4M-21还支持任意到任意模态的转换,进一步扩展了其应用范围。
4M-21模型的推出标志着从传统单模态优化模型向多模态综合处理能力的重大转变,展示了苹果在AI领域的强大实力和创新能力。
开源地址:https://github.com/apple/ml-4m/ 论文地址:https://arxiv.org/abs/2406.09406 在线demo:https://huggingface.co/spaces/EPFL-VILAB/4M
4月25日晚,OpenAI联合创始人兼首席执行官Sam Altman,在斯坦福大学的英伟达(NVIDIA)礼堂进行了公开演讲,超过1000名学生排队参加此次活动。
Altman说:“GPT-5将会比GPT-4更强大,GPT-6将会比GPT-5更智能,OpenAI的终极目标始终都没有变就是实现——AGI(通用人工智能)。”
以下是本次演讲的一些关键信息总结: 1. Sam Altman的演讲:作为OpenAI的联合创始人兼首席执行官,Sam Altman在斯坦福大学的NVIDIA礼堂进行了演讲,吸引了超过1000名学生。 2. AI的未来发展:Altman认为,人类尚未达到AI的极限,并且OpenAI的目标是实现通用人工智能(AGI)。他提到GPT-5将比GPT-4更强大,而GPT-6将比GPT-5更智能。 3. 开源与闭源:Altman认为,为了实现AGI,需要大量的资金投入,因此开源可能不是最佳途径。OpenAI从最初的开源策略转变为闭源,以确保商业回报和持续创新。 4. 资金与投资:他提到,为了推动AGI的发展,无论每年需要多少资金,只要能为全人类和AI领域做出贡献,他都不在乎。 5. OpenAI的核心能力:OpenAI的核心能力在于技术变革,能够定义AI能力的下一个范式转变。 6. Sora模型:OpenAI发布了文生视频模型Sora,这可能会对影视、游戏开发、广告营销等行业产生重大影响。 7. 免费使用ChatGPT:OpenAI宣布无需注册就能免费使用ChatGPT,这有助于那些没有能力开发类似产品的国家或地区。 8. 英伟达与OpenAI的合作:英伟达创始人黄仁勋向OpenAI捐赠了先进的AI超级计算机,这表明了两家公司之间的紧密合作关系。
近日有内幕爆出,苹果公司不会在今年推出由 Apple Intelligence 驱动的全新 Siri。
苹果会计划在明年 1 月开启全新 Siri 测试,并在 iOS 18.4 中推出正式版本。另外,Siri 的其他功能,例如新设计和 ChatGPT 集成,将于今年晚些时候推出。此前的报道中,Gurman 指出 Apple Intelligence 也将出现在 Vision Pro 上,但要到明年。
苹果在 6 月举办的 WWDC 上推出了搭载 Apple Intelligence (Apple 智能)的全新 Siri,用户在升级到 iOS 18 后,可以更自然地与 Siri 对话,新的 Siri 还能够很好地理解上下文。
不过,全新 Siri 只支持 iPhone 15 Pro 及以上的设备,而即将推出的 iPhone 16 系列也将支持 Apple Intelligence。另外,Mac 和 iPad 设备需要搭载 M1 及以上的芯片才能使用 Apple Intelligence。
大家对新版的 Siri 有哪些期待呢?