谷歌宣布推出Gemini Omni视频生成模型 谷歌在I/O大会上宣布推出一款新模型Gemini Omni,公司称其能够通过任何输入生成任何内容:用户可以通过图片、音频、视频和文字提示生成视频,还能够通过简单自然语言对视频进行编辑。谷歌表示,未来还将扩展该产品,使其支持生成图片和音频。 DeepMind 首席AI架构师兼技术总监科雷·卡武克库奥卢介绍称:“Omni可以生成非常高质量的视频,并允许用户在生成后与视频进行互动。可以想象,这为学习和探索提供了类…
谷歌宣布推出Gemini Omni视频生成模型 谷歌在I/O大会上宣布推出一款新模型Gemini Omni,公司称其能够通过任何输入生成任何内容:用户可以通过图片、音频、视频和文字提示生成视频,还能够通过简单自然语言对视频进行编辑。谷歌表示,未来还将扩展该产品,使其支持生成图片和音频。 DeepMind 首席AI架构师兼技术总监科雷·卡武克库奥卢介绍称:“Omni可以生成非常高质量的视频,并允许用户在生成后与视频进行互动。可以想象,这为学习和探索提供了类…
中国AI实验室在视频生成领域已领先于美国竞争对手 在视频生成这一生成式AI关键战场上,中国人工智能企业已经领先美国竞争对手;视频生成正被广告、电商和娱乐等行业迅速采用。总部位于北京的字节跳动和快手等公司,正利用海量短视频素材训练系统,因此在这方面领先于美国竞争对手。 据开发者和多个使用排行榜显示,这一转变标志着AI竞赛出现分化:尽管OpenAI、谷歌和Anthropic仍然主导大型语言模型以及编程等领域,但它们的视频工具在质量和易用性方面都落后于中国的产…
通义视频生成模型Wan2.7-Video上线 4月3日,通义视频生成模型Wan2.7-Video正式上线。该模型支持文本、图像、视频和音频全模态输入,聚焦视频生成后的编辑与修改能力,旨在让视频内容像文档一样可编辑。在视频编辑方面,Wan2.7 支持通过指令对画面进行局部调整,无需重新生成完整片段。具体功能包括:增删元素(如“删掉视频中的火车”)、替换物体(如“把胶片换成盘子”) 、修改物体属性(如建筑颜色);支持参考图像内容进行精准添加。环境与风格层面…
OpenAI正计划关停其AI视频生成平台Sora OpenAI正计划正式关停其推出仅数月的AI视频生成平台Sora。此举是公司为冲刺最快于今年第四季度进行的 IPO ,而将战略重心全面转向企业业务与编程功能的重要步骤。公司CEO山姆·奥尔特曼于周二向员工宣布了这一决定,确认将逐步淘汰使用其视频模型的相关产品。除消费者应用外,面向开发者的Sora版本及ChatGPT内的视频功能也将一并停止支持。原Sora团队后续将转向机器人技术等长期投资领域。此次调整反映…
字节跳动暂停在全球推出Seedance 2.0 两名知情人士称,在与好莱坞主要电影公司和流媒体平台发生一系列版权纠纷后,字节跳动已暂停在全球推出其最新视频生成模型Seedance 2.0。今年二月,字节跳动正式发布了Seedance 2.0,并表示该系统面向专业影视、电商和广告等用途,强调其能够同时处理文本、图像、音频和视频,从而降低制作成本。字节跳动原计划在三月中旬面向全球客户推出这款新的视频模型,但目前已暂停了该计划。字节跳动的法务团队正在努力找出和…
OpenAI的ChatGPT拟接入视频生成工具Sora 知情人士周二透露,OpenAI计划在ChatGPT平台上整合其AI视频生成器Sora。这一战略转变将拓展OpenAI在多模态AI技术领域的布局,有望提升用户对OpenAI聊天机器人的使用率,但同时也会增加成本。预计从现在到2030年,其推理成本将超 2250亿美元。目前,以文本为中心的AI模型已在家庭和工作场所得到普遍应用,专门用于生成视频和图片的AI模型则代表了该技术颠覆性潜力的下一个前沿领域。O…
字节跳动日本公司称已停止AI生成侵权视频 中国IT巨头字节跳动日本公司26日在自民党的会议上表示,已对其提供的视频生成AI服务作出调整,以防止生成可能侵犯相关权利的视频。该服务上线后被指可以生成擅自使用日本动漫角色等内容的视频。该视频生成AI为字节跳动发布的Seedance 2.0。疑似利用该AI生成的包含迪士尼角色、奥特曼等形象的视频目前已在社交平台传播。在26日的会上还汇报由运营方对生成的视频是否存在问题进行确认,并设举报窗口。日本AI战略担当相小野…
字节跳动AI工具已停止真人素材生成视频 字节跳动公司近日表示,已停止其人工智能视频生成模型服务Seedance 2.0基于真人人脸及动漫等角色形象生成视频的功能。字节跳动的一名高管说,目前不支持生成真人以及迪士尼这类拥有知识产权的角色形象,并称正致力于维持及加强侵权对策。字节跳动 12 日发布 Seedance。随后,大量包含迪士尼角色及奥特曼等形象的视频在社交平台传播。华特迪士尼公司以未经许可使用自家角色为由,已向字节跳动发函要求停止。日本AI战略担当…
今年一月OpenAI Sora安装量环比下降45% OpenAI的视频生成应用Sora在去年十月迅速登上苹果 App Store 榜首后,目前正面临困境。最新数据显示,随着人们对这款AI视频社交网络的早期热捧逐渐消退,该应用的下载量和用户消费额均出现下降。市场情报提供商Appfigures的数据显示,Sora在去年十二月的下载量环比下降32%。这一情况令人担忧,因为节假日通常是移动应用的增长契机,人们会收到新的智能手机作为礼物,而且往往有休假时间,从而更…
Adobe Firefly现在支持基于提示的视频编辑 Adobe公司正在更新其人工智能视频生成应用 Firefly,新增支持精准基于提示编辑的视频编辑器,同时为图像和视频生成增加新的第三方模型,包括黑森林实验室的FLUX.2和 Topaz Astra。迄今为止,Firefly 仅支持基于提示的生成,因此如果视频的任何部分不令人满意,用户就必须重新生成整个片段。借助新视频编辑器,你可以使用文本提示来编辑视频元素、颜色和摄像机角度,我们还获得了一个新的时间线…
Runway推出全新AI视频模型,在关键基准测试中击败谷歌和OpenAI 人工智能初创公司 Runway 周一宣布推出 Gen 4.5,这是一款全新的视频模型。Gen 4.5 允许用户根据文本提示词生成高清视频,用户可在提示词中描述他们想要的运动轨迹和动作细节。Runway 表示,该模型擅长理解物理规律、人体动作、镜头运镜以及因果逻辑。 该模型目前在 Video Arena 排行榜上占据榜首。评估者在不知道模型所属公司的情况下(即盲测),比较两个不同模型…
Sora、Nano Banana Pro因需求激增下调限额 面对人类高涨的 “AI创作欲望”,OpenAI和谷歌公司不约而同地下调了视频生成应用Sora和图像生成应用Nano Banana Pro的免费用户使用上限。具体来说,数小时前,OpenAI的Sora主管Bill Peebles宣布,为了让尽可能多的人用上这款AI,现在免费用户一天只能生成六个短视频,并搬出了算力不足的经典用语——“我们的GPU正在融化”。另外,谷歌上周发布的 Nano Banan…
Sora现允许支付额外费用来制作更多AI视频 总是在Sora上快速消耗视频生成额度?没问题,OpenAI现在允许您购买额外积分来制作更多AI视频。这很好,因为该公司表示,预计在未来的某个时候减少免费额度。OpenAI Sora团队负责人比尔·皮布尔斯表示,该视频平台的经济模式目前完全不可持续。高级用户显然对他们每天获得的免费生成次数不满意,因此皮布尔斯表示OpenAI将允许创作者根据自己的付费意愿获得相应的使用量。根据Sora在苹果应用的页面,十次额外视…
美团LongCat-Video视频生成模型发布 美团官方今日宣布,美团 LongCat团队正式发布 LongCat-Video 视频生成模型。该模型基于 Diffusion Transformer架构,可支持文生视频、图生视频及视频续写三类核心任务并宣称在开源模型中达到先进水平。模型可生成720p分辨率、30帧率的高清视频,其突出特点在于能够原生生成长达五分钟的连贯视频内容。模型通过视频续写预训练、块稀疏注意力等机制,旨在解决长视频生成中常见的画面断裂、…
谷歌最强文生视频模型 Veo 3.1 正式发布 谷歌推出了其新款视频模型Veo 3.1,具备改进的音频输出、精细化编辑控制以及更好的图像转视频输出效果。该公司表示,Veo 3.1 在五月发布的 Veo 3 基础上构建,能够生成更真实的剪辑,并更好地遵循提示词。谷歌表示该模型允许用户向视频添加对象,并使其融入剪辑的风格。很快,用户还将能够在Flow中从视频移除现有对象。Veo 3 已具备多项编辑功能,例如添加参考图像来驱动角色、提供首尾帧通过AI生成剪辑,…
OpenAI的Sora应用首周下载量超越ChatGPT 根据应用分析公司 Appfigures 最新数据,在登顶美区App Store之后,OpenAI的视频生成应用Sora的首周表现从技术上讲已超过了当初的ChatGPT。Appfigures预计,Sora上线前7天在iOS平台的下载量为62.7万次,超过了ChatGPT上线首周的60.6万次。不过,这并不是一个完全公平的对比,因为ChatGPT首周仅在美国上线,而Sora上线时同时覆盖美国和加拿大。A…
OpenAI新视频生成器将仅接受版权方主动选择退出 据知情人士透露,OpenAI正计划发布其Sora视频生成器的新版本,该版本会创作包含受版权保护材料的视频,除非版权所有者选择退出,不让其作品出现。OpenAI在过去一周开始就即将推出的产品及其选择退出的流程向人才经纪公司和制片厂发出通知,并计划在未来几天内发布新版本。Sora新版本的选择退出流程意味着,电影公司和其他知识产权所有者需要明确要求OpenAI不要在该工具生成的视频中包含其受版权保护的材料。据…
英伟达新芯片系统 助力AI视频与软件生成 英伟达表示,计划推出一款旨在处理视频生成和软件开发等复杂任务的新产品。英伟达称,这款名为 Rubin CPX 的产品将于2026年底上市。它将采取卡片形式,可嵌入现有的服务器电脑设计中,或用于能够在数据中心与其他硬件并行运行的独立计算机。该设计是明年推出的新Rubin产品线的衍生,能够让某些类型的人工智能工作更高效。英伟达表示,AI计算推理环节的某些要素,即生成答案回应请求的过程,效率未达应有水平。这是因为由单一…
Google 视频生成模型 Veo 3 更新竖版视频和1080P分辨率并降价 Google今天宣布,其旗下的视频生成模型 Veo 3 和 Veo 3 Fast 已在 Gemini API 中提生产环境使用。Veo 3 模型即日起还将全面降价,Veo 3:现价 0.40 美元/秒,原价 0.75 美元/秒;Veo 3 Fast:现价 0.15 美元/秒,原价 0.40 美元/秒。Veo 3 系列模型还添加了竖屏视频和 1080p 支持。现在可以将宽高比设置…
xAI新图像和视频生成器可制作NSFW内容 埃隆·马斯克的人工智能公司已正式向 iOS 应用的所有SuperGrok和Premium+ X订阅用户推出Grok Imagine,即xAI的图像和视频生成器。正如马斯克一贯的风格,他将Grok定位为无过滤、突破边界的人工智能,该生成器允许用户制作不宜在工作场所浏览(NSFW)的内容。Grok Imagine承诺将文本或图像提示转化为带原生音频的15秒视频,其“spicy 模式”允许用户生成包含部分女性裸体的露…