Google 正让 Gemini Advanced 订阅者试用 Veo 2 —— 一款其宣称能够生成具有“电影级真实感”高分辨率影片的文本转视频 AI 模型。从今天起,订阅者可以在网页端和移动端的 Gemini 模型下拉菜单中选择 Veo 2,输入提示语进而生成一段 720p 分辨率、时长八秒的视频。
每位订阅者每月可生成的视频数量有限,Google 表示将在用户接近限制时进行通知。Veo 2 输出的视频格式为 MP4,但移动端用户还可以选择通过“分享”按钮将视频直接上传至 TikTok 和 YouTube。
Veo 2 使用以下提示生成了这段视频: "a low-angle shot of a pampered French bulldog wearing sunglasses, lounges on a plush daybed by a sparkling turquoise pool at a luxury resort, with palm trees swaying gently in the background, captured on a bright, sunny day."
GIF: Google
Google 表示,升级后的 AI 模型对 "real-world physics and human motion"(现实物理和人体运动)有了更深刻的理解,从而能够呈现 "fluid character movement, lifelike scenes and finer visual details across diverse subjects and styles"(流畅的角色动作、逼真的场景以及多样主题和风格下更精细的视觉细节)。使用 Veo 2 生成的视频均带有 SynthID 数字水印,标识这些视频均由 AI 创作。
这一片段是在 Veo 2 中通过描述 "an animated shot of a tiny mouse with oversized glasses, reading a book by the light of a glowing mushroom in a cozy forest den."(一个戴着超大眼镜的小老鼠,在舒适的森林巢穴中借由发光蘑菇的光芒阅读一本书)而创作的。
你现在可以为 Google 的 AI 视频模型提供摄像机方向指令
除了 Veo 2 之外,Google 还向 Google One AI Premium 订阅者推出了 Whisk Animate —— 这一工具可以利用 Veo 2 将一张图像转换为一段八秒的视频。该功能是在 Google 现有的 Whisk 工具基础上开发而成,后者可用于创建 AI 生成的图像混搭。现通过 Google Labs 向全球订阅者提供 Whisk Animate。
Google 于去年 12 月以早期访问方式首次推出 Veo 2,该工具在公司 Vertex AI 平台上每秒视频收费 50 美分。此后,YouTube 已将 Veo 2 添加至其实验性功能 Dream Screen 中,允许用户为 Shorts 创建 AI 生成的视频片段。
好文章,需要你的鼓励
由于用户对ChatGPT 4o模型的强烈需求和怀念,OpenAI决定重新将4o作为可选项推出。这一决定反映了用户对该模型性能和功能的认可,以及市场对多样化AI模型选择的需求。此举表明OpenAI正在积极响应用户反馈,调整产品策略以更好地满足不同用户的使用偏好和需求。
OPPO AI团队首次系统性研究了大语言模型智能体的效率优化问题,提出了高效智能体框架。通过对基础模型选择、规划复杂度、工具配置和记忆机制的深入分析,他们在GAIA基准测试中实现了96.7%性能保持的同时,运营成本降低28.4%。研究发现简单设计往往更有效,为智能体系统的实用化部署提供了重要指导。
Meta平台公司选定太平洋投资管理公司和Blue Owl资本为其在路易斯安那州农村地区的数据中心扩建项目提供290亿美元融资。其中,太平洋投资管理公司将主导260亿美元的债务融资部分,Blue Owl提供30亿美元股权投资。该项目将加速Meta的人工智能开发,预计到2030年全球数据中心将需要6.7万亿美元投资以满足计算需求。
上海交通大学和华为联合开发的EvoC2Rust框架,能够自动将C语言项目转换为安全的Rust项目。该系统采用"骨架先行"策略,先构建项目框架再逐步翻译函数,并通过七大类安全映射确保翻译质量。在工业项目测试中达到93.84%编译通过率和89.53%功能测试通过率,为解决C语言内存安全问题提供了实用解决方案。