妈妈咪呀

谷歌 DeepMind 发布 GenCeption:打破计算机视觉桎梏_我的网站

海派甜心

A |     苹果昨日正式发布全新 Mac mini 便携式主机,搭载全新 M6 芯片与此前已经推出的 M5 Pro 芯片,6999 元起售。    IT之家 7 月 21 日消息,科技媒体 The Decoder 昨日(7 月 20 日)发布博文,报道称谷歌 DeepMind 发布 GenCeption 模型,将预训练的视频生成器重新用于深度估计和分割等经典计算机视觉任务。

B | 叠加国补后实付 5949.2 元,再叠教育优惠后仅需 5269.2 元,今日京东自营正式开启预约,明日 9 点(2026-08-27 09:00)正式开抢:京东苹果 Mac mini M6 还有教育优惠版可选国补后 5949.2 元起直达链接京东苹果 Mac mini M5 Pro 还有教育优惠版可选国补后 11499 元起直达链接老款 M4 版现售 5099 元,教育优惠后 4504 元,小伙伴们可按需选购:京东苹果 Mac mini M4 还有教育优惠版可选国补后 5099 元直达链接配备 M6 芯片后,Mac mini 的 AI 性能至高可提升 4 倍,存储速度与图形处理速度提升 2 倍,CPU 性能提升 40%。无论是日常办公任务还是智能体 AI 工作流,Mac mini(搭载 M6 芯片)都能带来十分流畅的体验。而搭载 M5 Pro 芯片的 Mac mini 则提供更专业的性能,助力用户轻松应对从视频制作到游戏开发等高要求项目,可轻松应对各类商务工作流,无论 Mac mini 是作为主工作站使用,还是用于始终在线的桌面端智能体计算。         IT之家援引博文介绍,大语言模型在学习预测下一个 Token 的时候,在训练过程中往往需要吸收语法、世界知识和上下文关系等内容。新款 Mac mini 自 8 月 27 日上午 9:00 起接受预购,正式发售日期为 9 月 22 日。京东苹果 Mac mini M6 还有教育优惠版可选国补后 5949.2 元起直达链接相关阅读:广告声明:文内含有的对外跳转链接(包括不限于超链接、二维码、口令等形式),用于传递更多信息,节省甄选时间,结果仅供参考,包含外链的文章均包含本声明。         但是在计算机视觉领域,视觉模型缺少等效的训练方法,主要由专业模型主导,包括用于分割的“Segment Anything”和用于深度估计的“Depth Anything”,每个模型都使用其特定的架构。         谷歌 DeepMind 团队为此提出 GenCeption 模型方案,尝试将一个“生成视频”的 AI 模型逆向改造成一个能“理解世界”的视觉分析引擎。         GenCeption 打破了传统计算机视觉“一个任务一个专用模型”的格局,仅凭单一模型就能同时做好深度估计、图像分割、3D 姿态估计、表面法线预测和相机姿态估计等核心视觉任务。         GenCeption 基于阿里巴巴开源视频模型通义万相 Wan2.1 系列训练,与传统扩散模型需多步去噪不同,GenCeption 在一次前向传播中完成预测,从而提升视觉任务处理速度。

C | 模型通过文本提示指定任务,可输出深度图、表面法线图、分割掩码,并可处理相机运动表示。         训练数据以合成为主。

D | 论文称,数据集仅包含 7500 段视频,由 800 个数字人体模型与 200 段动作捕捉序列组合生成,再通过 Blender 在不同背景和镜头角度下渲染。

E |          泛化方面,GenCeption 几乎只在单人合成视频上训练,但可处理真实多人视频,也可迁移到动物和类人机器人类别。论文称,部分输出细节甚至超过训练时 Blender 渲染结果,可保留猫胡须和单根发丝边缘。         性能方面,论文给出两组处理时间数据:小模型处理 81 帧视频约需 6 秒;大模型参数量为 140 亿,处理同样长度视频约需 10 秒。         参考。

F |

Current article:http://xg0z.cuiguagonggengaotianwan.shop/list_tukv9ba/obg.html

Published on:00:00:00