你是我的姐妹

谷歌 DeepMind 发布 GenCeption:打破计算机视觉桎梏_我的网站

行尸走肉第三季

一 |     IT之家 7 月 21 日消息,科技媒体 The Decoder 昨日(7 月 20 日)发布博文,报道称谷歌 DeepMind 发布 GenCeption 模型,将预训练的视频生成器重新用于深度估计和分割等经典计算机视觉任务。    两年之约,一箭重逢!《龙之谷》怀旧服2周年版本今日上线,全新光明系外传职业「银色猎人」强势登场,迷雾巢穴高燃开启,多人协作玩法神圣天堂防御战热血来袭,更有2周年限定福利、成长活动、丰富奖励同步上线哦!1.jpg图1绝美光明之力!全新职业「银色猎人」登场!作为《龙之谷》怀旧服2周年重磅内容之一,全新外传职业「银色猎人」今日正式登陆阿尔特里亚大陆。         IT之家援引博文介绍,大语言模型在学习预测下一个 Token 的时候,在训练过程中往往需要吸收语法、世界知识和上下文关系等内容。         但是在计算机视觉领域,视觉模型缺少等效的训练方法,主要由专业模型主导,包括用于分割的“Segment Anything”和用于深度估计的“Depth Anything”,每个模型都使用其特定的架构。         谷歌 DeepMind 团队为此提出 GenCeption 模型方案,尝试将一个“生成视频”的 AI 模型逆向改造成一个能“理解世界”的视觉分析引擎。灵巧迅捷的战斗风格,华丽流畅的连招,灵活多变的位移,以及极具观赏性的柔美外表,「银色猎人」将为冒险家们带来焕然一新的空中战斗体验。伴随着新职业上线,预约里程碑奖励开放领奖,专属坐骑、活动限定称号“一箭破天”送送送!3500万幸运币也将同步开抽,完成指定任务即可到新职业主题站中抽个痛快,最高单人可累计获得100,000幸运币哦!还有「幻纱镂影」主题三件套等新职业专属福利大放送,欢迎冒险家们尽情体验「银色猎人」的独特魅力!2.jpg图22周年福利盛会,海量福利惊喜不间断!《龙之谷》怀旧服2周年,当然要让冒险家们满载而归!角色完成指定任务,就能领取周年奖励。         GenCeption 打破了传统计算机视觉“一个任务一个专用模型”的格局,仅凭单一模型就能同时做好深度估计、图像分割、3D 姿态估计、表面法线预测和相机姿态估计等核心视觉任务。超级蠢萌的卡皮巴拉坐骑,中国风满满的福禄满仓祥云三件套,代表着传承与龙文化的旗袍时装,还有2周岁活动限定称号等超丰富好礼,统统免费领。         GenCeption 基于阿里巴巴开源视频模型通义万相 Wan2.1 系列训练,与传统扩散模型需多步去噪不同,GenCeption 在一次前向传播中完成预测,从而提升视觉任务处理速度。为了感谢两年来所有冒险家的陪伴与支持,8月20日生日当天,冒险家们还可领到钻石潘多拉礼包、花冠、坐骑秘匣、保护药、[活跃时装]兑换券、黄金硬币、2周年纪念币奖励!福利一波又一波,2周岁生日福利盛宴,真的很哇塞!3.jpg图3-卡皮巴拉坐骑(二选一)4.jpg图4-福禄满仓祥云三件套5.jpg图5-旗袍时装2周年福利盘点>>>「迷雾巢穴」开启,挑战未知极限!浓雾蔓延,危险悄然降临,「迷雾巢穴」正式登场!不同以往的通关机制,更具挑战性的战斗体验,等待冒险家深入迷雾,破解隐藏着的前所未有的危机。危险与机遇并存,唯有默契配合、精准操作,才能突破层层考验,赢取属于强者的荣耀与丰厚奖励! 6.jpg图6-迷雾巢穴并肩战斗吧!神圣天堂防御战打响!警报响彻神圣天堂,超巨型怪物来袭!全新多人协作玩法「神圣天堂防御战」限时开启,冒险家们需携手并肩,共同守护神圣天堂的重要据点,迎战体型巨大的岩蜥。4-12人团队协作、职业配合、战术应变,打败巨蜥,有机会获得各类材料以及冒险家公会会长的银币,可凭银币至艾琳处兑换巨蜥坐骑、巨蜥之金属板、花冠、潘多拉礼包、保护药等好礼。模型通过文本提示指定任务,可输出深度图、表面法线图、分割掩码,并可处理相机运动表示。         训练数据以合成为主。集结伙伴,一起守护属于我们的神圣天堂!7.jpg图7-防御战S1赛季新职业「银色猎人」绝美上线,迷雾巢穴等待冒险家们来征服,神圣天堂防御战的号角已经吹响!即刻加入《龙之谷》怀旧服2周年版本,让我们一起,开启阿尔特里亚大陆冒险的全新篇章吧~!。

二 | 论文称,数据集仅包含 7500 段视频,由 800 个数字人体模型与 200 段动作捕捉序列组合生成,再通过 Blender 在不同背景和镜头角度下渲染。         泛化方面,GenCeption 几乎只在单人合成视频上训练,但可处理真实多人视频,也可迁移到动物和类人机器人类别。

三 | 论文称,部分输出细节甚至超过训练时 Blender 渲染结果,可保留猫胡须和单根发丝边缘。

四 |          性能方面,论文给出两组处理时间数据:小模型处理 81 帧视频约需 6 秒;大模型参数量为 140 亿,处理同样长度视频约需 10 秒。         参考。

Current article:http://merwwi.chongtunkuaitaogacuiliamanzu.cfd/list_pwg5/y9lmpmr.pptx

Published on:03:27:20


我的网站最近更新

我的网站热门资讯