首页 > 生活分享 > 免费教学 > 谷歌推Scenic:可识别视频内容 并生成详细描述

谷歌推Scenic:可识别视频内容 并生成详细描述

发布时间:2024-04-08 23:47:07

Scenic 是一个以注意力模型为重点的计算机视觉研究代码库。

⭐️ 提供 SOTA 模型和基线模型,以及共享库和项目。

⭐️ Scenic 采用 JAX 和 Flax 进行开发,为快速原型设计大规模视觉模型提供支持。

站长之家(ChinaZ.com) 4月7日 消息:Scenic 是谷歌推出的模型,一个专注于计算机视觉领域的代码库,主要用于研究基于注意力的模型。

该库提供了一系列共享的轻量级库,解决训练大规模视觉模型时常见的任务,并包含了几个使用这些库的问题特定训练和评估循环的项目。Scenic 使用 JAX 和 Flax 进行开发,支持开发人员在图像、视频、音频和多模态组合方面开发分类、分割和检测模型。Scenic能识别任意长度的视频内容,并生成详细描述。针对长视频,可以在处理完整个视频前,流式预测视频内容。

Scenic 提供了一些功能,包括用于启动实验、摘要编写、日志记录、性能分析等的样板代码;优化的训练和评估循环、损失函数、度量、双部分匹配器等;以及用于流行视觉数据集的输入管道和强大的非注意力基线模型。

在 Scenic 中,有一些 SOTA 模型和基线模型,这些模型可能是使用 Scenic 开发的,也可能是在 Scenic 中重新实现的。一些项目包括 ViViT、OmniNet、Attention Bottlenecks for Multimodal Fusion 等。此外,Scenic 还提供了一些重现的基线模型,如(ViT)An Image is Worth16x16Words、(DETR)End-to-End Object Detection with Transformers 等。

Scenic 的目标是促进大规模视觉模型的快速原型设计。为了保持代码简单易懂且易于扩展,Scenic 更倾向于通过复制粘贴而非增加复杂性或增加抽象来解决问题。只有当功能被证明在许多模型和任务中广泛有用时,才可能将其上游到 Scenic 的共享库中。

免费教学更多>>

Uber计划2026年底前在15城推出自动驾驶出租车服务,Q4及Q1盈利预期未达市场预期 起亚宣布2026款Niro插电混动版将退出美国市场 印度车企1月销量普遍增长,SUV与电动车成主要驱动力 原力无限—小原子(YUANZI)首日盲订即突破100台 欧盟、日本与美国就关键矿产供应链韧性建立战略伙伴关系 定义行业新节点:德赛西威发布首款8T8R 4D毫米波雷达 李想:全新理想L9不仅是好车,更是具身智能机器人开山之作 俄罗斯2026年1月汽车市场多品类销量同比下滑,商用车降幅显著 广汽高域飞行汽车AirCab,斩获33亿元订单! 中科创达旗下晓悟智能与北京人形机器人创新中心达成战略合作 重庆国资出手,入股一家做“机器人大脑”的公司 一汽红旗全固态电池首台样车成功下线 瑞虎系又多一家企业IPO,目前已过会 离子能源公司完成数亿元Pre-A轮融资 小米前高管创业,获高瓴、智元等数千万掷投 马自达押油电混合:下一代纯电推迟至2029年 2025越南车市大反转,“丰田们”的时代变了 启境汽车发布第三期网友问答,线下服务网络规划明确 新款比亚迪海豹06 EV正式进入工信部目录,新车将有望在年内上市 大鹏展翅已高飞?方程豹钛7,单月销量升至3.4万台 精准踩中用户痛点 合资新车智能焕新 春节购车必看 冰雪试驾别克至境世家:在冰面上,你会忘了这是一台新能源大型 比亚迪放大招:宋Pro DM-i 220km版是否诚意过头? 凭实力精准卡位,HR-V打造十万元级SUV新标杆 苦走10年投融路,李斌热泪盈眶:今天,我们终于赢了! 售价 30 万元以上市场分析 奔驰品牌销量与成交均价居前 奇 瑞or比亚迪,谁将成为2026海外第一? 降幅垫底:广汽本田 5 年“ 5 连降”,高洪祥难为无米之炊? 日产全新轩逸量产下线!前脸升级V型,颜值飙升不少,一季度上市 小鹏汽车2026全球新品发布会重磅来袭,四款新车开启AI出行新时代