RuLan03/Sthv2_500_3scope
Something-Something V2 (SSV2) 视频预测数据集子集构建文档 🚀 1. 项目目标与任务定义 本项目旨在从庞大的 Something-Something V2 训练集中,构建一个针对指令驱动型视频预测任务的、高质量、小规模的训练和验证子集。 核心任务定义 我们采用经典的视频预测任务定义:给定一个短序列 (F_1 到 F_20) 和一个文本指令,预测序列的下一帧 (F_21)。 元素 描述 索引 图像尺寸 输入序列 (I_Input) 20 张连续帧作为观测输入。 F_01 到 F_20 128 × 128 目标帧 (I_Target) 序列的第 21 帧作为模型预测的真值。 F_21 128 × 128 文本指令 (T) 视频的原始文本标签 (label 字段)。 SSV2 train.json 字符串 🔬 2. 数据集子集精准提取策略(创新点) Something-Something V2 包含… See the full description on the dataset page: https://huggingface.co/datasets/RuLan03/Sthv2_500_3scope.
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Add files using upload-large-folder tool
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
Update README.md
initial commit
