Turing Inc. STRIDE-QA-Dataset Collection STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes • 4 items • Updated Jan 23 CoVLA-Dataset Collection CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving • 2 items • Updated Jan 23 • 1 One-D-Piece Collection One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression. (https://arxiv.org/abs/2501.10064) • 6 items • Updated Jan 21, 2025 Heron Collection Heron: Japanese Vision Language Models • 18 items • Updated Mar 2 • 1
STRIDE-QA-Dataset Collection STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes • 4 items • Updated Jan 23
CoVLA-Dataset Collection CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving • 2 items • Updated Jan 23 • 1
One-D-Piece Collection One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression. (https://arxiv.org/abs/2501.10064) • 6 items • Updated Jan 21, 2025
Turing Inc. STRIDE-QA-Dataset Collection STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes • 4 items • Updated Jan 23 CoVLA-Dataset Collection CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving • 2 items • Updated Jan 23 • 1 One-D-Piece Collection One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression. (https://arxiv.org/abs/2501.10064) • 6 items • Updated Jan 21, 2025 Heron Collection Heron: Japanese Vision Language Models • 18 items • Updated Mar 2 • 1
STRIDE-QA-Dataset Collection STRIDE-QA: Visual Question Answering Dataset for Spatiotemporal Reasoning in Urban Driving Scenes • 4 items • Updated Jan 23
CoVLA-Dataset Collection CoVLA: Comprehensive Vision-Language-Action Dataset for Autonomous Driving • 2 items • Updated Jan 23 • 1
One-D-Piece Collection One-D-Piece: Image Tokenizer Meets Quality-Controllable Compression. (https://arxiv.org/abs/2501.10064) • 6 items • Updated Jan 21, 2025