Japanese SFT/DPO data convert to speech via TTS. And audio caption data generated by Qwen3-Omni. All datasets are available for commercial use.
Ayuto Tsutsumi
Atotti
AI & ML interests
None yet
Recent Activity
liked a model 4 days ago
microsoft/VibeVoice-ASR-Streaming-7B updated a dataset 5 days ago
voicist/yamaguchi updated a model 14 days ago
voicist/cw-ja