Japanese SFT/DPO data convert to speech via TTS. And audio caption data generated by Qwen3-Omni. All datasets are available for commercial use.
Ayuto Tsutsumi
Atotti
AI & ML interests
None yet
Recent Activity
liked a model 3 days ago
OpenMOSS-Team/MOSS-SoundEffect-v2.0 liked a model 3 days ago
sbintuitions/kana-whisper liked a dataset 4 days ago
tsinghua-ee/QualiSpeech