> For the complete documentation index, see [llms.txt](https://doc.thordata.com/doc/llms.txt). Markdown versions of documentation pages are available by appending `.md` to page URLs; this page is available as [Markdown](https://doc.thordata.com/doc/zh-hk/chang-jian-wen-ti/chan-pin-wen-ti/duo-mo-tai-shu-ju-ji/thordata-de-shu-ju-ji-dou-yong-zai-na-xie-ai-ying-yong-shang.md).

# Thordata 的數據集都用在哪些 AI 應用上？

涵蓋語音辨識、大型語言模型訓練與評測、電腦視覺、電商情報、內容風控和具身智慧機器人等應用方向。

具體例子：小語種 ASR 語料（印尼語、泰語、馬來語、越南語、口音英語）用於訓練跨境客服與在地化場景的語音辨識；200 億筆 YouTube 留言與 900 億筆 TikTok 元資料支撐推薦、趨勢分析與情感模型；11 種語言的 OCR 影像數據集服務文件數位化；900 萬題的職業考試題庫用於大型語言模型評測與微調；涵蓋居家、辦公、工廠場景的第一人稱 Ego 影片（9 萬+ 小時）訓練具身智慧與 VLA 模型。如果您的應用不在這些方向上，也可以圍繞具體場景客製化採集。
