Adaption Labs推出Invent a Dataset 无需种子语料生成可用训练数据集

近日,AI基础设施研发商Adaption Labs正式推出全新训练数据生成工具Invent a Dataset。该工具无需依赖现有种子语料库,仅通过用户输入的任务描述,即可自动生成符合训练要求的指令数据、偏好对齐数据行,大幅降低大语言模型垂直场景微调的数据标注、素材收集成本,有望缓解AI训练领域长期存在的高质量数据集供给不足痛点。

如果你想做一个面向线下餐饮门店的智能排班模型,过去首先要花至少1个月收集上万条行业排班历史数据,再花数万元请标注员清洗对齐,才能拿到可用的训练数据集——这个困扰了无数AI开发者的痛点,如今有了更高效的解决方案。

当前大语言模型向垂直场景渗透的过程中,高质量定制化训练数据集的获取成本,已经占到整体微调项目成本的60%以上

免责声明:本网站AI资讯内容仅供学习参考,不构成任何建议,不对信息准确性与完整性负责。