
点击查看大图

点击查看大图
全面介绍
✨ OneNine by 19X AB:解锁全球语言的AI潜力 ✨
OneNine by 19X AB 专注于为低资源语言提供可扩展的AI解决方案,致力于为全球AI实验室构建强大的数据供应链。我们相信,每个人都值得被AI理解。
💡 产品亮点:连接世界,赋能AI
- 文化真实性数据: 我们提供经过预标注、具有文化真实性的数据集,尤其侧重于非洲及其他低资源语言。
- 赋能全球AI巨头: 我们成功助力OpenAI、Google、Meta、Anthropic、xAI 和 Microsoft 等领先AI公司,使其模型能够真正理解全球40亿未被充分代表的用户。
- 高质量、训练就绪: 我们将原始数据转化为高质量的标注数据,确保数据集能够直接用于您的AI模型训练。
“我们正在为AI构建目前缺失的中低资源语言数据基础设施。”
🎯 我们的解决方案:多维度赋能您的AI项目
1. 面向低资源语言的AI训练数据
我们提供即用型、预标注的高质量数据集,涵盖150多种低资源语言,可立即投入模型训练。
- 🔊 音频与语音 (Audio & Speech): 提供ASR & TTS数据集、转录文本等。
- ✍️ 文本与自然语言处理 (Text & NLP): 包含翻译对、命名实体识别 (NER) 和情感分析数据。
- 🖼️ 图像与视觉 (Images & Vision): 支持图像分类、对象检测等。
2. 您的数据,我们的专业知识
无论您拥有何种原始数据,我们都能通过专业团队进行标注,支持150多种语言。
- 🎧 音频标注 (Audio Annotation)
- ✏️ 文本标注 (Text Annotation)
- 🖼️ 图像标注 (Image Annotation)
- 多层级质量保证 (Multi-tier QA):由母语使用者和自定义标注指南确保数据质量。
3. 模型对齐与强化学习 (Align Your Models)
为服务不足的语言提供人类反馈数据,用于模型的强化学习 (RLHF)。
- 偏好排名 (Preference Rankings)
- 响应评级 (Response Ratings)
- 安全对齐 (Safety Alignment):支持指令调优,确保模型理解文化语境。
🌍 我们的全球数据构建流程
-
全球贡献者 (Global Contributors): 社区成员贡献语音记录、故事和文化知识,为包容性AI奠定基础。
招聘中: 沃洛夫语、约鲁巴语、林加拉语及10多种语言的母语使用者!
- 先进AI算法 (Advanced AI Algorithms): 结构化清理贡献者数据,保留文化语境和语言细微差别。
- 专家验证 (Expert Validators): 专家和社区领导审核贡献内容,添加文化注释,确保真实代表性。
- 赋能AI模型 (Fuel AI Models): 经过验证的数据集为OpenAI、Google、Meta、Anthropic等AI巨头的模型提供动力,连接社区与技术。
我们有5个角色、6个步骤,为您提供高质量的AI数据。
📈 AI模型基准表现提升
与领先AI模型基础表现相比,OneNine数据集可显著提升模型在低资源语言上的理解能力。
- GPT-4o (OpenAI): 基础 42.3% → 通过 OneNine 提升至 68.7% (+62%)
- Claude 3.5 (Anthropic): 基础 38.9% → 通过 OneNine 提升至 61.2% (+57%)
- Gemini 1.5 (Google): 基础 35.7% → 通过 OneNine 提升至 54.8% (+54%)
- LLaMA 3.1 (Meta): 基础 31.2% → 通过 OneNine 提升至 48.6% (+56%)
- Mistral Large (Mistral): 基础 28.4% → 通过 OneNine 提升至 43.9% (+55%)
这充分展示了 OneNine 数据集在提升主流AI模型对低资源语言理解能力方面的巨大潜力。
产品评分
暂无评分
登录后即可评分
















