HyperAIHyperAI

Command Palette

Search for a command to run...

CulturalGround 多语言文化视觉问答数据集

在 Discord 上讨论

日期

5 个月前

数据集组织

Carnegie Mellon University

论文 URL

2508.07414

许可证

Apache 2.0

标签

CulturalGround 是由卡耐基梅隆大学 NeuLab 于 2025 年发布的一个面向文化知识对齐的多语言多模态视觉问答数据集,相关论文成果为 「Grounding Multilingual Multimodal LLMs With Cultural Knowledge」,旨在提升多模态大语言模型对小众文化实体与低资源语言的理解与推理能力。

该数据集包含 2200 万对高质量、文化语境丰富的问答,覆盖 42 个国家与 39 种语言,每条样本包含图像、问题与答案,按国家与语言组织,以直接将模型预测与文化实体对齐。

数据包含:

  • 图片与实体元信息(国家/语言/实体 ID/文化属性)
  • 视觉问答样本:开放式问答与多选/判断题两类,含未滤与已滤版本
  • 多语文本:覆盖 39 种语言的问题与答案,支持跨语言训练与评测
数据集示例

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码
开箱即用的 GPU
最优定价

HyperAI Newsletters

订阅我们的最新资讯
我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新
邮件发送服务由 MailChimp 提供
CulturalGround 多语言文化视觉问答数据集 | 数据集 | HyperAI超神经