单选题
2565.常用的文本数据标注工具不包括()。
A
YEDDA
B
Chinese-Annotator
C
doccano
D
LabelBox
答案解析
正确答案:D
解析:
题目:2565. 常用的文本数据标注工具不包括( )。
选项:
A: YEDDA
B: Chinese-Annotator
C: doccano
D: LabelBox
正确答案:D
解析:
本题考查的是对常用文本数据标注工具的了解。需要判断哪一个工具不属于“常用的”中文或通用文本数据标注工具范畴,或在特定语境下是否主要面向文本标注任务。
逐项分析:
A: YEDDA(Yet another Entity and Dependency Dataset Annotator)
YEDDA 是一款由北京大学研发的轻量级、开源的文本标注工具,特别适用于中文命名实体识别(NER)、关系抽取等自然语言处理任务。支持多种标注格式,广泛应用于中文文本标注场景,属于常用的文本标注工具。
B: Chinese-Annotator
这是一个专为中文文本设计的开源标注工具,支持命名实体识别、词性标注、句法分析等任务。其名称即表明其针对中文语言的特点进行了优化,是中文NLP研究中常用的工具之一。
C: doccano
doccano 是一个开源的、基于Web的文本标注平台,支持文本分类、序列标注、情感分析等多种任务。界面友好,支持多人协作,被广泛应用于学术研究和工业项目中,是当前非常流行的文本标注工具。
D: LabelBox
LabelBox 是一个商业化的数据标注平台,主要面向图像、视频和传感器数据的标注,在计算机视觉领域应用广泛。虽然它也支持文本标注功能,但其核心优势和主要应用场景并非文本数据处理,且在文本标注领域的普及程度和专业性不如其他三个工具。尤其在中文文本处理或学术研究中使用较少。
因此,从“常用的文本数据标注工具”这一限定来看,LabelBox 并不属于典型的、专注于文本标注的常用工具。
结论:
正确答案为 D,因为 LabelBox 主要用于图像等非文本数据的标注,虽具备文本标注能力,但在文本标注领域并不属于“常用”或“主流”的专用工具。
核心知识点:
1. 文本数据标注工具:指用于对文本进行人工或半自动标记的软件工具,常见任务包括命名实体识别、文本分类、关系抽取、情感分析等。
2. 开源与商用平台区别:开源工具如 doccano、YEDDA 更适合研究和小规模项目;商用平台如 LabelBox、Scale AI 等更侧重企业级数据管理与多模态支持。
3. 工具适用场景差异:不同标注工具根据语言支持、功能设计、部署方式等各有侧重,选择时需结合任务类型(文本/图像)、语言(如中文支持)、成本和团队规模等因素。
综上,本题答案选 D。
相关知识点:
常用标注工具不含LabelBox
题目纠错
人工智能训练师题库
相关题目
单选题
2288.可以使用()接受用户的键盘输入
单选题
2287.提出非单调推理是由于()。
单选题
2286.现代语言学家把语言处理分成3个层次:语法分析、句法分析和语义分析。其中,指从句子中获得单词的语言学信息并确定单词含义的是()。
单选题
2285.一般来说“黑天鹅”事件的特点是()。
单选题
2284.典型的“鸡尾酒会”问题中,提取出不同人说话的声音是属于()。
单选题
2283.框架是一种()方式。
单选题
2282.已知初始问题的描述,通过一系列变换把此问题最终变为一个子问题集合;这些子问题的解可以直接得到,从而解决了初始问题。这是知识表示法叫()。
单选题
2281.人工智能判断癌症的方法不包括是()。
单选题
2280.不属于图像分类技术应用领域的是()。
单选题
2279.Siri是一种()系统。
