湘里妹子学术网

 找回密码
 注册
查看: 3001|回复: 0

汉语文本词性标注标记集

[复制链接]
发表于 2007-5-21 22:05:54 | 显示全部楼层 |阅读模式
汉语文本词性标注标记集


代码
名称
帮助记忆的诠释
Ag
形语素
形容词性语素。形容词代码为a,语素代码g前面置以A
a
形容词
取英语形容词adjective的第1个字母。
ad
副形词
直接作状语的形容词。形容词代码a和副词代码d并在一起。
an
名形词
具有名词功能的形容词。形容词代码a和名词代码n并在一起。
b
区别词
取汉字“别”的声母。
c
连词
取英语连词conjunction的第1个字母。
Dg
副语素
副词性语素。副词代码为d,语素代码g前面置以D
d
副词
adverb的第2个字母,因其第1个字母已用于形容词。
e
叹词
取英语叹词exclamation的第1个字母。
f
方位词
取汉字“方”
g
语素
绝大多数语素都能作为合成词的“词根”,取汉字“根”的声母。
h
前接成分
取英语head的第1个字母。
i
成语
取英语成语idiom的第1个字母。
j
简称略语
取汉字“简”的声母。
k
后接成分
 
l
习用语
习用语尚未成为成语,有点“临时性”,取“临”的声母。
m
数词
取英语numeral的第3个字母,nu已有他用。
Ng
名语素
名词性语素。名词代码为n,语素代码g前面置以N
n
名词
取英语名词noun的第1个字母。
nr
人名
名词代码n和“人(ren)”的声母并在一起。
ns
地名
名词代码n和处所词代码s并在一起。
nt
机构团体
“团”的声母为t,名词代码nt并在一起。
nz
其他专名
“专”的声母的第1个字母为z,名词代码nz并在一起。
o
拟声词
取英语拟声词onomatopoeia的第1个字母。
ba介词 把、将 
bei介词 被 
p
介词
取英语介词prepositional的第1个字母。
q
量词
取英语quantity的第1个字母。
r
代词
取英语代词pronoun的第2个字母,p已用于介词。
s
处所词
取英语space的第1个字母。
Tg
时语素
时间词性语素。时间词代码为t,在语素的代码g前面置以T
t
时间词
取英语time的第1个字母。
dec助词 的、之 
deg助词 得 
di助词 地 
etc助词 等、等等 
as助词 了、着、过 
msp助词 所 
u
其他助词
取英语助词auxiliary
Vg
动语素
动词性语素。动词代码为v。在语素的代码g前面置以V
v
动词
取英语动词verb的第一个字母。
vd
副动词
直接作状语的动词。动词和副词的代码并在一起。
vn
名动词
指具有名词功能的动词。动词和名词的代码并在一起。
vl联系动词是、为
vu助动词能、会、应、可、要、应该、可能
vf趋向动词起、来、到、出、进、起来、上去、上来
w。 
w, 
w? 
w! 
w、 
w; 
w: 
w“ 
w” 
w《 
w》 
w( 
w) 
w' 
w‘ 
w『 
w』 
w………… 
w
其他标点符号
 
x
非语素字
非语素字只是一个符号,字母x通常用于代表未知数、符号。
y
语气词
取汉字“语”的声母。
z
状态词
取汉字“状”的声母的前一个字母。

说明:
本标记集基于北大标记集。对北大计算语言所表示感谢!
您需要登录后才可以回帖 登录 | 注册

本版积分规则

Archiver|手机版|湘里妹子学术网 ( 粤ICP备2022147245号 )

GMT++8, 2024-4-20 15:43 , Processed in 0.083379 second(s), 18 queries .

Powered by Discuz! X3.4

Copyright © 2001-2023, Tencent Cloud.

快速回复 返回顶部 返回列表