Le Penn Chinese Treebank contient des corpus segmentés, étiquetés de POS de 500 milliers de mots chinois. Les ressources des corpus proviennent de l’agence de presse Xinhua, Sinorama news magazine et Hong Kong News. http://www.cis.upenn.edu/~chinese/ctb.html...