
主要研究领域为大规模的跨语言预训练。课题目标是希望预训练模型在源语言(例如英语)上微调后,可以直接应用到其他目标语言上(例如中法德日)。子课题包括:如何改进模型以提高在目标语言上的迁移效果,如何不利用双语语料实现语言之间的对齐,以及通过本课题增进对人类语言各种性质的理解等。
1、实习时间至少为六个月,有长期实习意向的同学优先,本硕博均可
2、有NLP/ML/CV相关论文发表经验的同学优先
3、关注NLP/ML/CV的最新模型和算法,并且有实现和调试模型的经验
4、有较强的动手能力,熟练掌握pytorch等框架
