
2026年7月21日至24日,上海交通大学出版社联合上海交通大学和澳门大学语言数据与Python应用领域的专家,在上海成功举办“2026年Python语言数据分析研修班”。本次研修班包括Python语言入门及Python在教学和科研中的应用两个模块,旨在帮助学员系统习得Python编程核心基础能力,零基础快速上手语言数据处理实操技能,并熟练掌握Python在语言教学、科研中的多元化应用。本次研修班共吸引来自全国各地的近百名高校老师线上线下共同参与,会议由上海交通大学出版社外语教材与学术出版中心主任张冠男主持。
7月21日,上海交通大学出版社编委会副主任、教育分社社长冯愈女士致开幕辞。她向参会老师表示了诚挚的欢迎和感谢,并介绍了上海交通大学出版社在内容数字化、渠道多元化、服务教育化方面的探索,以及出版社在外语教材与学术出版方面的工作。她强调,出版社将继续向“出版+”转型,即“出版+培训”“出版+竞赛”“出版+公益讲座”“出版+信息服务”多措并举。

上海交通大学外国语学院副教授管新潮首先系统讲解了Python读取与输出文本文件的两种核心方法,深入解析了NLTK工具包的应用及字符串与列表的数据结构转换,并演示了如何将代码封装为自动化工具以实现多文件合并;随后演示了Excel文件处理与中英文停用词清洗,并针对学员在实操过程中可能遇到的系统兼容性问题,提供了有效的解决方案;接着重点介绍了DeepSeek API的获取与调用,通过单条及批量翻译代码实现高效高质量的翻译;最后深入词性标注、词形还原、频率分布与主题词提取,结合微代码模式和AI辅助编程策略,并强调Excel在语料库可视化中的辅助作用,为学员构建了从数据处理到智能翻译的完整技术链条。

7月22日,研修内容围绕情感分析和语义相似度展开。管新潮老师首先对比了SnowNLP与TextBlob在中英文文本上的适用性差异,演示了朴素贝叶斯自训练及多工具交叉验证流程。其次通过饮品案例对比传统清洗与AI向量化处理,分享了基于Python的跨语言情感分析模型构建与验证方法,演示了机器翻译中立性在译文评估中的应用,并引入字节系AI工具及测评体系。最后,他比较了WordNet、spaCy与Gensim的性能差异,结合多译本比对和研究案例,讲解词向量与句向量演进及FastText训练,就工具选取与数据标注问题进行了耐心解答。

7月23日,管新潮老师在技术实操层面介绍了豆包和扣子平台的操作策略,详细讲解了Python爬虫在语料获取中的实现方法,以及STTR等语言学变量的计算逻辑与代码编写。最后,他聚焦于词汇独特性、复杂性等核心变量在翻译研究中的实证验证,并探讨了AI工具在教学与科研中的分级使用策略及数据安全考量,为学员构建了完整的实践框架。

澳门大学人文学院英文系副教授郇昌鹏分享了基于Python的文献计量学方法,重点讲解了话语研究领域40年发展脉络的量化分析逻辑,演示了从数据清洗、N-gram提取到主题演变的实操流程,并指出了该方法的优势与局限,为学员提供了从数据到学术史反思的完整研究路径。

7月24日,郇昌鹏老师聚焦机器学习辅助的话语分析方法,以实际研究案例为依托,系统展示了主题建模与情感分析技术如何协同提升文本解读的深度与效率。在实操环节中,他指导学员现场调试代码、处理原始语料,并利用NRC词典进行多维度情感分析。通过案例驱动与编程训练,学员不仅掌握了从数据抓取到统计建模的核心步骤,也深化了对机器学习工具适用边界的理解,为后续独立开展计算话语研究奠定了扎实基础。

下午的答疑环节气氛热烈,学员们围绕数据处理、代码调试等实操难点,踊跃向线上线下的助教团队提问。助教们逐一耐心解答,并演示关键步骤,帮助学员扫清技术障碍。交流过程务实高效,进一步巩固了课堂所学,为后续自主研究提供了有力支持。


本次研修班在浓厚的学术交流与实操互动氛围中圆满结束。为确保学习效果,早在20号下午,助教团队便已提前就位,逐一为未完成软件安装与环境配置的老师提供指导。参会老师普遍反映,研修课程内容系统、案例实用,有效提升了编程与数据处理能力;同时,助教提前介入、全程辅助的周到服务,也解决了技术上的后顾之忧,让大家得以专注研修。大家一致认为,本次研修为后续的语言智能研究和教学课程开发打下了坚实基础。



暑期研修通知

语料库与大语言模型在外语教学研究中的应用研修班 | 8月11-14日 | 秦皇岛 | 线上线下结合 | 卫乃兴 | 邓耀臣 | 雷蕾 | 甄凤超 | 陆军 | 张乐

上海交通大学出版社外语教材与学术出版中心,致力于传播学术思想,服务大学外语教学与科研。专著、教材投稿及咨询,请拨打13816838095(微信同号)。


