王文强 江远帆 方冉冉 卫清



编者按:在这个到处被流量充斥的时代,网络直播恶俗弹幕不断出现,影响网络环境的同时,在一定程度上也影响着部分未成年用户的身心健康,网络弹幕的相关问题亟待解决。本项目基于利用Python爬虫、 Selenium模块、Matplotlib等模块与技术完成对于bilibili恶俗弹幕问题的优化处理。本项目将直播过程中出现的弹幕抓取并存储于目标数据库中,再通过设定的语义框架对抓取内容进行实时且有效地弹幕过滤,以此来管理弹幕中出现的恶俗词汇与不良言论,从而达到净化网络环境的最终目的。
问题背景
网络让人们言论自由、话语权趋于平等的同时,也为一些人进行网络暴力提供了机会。虚拟的网络环境致使网络发言者可以以虚拟的网名和网络ID的形式,隐藏其真实身份,这就造成网民言说责任与真实身份的断裂,使其有了放纵自身网络行为的机会。虽然现在部分软件已经开始渐渐提倡用实名认证的方式让用户做到文明发言,但是网络暴力、恶俗弹幕的问题依旧存在。
目前弹幕言论监管还主要依靠人工进行删除与禁言,操作繁琐且常常出现“漏网之鱼”。“弹幕”最早时为军事用语,指的是用炮弹对目标进行密集炮击。后来因为niconico①播放器的评论功能与当时的弹幕射击游戏很是相似,所以才渐渐发展成现在我们所说的视频或是直播中的弹幕功能。随着弹幕文化在大众、尤其是年轻群体中的影响力不断扩大,弹幕内容也逐渐成为视频传播过程中非常重要的一部分,但目前诸多平台弹幕监察措施和过滤手段却迟迟没有得到优化,伴随着的是恶俗弹幕内容的不断出现。……