@atreides 中推的色情跟贴我觉得大约有三个浪潮。第一波是tumblr难民时期,这各阶段构建了“黄推”基本盘,但是基本上不会跑去别的账号下面跟贴的,都是同类账号互动。这个阶段我觉得更多地是一个成人内容交流的需求驱动的。第二波是马斯克改算法,立党和诸多其他每日大赛账号快速在算法推荐中获得更高优先级。这时候就开始出现很多以流量为目标的账号,这些色情推主多数都是去个体化的。第三波是近半年的大量无效无关色情跟贴,其中有一部分很可能是和官方有关的信息污染投放。这一波是真的几乎彻底把串推这种模式毁掉了。
我倒不觉得是“无审核全开放SNS的不可能性”,反倒可能是中文SNS畸形审查机制(以及畸形短视的互联网商业模式)输出的一股熵流。
@duncan1n1
我个人其实对聊天机器人账号态度比较中立。在一个真正健康的SNS平台上,不想看到聊天机器人屏蔽了就可以(您第二段所说的机器人过滤应对的是这类问题)。
现在的问题是大量机灌的情形,换言之并不是一个机器人账号,而是大量行为刻板(可能通过人工也可能通过程序控制)的假个人账号,我们无法区分它是机器人还是某个个人或团体的一堆傀儡账号或说小号。过滤是过滤不尽的,除非部分放弃讨论的公共性(比如现在twitter上很多人选择“只有发帖人指定的人可以恢复”),否则无法解决。
这类傀儡账号的问题依我个人愚见,最初的起源很可能是官方资金驱动的。2022年底,如果听说某地发生群体性事件,搜索[地名]的实时消息,就会出现一大堆打着tag“[地名] 线下/同城/约炮”的内容。而这个[地名]是县城或者社区级别都有这种情况发生,这很显然是故意进行的信息污染。
我因此有了进一步(也不免掺杂了更多个人偏见)的推测:官方需要信息污染以降低信息热度,因此一些外包机构就养了一大批注册时间很短推文很少的伪色情账号,这类账号在规模不大的时候是很容易被识别处理的(就好像那些临时冒出来发言的粉红账号一般的结果一样,就是被它们回复的人一ban了之),应对方案就是养号。养更多的假账号或者让每个号都使用更久发更多色情信息,显得像真色情账号。
更多假账号就不必谈了,谈谈后一个策略。个人账号更常见的就是形成网友关系相互转发,平时也会有一些聊天。被机构所运作的账号则在互相转发之外经常会参加每日大赛,并且会在发表“原创”内容时at某几个平台类账号(签约色情视频平台、“实名认证”之类“资源推介”型账号,我推测可能还有一些黄推MCN)。纯粹做信息污染或者诈骗的账号,转发量可能比较低,互相at成为一个小圈子的情况非常低。
所以识别其实并不困难,twitter在被马一龙买下之前就曾经识别过几批有官方背景的粉红水军账号。但这种识别要确定哪些是机灌账号,需要精确为其行为画像且不误伤,似乎不大容易。我想从头遏制,一定需要一个政治的方案:宣传部门不该有预算去信息污染,以及形成一个较为坚韧的舆论生态。前者可能民主化会是一个解决方案,而后者……我不知道“清菌毯”的过程要多久才能解决。
@StYi 我最后一段话针对的是不请自来的机器人,并不是针对所有机器人的。
我觉得解决现在这一代发送垃圾推的机器人其实并不难,可以根据词法、语法规则、推文的信息量和重复率、个人简介或帐号首页推文中存在常见网站之外的外站链接或即时通讯联系方式等特征deboosting推文,降低对正常用户使用体验的影响。一段时间以后积累了更多的数据,就更容易知道哪些帐号频繁被deboosting,从而可以针对这些帐号采取shadow ban等软性限制措施。软性限制往往比硬性封号更有效,因为被限制的帐号通常不会立即意识到异常,也就不会立即切换新的帐号。
这种方式对普通人的影响很低,顶多也就是偶尔有几个推文回复被deboosting而已,但对于spam bot来说大幅增加运营成本,不仅需要生成不重复的有较长内容且语法正确的推文内容,还要监测shadow ban等软性限制。
当然,这只对现在这一代正在使用的伪色情垃圾回复机器人有效,日后bot改变了,应对方式也要随之改变。这也不利于增加来自垃圾机器人的蓝标推文boosting盈利。
@duncan1n1 @StYi 现在spam都开始用AI自动生成推文了,有些甚至乍一看还是对原推的正经回复,基本和活人发的废话口水po差不多…人类都很难分辨,不要说自动识别程序了…
@duncan1n1 @dreamplan2501 @StYi
可能关键在“数量惊人的”
@duncan1n1 @Acer @StYi 可以用来养号。
@dreamplan2501 @Acer @StYi 封号的时候并不会在意这个号曾经发了多少内容、注册时间有多旧,只会在乎它是否违反了规则。如果在它加入外站链接或者私聊联系方式并且发布格格不入(因此才会吸引目光)的内容时就触发soft ban,降低展示率并且等用户举报,一段时间没有举报再逐步恢复展示率,那么就可以最小化它的不良影响,而普通用户几乎感受不到这种政策对使用体验带来的影响。由于这种方式降低点击量,发广告的人发现不赚钱自然也就不发了。
@duncan1n1 @Acer @StYi 我记得以前推特的政策是会根据这个号的注册时长发推频率互动量等等来决定显示权重或被举报后的处理等级的。但是马斯克接手后就不知道了。反正直观体验就是乌泱泱的蓝勾spam冲击一切较为热门的推文,外媒中文频道也是重灾区。而且这种污染现在有从中文圈向英文圈蔓延的趋势,给你饭里掺屎。
@dreamplan2501 @Acer @StYi 即便是老帐号也有可能是通过盗号、购买等方式获得的,所以依赖注册时间和历史发帖等方式的判定注定要失败的。
@duncan1n1 @Acer @StYi 不能通过文本内容分析到不自然的变化来防止吗?
@dreamplan2501 @Acer @StYi 真人也会变,生老病死、婚丧嫁娶之类的life event有可能会改变一个人的说话方式和习惯。单纯依靠这种方式是不现实的。
@duncan1n1 @Acer @StYi 我直观感觉人类的这种性格和关注点、说话方式变化仍然会是在一个符合逻辑、有迹可循、较为自然的幅度范围内,即便是突遭变故,也极少有突然无缘无故性情大变的。而养号卖号盗号的还是感觉有点不一样…当然只标注是或不是可能也比较难准确反映现实。比较理想的解决办法可能是设一个十分制或百分制来显示程序判断是否虚假账号的可能性,供用户参考。
@dreamplan2501 @Acer @StYi 其实内容显示出来了,发这些东西的人的目的也就达到了。上面带着提醒信息也无所谓,想要上当的人是拦不住的。参考:银行柜员试图劝阻打算给骗子转账的人。
@Acer @dreamplan2501 @StYi 如果发了这种东西以后不能获得了流量,也就失去了意义。这种spam最终是想要诱导用户访问外站链接或者参与私聊的。如果单纯只是数量多,但和普通的废话区分不开,它们恐怕也不会获得什么点击量的。