三九小说

手机浏览器扫描二维码访问

第27章(第2页)

作为一名合格的科研工作者,谢与非首先开始做文献收集工作。

Sci-Hub是用不了了,KI上的文献也不算很多,于是谢与非只好从最基础的做起——先筛选知名小说网站和APP。

不多时就进入到了着名的网文论坛,从中筛选出基本符合要求的平台若干。

然后再细分,哪些网站以霸总小白文见长,哪些受众比较多样化。

接着呢,就是科研狗们最喜欢的收集数据阶段。

谢与非花了两个晚上,研究了各类榜单的排名和更新依据,从论坛里搜集了大量资料,甚至搞明白了几大平台女频的各种打榜暗箱操作。

于是她——开始看小说了?

不,蠢蠢欲动想要写个刷票小程序和网站的算法较量一下,看能不能被识破。

但是理智告诉她,做研究要不忘初心,总结霸总的行为规律才是首要任务,于是又回归到了霸总文本身。

开始的时候,谢与非做了个Excel表,里面列了各个网站排名前十的霸总文,并且按照简介和名字做了分类。

通过阅读大量的书评,扫文号和论坛讨论贴可知,霸总文只是一个大项目,里面还分有不同的小类与流派。

根据题材可以分为重生,穿越,现实,古代等等,穿越下面还有,等小类。

根据风格还可以分为「甜宠型」,「强迫型」,「型」,「契约情人型」等等。分析平台的榜单排名可知,目前「虐恋型」已经过时,「甜宠型」和「火葬场型」正在当红。

表列到这里,谢与非发现单纯的表格已经不能满足她了,这种复杂的分类需要一个坐标系。

于是画起了横轴和纵轴。

除了文章风格,作为霸总文灵魂的「霸总」当然也需要分类。

什么型霸总,粗暴型霸总,外冷内热型霸总,智商极高型霸总,反正也是需要一个坐标系来画明白的。

画着画着图她的思维又开始奔逸了,像霸总文这种具有高度同质性并且特徵明显的小说,是不是可以先收集大量数据建立一个语料库,然后再写一个算法让AI自动出产霸总文,只要输入想要的属性标签,然后就可以自动从语料库里摘取句子生成语段。同理可证那些打脸文丶丶文都可以一样产出。

小贴士:如果觉得不错,记得收藏网址或推荐给朋友哦~拜托啦(.)

:||

八零漂亮后妈,嫁个厂长养崽崽  请认真搞笑  苗疆少年的小情蛊  欲拒还迎后男主精分了  夜路行人  [原神] 原初之母竟是我自己  缘来很甜  七十年代创业忙  山青卷白云:女翻译与王维  在年代文离婚后的幸福生活  死对头老公出轨观察日记  绿茶女配的前男友们  夜间飞行  [历史同人] 天幕剧透后秦始皇手握封神榜  瑞雪临  暴风雪来临:开启末世零元购  御厨大人她有新派料理[美食]  星际第一符籙机甲师  影后娘娘升职记  鼻炎Beta生活手册  

热门小说推荐
大话之神

大话之神

一个热爱网络游戏的痴孩子,二不垃及的真神祝愿下进入了游戏的世界。。。。。。...

武林店小二

武林店小二

江湖日报讯肯麦郎连锁客栈享誉大明各府,其总部却是京城一家名为来福的小客栈。来福客栈在江湖上大名鼎鼎,即便费用高昂,上到各派掌门下到江湖游侠,都挤破脑袋想去来福客栈吃顿饭。记者有幸请到武林盟主,揭开来福客栈的秘密!来福客栈日常一幕少林方丈,你怎么吃饭不给钱啊?偶弥陀佛,出家人身无分文,这顿饭可否算作化缘?不行!武当掌门没钱吃饭,还在后院洗碗呢!你若不给钱,就去洗茅房!来福客栈日常二幕丐帮长老,瞧你样子就没钱吃饭,你来客栈干啥?听闻来福客栈可以拿东西抵押,我这里有本上乘的秘...

九龙吞珠

九龙吞珠

一张从始皇帝皇宫流传出的长生不老药地图,解开不死不灭之秘。一代名将,将守,从万人敌,到无人敌的重生之路!九龙吞珠读者交流群721466643)...

抢救大明朝

抢救大明朝

关于抢救大明朝朱慈烺此贼比汉奸还奸,比鞑子还凶,比额李自成还能蛊惑人心!闯王李自成立马九宫山,遥望东南,感慨万千。慈烺此子忤逆不孝,奸诈凶残,简直是曹操再世,司马复生,让他当了皇帝,全天下的...

我和大圣是兄弟

我和大圣是兄弟

王虎穿越了,而且悲催的成了五指山下的一只老虎。我去,这是要做猴哥虎皮裙的节奏?王虎表示不服。作为一只21世纪穿越来的新时代老虎,怎么着也要和猴哥拜把子,做兄弟啊!此时此刻齐天大圣孙悟空被压五行山马上就满五百年,再有十年,波澜壮阔,影响三界格局的西天取经之旅就要开始,看王虎如何在其中搅动三界风云,与猴哥一起再掀万...

每日热搜小说推荐