最近号越开越多,一个人根本喂不饱那么多内容位,就想着能不能让机器自己产。试下来大概是这么个思路:用Python的transformers库对接Hugging Face上的预训练模型来出文本,然后拿GitHub Actions定时跑脚本,跑完发封邮件通知我。
中间接了个Google Trends的接口,看看最近大家搜什么,让机器出的东西别太离题。数据这块我用matplotlib画了个简单的图看趋势。
最有用的其实是最后加的那个质量打分模块,用连贯性和相关性两个维度卡一遍,不然纯生成的东西读起来一股塑料味,直接发出去要挨骂的。现在还在调,产出勉强能用,但离能完全放手还差得远。