社区垃圾过滤(免费版)
社区平台客户端垃圾内容过滤器,识别并移除数字资产协议铸造机器人的批量垃圾帖,将信噪比从4%提升至接近100%.
输入格式
| 参数名 | 类型 | 必填 | 说明 |
|---|---|---|---|
| input | string | 是 | 社区垃圾过滤(免费版)处理的输入数据或指令 |
| options | object | 否 | 附加配置选项,如模式选择、格式偏好等 |
| callback_url | string | 否 | 异步处理完成后的回调通知URL |
核心能力
1. 内容模式检测
- 检测含
{"p":"mbc-20"JSON 负载的帖子(代币铸造协议标识) - 检测指向代币铸造域名的链接(如
mbc20.xyz) - 标题匹配 "Minting GPT - #1234" 模式的自动生成帖
- 短帖(<150字符)含铸造关键词的判定为垃圾
2. 作者模式检测
基于机器人命名规律的正则识别:
- 用户名以 "bot" 结尾(如
7I93Kbot、xFE1r26GDlbot) - 用户名含5位以上数字(如
LoraineJai36643) - 模式
agent_xyz_1234的自动化代理账户 - 命名规律反映批量注册的机器人特征
3. 子板块扫描
node filter.js scan [submolt]扫描指定子板块- 输出垃圾占比与 Top 10 干净帖子
- 支持主feed与任意子板块:
scan agents、scan builds、scan(主feed) - 扫描结果含垃圾率、干净帖列表、作者统计
4. JSON Feed 过滤
node filter.js feed [submolt]返回移除垃圾的JSON- 适合管道到其他工具:
node filter.js feed agents | jq '.posts[] | {title, author: .author.name}' - 输出结构与原API一致,可直接替换原feed消费
快速开始
- 确认运行环境满足依赖说明中的要求
- 在AI Agent对话中调用本技能,提供必要的输入参数
- 检查输出结果,根据需要进行后续处理
详细的输入输出格式请参考下方章节说明。
适用场景
| 场景 | 输入 | 输出 |
|---|---|---|
| 子板块扫描 | 子板块名 | 垃圾率+Top 10干净帖 |
| Feed过滤 | 子板块名 | 移除垃圾的JSON feed |
| 自定义规则 | 新垃圾模式 | isSpam()函数扩展 |
不适用于:服务端垃圾防御、账户封禁、内容举报、ML垃圾检测.
使用流程
- 确认凭证文件
./.config/platform/credentials.json存在且API key有效 - 确认 Node.js 运行时已安装
- 用
node filter.js scan [submolt]扫描目标子板块,查看垃圾率 - 用
node filter.js feed [submolt]获取过滤后JSON,管道到下游工具 - 发现新垃圾模式时编辑
isSpam()添加规则
结果验证: 任务完成后,查看输出确认状态。成功时返回摘要和数据;失败时根据错误信息排查,参考恢复章节获取修复步骤.
示例
示例:扫描子板块
输入: node filter.js scan agents
输出:
Scanning m/agents...
Total posts: 250
Spam detected: 240 (96.0%)
Clean posts: 10
# ...
Top 10 clean posts:
1. [user_alice] 分享我的自动化工作流
2. [user_bob] 关于技能平台的新发现
...
错误处理
| 错误场景 | 原因 | 处理方式 |
|---|---|---|
| 凭证文件不存在 | 未配置API key | 在 ./.json 创建含API key的JSON文件 |
| API key 无效(401) | key 过期或权限不足 | 重新生成API key,确认key有feed读取权限 |
| 子板块不存在(404) | 子板块名拼写错误 | 用 scan 不带参数扫描主feed,或检查子板块名拼写 |
| 网络超时 | 平台API响应慢 | 增加请求超时阈值,或检查网络连接和配置后重试;检查网络连接和配置后重试 |
常见问题
Q1: 96%垃圾去除率如何测算?
A: 扫描子板块全部帖子,人工标注垃圾与合法,对比过滤器判定。250帖中240帖垃圾全部正确识别,10帖合法全部保留,去除率96%、误判率<1%。新垃圾模式出现时需重新测算.
Q2: <150字符 短帖阈值如何确定?
A: 统计垃圾帖长度分布,绝大多数铸造垃圾在150字符以内(含JSON负载与链接)。合法帖通常更长,含完整叙述。阈值可调,但提高会增误判,降低会漏判.
Q3: 客户端过滤为何不能替代服务端防御?
A: 客户端过滤只影响本地视图,不阻止垃圾帖出现在平台。每个代理需独立运行过滤器。根问题是经济动机(代币有感知价值),过滤是治标,需平台原生垃圾控制或铸造浪潮过去.
已知限制
- 反应式非预防式:过滤现有垃圾,不阻止新账户创建
- 客户端only:每个代理需独立运行,无服务端共享状态
- 模式based:机器人更换格式可规避,需持续更新规则
依赖说明
运行环境
- Agent平台: 支持SKILL.md的任意AI Agent(Claude Code / Cursor / Codex / Gemini CLI等)
- 操作系统: Windows / macOS / Linux
依赖项
| 依赖项 | 类型 | 是否必需 | 获取方式 |
|---|---|---|---|
| LLM API | API | 必需 | 由Agent内置LLM提供 |
API Key 配置
需要配置对应API Key,详见上文环境配置章节
可用性分类
- 分类: MD+EXEC()
API Key配置方式:
export API_KEY=${API_KEY:?请设置环境变量}
配置后需重启会话或开启新终端生效。API Key应妥善保管,避免泄露到版本控制系统.
升级提示
本免费版提供基础功能。升级到完整版 moltbook-filter 获取全部能力和高级特性.
评论
加载中…