数据揭示 Reddit 刀具推荐或存水军操纵
Hacker News 热帖(26 赞)中,作者用数据调查 Reddit 刀具社区是否存在水军。作者微调 GLiNER 模型,从 r/knives、r/chefknives 等六个 subreddit 评论中抽取品牌、型号和钢材。初步发现某厨师刀品牌在“该买什么”类提及中有 31% 来自 5% 的账号,是随机预期的 4 倍。随后作者拉取这些账号历史,并预先定义 astroturfing 的数据模式以判断推荐是否被操纵。
欺诈、合规、信用与经营风险——让预警和决策有可追溯依据
+ 关注此主题,在 For Me 查看最近 7 天内最新的 3 条
Hacker News 热帖(26 赞)中,作者用数据调查 Reddit 刀具社区是否存在水军。作者微调 GLiNER 模型,从 r/knives、r/chefknives 等六个 subreddit 评论中抽取品牌、型号和钢材。初步发现某厨师刀品牌在“该买什么”类提及中有 31% 来自 5% 的账号,是随机预期的 4 倍。随后作者拉取这些账号历史,并预先定义 astroturfing 的数据模式以判断推荐是否被操纵。
作者在已有安全审查自动化基础上,用Agent层扩展流程,目标不是替代人,而是让系统理解请求、应用安全标准、补全缺失信息并识别人工介入时机。首个版本只覆盖一条审查路径,随后团队将其扩展为支持更多安全受理与审查环节的多个Agent。实现全部构建在Databricks上:Unity Catalog提供受治理的标准、请求、证据、决策与系统输出空间,Databricks托管基础模型(Claude Haiku、Sonnet、Opus)负责分类、风险评估和起草要求,Lakeflow Jobs在Serverless Compute上编排Notebook工作流,Databricks Apps提供受理应用和高管看板。请求在统一受治理表中连续流转,从Intake到Reasoning逐步处理。
精选长期内容,最多 3 篇
按发布时间倒序