Roblox 已将其三种AI安全工具向开源社区发布

两部手机屏幕上显示了包含角色和与Roblox语音聊天政策违规相关的通知弹窗的虚拟环境。
图片来源:Roblox

Roblox决定通过强大开放在线安全工具模型社区(简称ROOST)公开提供其三种AI安全模型。这一独立的非营利组织是与Google、OpenAI和Discord在2025年成立的,维持专注于在线安全的开源基础设施。

Roblox贡献的三种模型包括PII分类器、Roblox Sentinel和最新的语音安全分类器。这些工具已在其自身平台上启用,旨在加强安全保护,其中PII分类器通过检测各种伪装和代码词识别分享或请求个人信息的情况。

此外,Roblox提供了一个评估数据集,展示合成聊天样本,旨在模拟用于绕过这些过滤器的方法。Roblox Sentinel旨在识别对儿童的潜在威胁的早期预警信号,而语音安全分类器则处理实时语音聊天的审查,并通过ROOST社区的反馈不断改进。

这个新的评估数据集将帮助公司测试其安全解决方案的效率,提供对30种语言和八种违规类型的审查支持。根据Roblox信任与安全工程副总裁Naren Koneru的说法,分享这些模型为其他平台开发审查工具提供了宝贵的基础,同时也实现了互相学习,因为公司可以反馈他们的进展。

Koneru强调,安全是集体努力的结果,Roblox仍然致力于通过在ROOST社区内的合作推动检测工具的进步。在这一承诺的背景下,美国参议院司法分委员会关于犯罪和反恐的调查已经宣布启动,内容是关于Roblox被指控优先考虑参与度和收入而不是儿童安全的指控。

该平台已被要求在2026年8月31日前提交关于儿童安全和虐待案例的详细记录。为解决安全问题,Roblox推出了一些措施,例如限制13岁以下用户的直接消息功能、对全球聊天功能进行年龄检查、为内容推出“敏感问题”标签,并加强审核系统和家长控制。

gamesindustry.biz
评论
写评论...
Related news