问小创
告诉我你的需求,我帮你从站内挑最合适的 AI 工具。
AI大模型厂商Anthropic近日宣布为旗下全系列Claude大模型新增原生诈骗检测功能,该功能可精准识别钓鱼链接、虚假理财话术、仿冒官方通知等12类主流网络欺诈内容,早期测试数据显示其识别准确率超过98%,误报率不足1%,能够有效帮助普通用户、企业客户规避经济损失,为生成式AI落地安全场景提供了新的参考路径。
最近不少网友在社交平台吐槽,收到的仿冒物流退款、银行账户冻结短信几乎能以假乱真,甚至AI生成的熟人诈骗语音连亲近的人都很难分辨,而这类普通人头疼的识别难题,现在可以直接交给Claude解决。
美国联邦贸易委员会(FTC)发布的2024年上半年网络欺诈报告显示,期内美国消费者因网络欺诈产生的总损失超过58亿美元,同比上涨22%,其中34%的欺诈内容由AI工具生成,话术更自然、伪造的凭证更逼真,传统基于关键词拦截的反诈工具命中率已经跌到57%,无法应对迭代速度极快的新型欺诈手段。
和市面多数需要额外安装的反诈插件不同,此次Anthropic推出的诈骗检测功能是原生嵌入Claude全系列产品,免费用户和付费的Claude 3 Opus、Sonnet、Haiku用户无需额外开通权限即可使用。
用户只需要将可疑的短信截图、邮件内容、聊天记录甚至语音转写文本发送给Claude,模型就会自动标注其中的风险点,包括伪造的官方域名、索要验证码/转账的敏感话术、不符合市场规律的高收益承诺等特征,同时给出明确的风险等级提示。根据Anthropic公布的内部测试数据,该功能对12类主流欺诈场景的识别准确率达98.7%,误报率仅为0.8%,远高于传统反诈工具的平均水平。
实际上不止Anthropic,头部大模型厂商都在加速布局AI安全工具的落地:OpenAI此前已经为ChatGPT新增了恶意内容识别模块,可主动拦截用户询问诈骗话术的请求,Google Gemini也上线了反诈插件,支持对用户上传的内容做风险筛查。
在业内看来,生成式AI已经成为网络安全攻防的核心战场:一方面黑灰产借助AI降低了诈骗内容的生产门槛,另一方面大模型本身的语义理解、多模态识别能力,也为反诈提供了更高效的解决方案。Anthropic相关产品负责人透露,后续还将开放诈骗检测功能的API接口,支持银行、电商、支付平台将其集成到自身的业务流程中,实现从用户端识别到交易环节拦截的全链路风险防控。
AI创作导航,创作与探索并重。聚合全球优质AI工具,覆盖短视频、图文、写作、设计等创作场景,以及办公、学习、编程、生活等全品类需求。从创作出发,探索AI的无限可能,为创作者、学生、教师、职场人提供一站式AI工具导航与场景化应用指南。