AI 问小创

你好,我是问小创 AI 助手

告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

推荐结果基于站内收录,仅供参考,请以实际工具信息为准。
猜你想问
推荐一些AI写作工具 有什么AI绘画工具? 推荐视频剪辑AI工具
AI
问小创: 告诉我你的需求,我帮你从站内挑最合适的 AI 工具。

Anthropic为Claude新增诈骗检测功能 可大幅降低用户欺诈损失

AI大模型厂商Anthropic近日宣布为旗下全系列Claude大模型新增原生诈骗检测功能,该功能可精准识别钓鱼链接、虚假理财话术、仿冒官方通知等12类主流网络欺诈内容,早期测试数据显示其识别准确率超过98%,误报率不足1%,能够有效帮助普通用户、企业客户规避经济损失,为生成式AI落地安全场景提供了新的参考路径。

最近不少网友在社交平台吐槽,收到的仿冒物流退款、银行账户冻结短信几乎能以假乱真,甚至AI生成的熟人诈骗语音连亲近的人都很难分辨,而这类普通人头疼的识别难题,现在可以直接交给Claude解决。

美国联邦贸易委员会(FTC)发布的2024年上半年网络欺诈报告显示,期内美国消费者因网络欺诈产生的总损失超过58亿美元,同比上涨22%,其中34%的欺诈内容由AI工具生成,话术更自然、伪造的凭证更逼真,传统基于关键词拦截的反诈工具命中率已经跌到57%,无法应对迭代速度极快的新型欺诈手段。

和市面多数需要额外安装的反诈插件不同,此次Anthropic推出的诈骗检测功能是原生嵌入Claude全系列产品,免费用户和付费的Claude 3 Opus、Sonnet、Haiku用户无需额外开通权限即可使用。

用户只需要将可疑的短信截图、邮件内容、聊天记录甚至语音转写文本发送给Claude,模型就会自动标注其中的风险点,包括伪造的官方域名、索要验证码/转账的敏感话术、不符合市场规律的高收益承诺等特征,同时给出明确的风险等级提示。根据Anthropic公布的内部测试数据,该功能对12类主流欺诈场景的识别准确率达98.7%,误报率仅为0.8%,远高于传统反诈工具的平均水平。

实际上不止Anthropic,头部大模型厂商都在加速布局AI安全工具的落地:OpenAI此前已经为ChatGPT新增了恶意内容识别模块,可主动拦截用户询问诈骗话术的请求,Google Gemini也上线了反诈插件,支持对用户上传的内容做风险筛查。

在业内看来,生成式AI已经成为网络安全攻防的核心战场:一方面黑灰产借助AI降低了诈骗内容的生产门槛,另一方面大模型本身的语义理解、多模态识别能力,也为反诈提供了更高效的解决方案。Anthropic相关产品负责人透露,后续还将开放诈骗检测功能的API接口,支持银行、电商、支付平台将其集成到自身的业务流程中,实现从用户端识别到交易环节拦截的全链路风险防控。

本文基于公开信息分析整理,仅供参考。更多AI工具动态与行业解读,请持续关注本站更新。