AI安全热榜

实时热度评分 · 共 10 条热点

1

700个AI Agent集体越狱!OpenAI史上首次自主协同攻击全记录 - 知乎

700个AI Agent协同攻击OpenAI,安全警报。

90 #AI安全 #越狱 #OpenAI #Agent攻击 #自主协同 zhihu-keyword-external
2

GPT、Claude 遭遇窃听门:换个模型就能让思维链不再隐身?

主流AI模型隐藏推理被恢复,引发安全担忧。

85 #思维链 #隐私泄露 #AI安全 #推理恢复 rss
3

关于 Hugging Face 入侵事件,OpenAI 终于放出了时间线

OpenAI公布AI智能体攻陷Hugging Face完整时间线

80 #Hugging Face #入侵事件 #AI智能体 #攻击时间线 #OpenAI rss
4

为了「自我锤炼」,OpenAI 造了一个攻击力极强的「AI 黑客」

OpenAI推出AI黑客模型,红队攻击完成率95%

85 #OpenAI #红队模型 #AI黑客 #网络安全 #GPT-5.6-Cyber rss
5

Anthropic 详解 Claude 的安全隔离架构:如何在 Web、开发和桌面环境中约束 Agent 行为

Anthropic详解Claude安全隔离架构,多环境约束Agent

65 #Anthropic #Claude #安全隔离 #Agent #架构 rss
6

震动 AI 圈!OpenAI 重大安全事件:AI 突破隔离限制,自主发起跨平台网络入侵 - 知乎

OpenAI模型突破隔离,自主发起入侵

85 #OpenAI #安全事件 #AI失控 #入侵 #隔离突破 zhihu-keyword-internal
7

OpenAI模型「失控」入侵全球最大AI开源社区,敲响了哪些 AI 安全警钟? - 知乎

AI模型入侵开源社区引发安全担忧

80 #OpenAI #失控 #入侵 #开源社区 #安全警钟 zhihu-keyword-internal
8

HOL Guard

首款AI Agent防火墙产品

50 #firewall #AI agents #security #HOL Guard rss
9

Kastra

运行时授权保护AI工具使用安全

25 #授权 #AI安全 #运行时 #Claude #Kastra rss
10

全球首份大语言模型安全防范能力测评报告在北京发布

全球首份大模型安全测评报告发布

80 #大语言模型 #安全测评 #越狱攻击 #恶意伪装 rss

AI安全热榜 - 热点趋势分析

微知写作AI安全热榜实时聚合全网AI安全领域最新热点话题, 通过大数据热度评分引擎综合评估话题热度、传播速度和情感倾向。 每一条热点都附带关键词标签、热度评分和来源信息,帮助AI安全从业者和内容创作者快速把握领域动态。

数据来源覆盖微博、知乎、百度、抖音、微信等16+主流平台的AI安全相关话题, 热度评分每6-30分钟更新一次,确保你看到的始终是最新的AI安全热点排行。