从识别恶意文本到控制信息流:AI智能体安全的新方向
一、智能体安全正在从“模型安全”走向“系统安全” 大语言模型最初主要负责回答问题和生成文本。即使模型受到误导, […]
从识别恶意文本到控制信息流:AI智能体安全的新方向 Read More »
一、智能体安全正在从“模型安全”走向“系统安全” 大语言模型最初主要负责回答问题和生成文本。即使模型受到误导, […]
从识别恶意文本到控制信息流:AI智能体安全的新方向 Read More »
2026年7月28日,一份名为 “Pacing the Frontier” 的联合声明公开发布。截至本文撰写时
AI发展太快,有必要踩刹车:Pacing the Frontier事件综合分析 Read More »
2026年7月27日,NVIDIA联合微软、IBM、SpaceX、Hugging Face、Linux基金会、
Open Secure AI Alliance(开放安全人工智能联盟):致力建设面向智能体时代的开放式AI防御栈 Read More »
摘要 自主智能体正在把人工智能从一种“信息生成工具”,转变为能够读取数据、制定计划、调用软件、执行代码、操作账
自主智能体失控与AI网络安全综述报告——从“模型给建议”到“系统直接行动”的安全范式转变 Read More »
梵蒂冈官网发布教宗良十四世通谕 《Magnifica Humanitas》,副标题是 “在人工智能时代守护人的
Magnifica Humanitas,崇高人性 Read More »
“Mythos”正式名称是 Claude Mythos Preview。该模型目前不面向普通用户公开发布。更准
Anthropic最新模型Mythos Read More »