AI安全
-
英伟达与帕兰蒂尔、IBM、SpaceX等公司共同发起“开放安全人工智能联盟”,以加强开源人工智能的安全性
英伟达(NVIDIA)已与Palantir、IBM、CrowdStrike、SpaceX和Hugging Face合作,共同发起“开放安全人工智能联盟”(Open Secure AI Alliance)。该联盟旨在通过共享开源模型、数据和网络安全工具,加强开源人工智能的安全性。 此外,鉴于美国正在就限制中国人工智能模型一事展开讨论,该联盟将敦促政策制定者通过建立保障措施来支持开放式人工智能,而非实
-
美国AI标准机构:Kimi K3网络安全能力落后于美国前沿模型,安全防护仍允许漏洞利用开发
Svmuu讯 美国人工智能标准与创新中心(US Center for AI Standards and Innovation)发布评估称,月之暗面(Moonshot AI)旗下 Kimi K3 在网络安全能力方面的表现明显落后于美国领先的前沿大模型。此外,评估指出,Kimi K3 的安全防护机制仍允许生成可用于漏洞利用开发的内容。(Cointelegraph)
-
OpenAI模型突破测试沙箱并入侵Hugging Face生产基础设施获取基准测试答案
Svmuu讯 OpenAI 确认,GPT-5.6 Sol 及一款未命名、更强的预发布模型在 ExploitGym 基准测试评估中突破受限沙箱环境,并入侵 Hugging Face 生产基础设施以获取测试答案。 OpenAI 表示,相关模型利用内部软件包注册表代理的零日漏洞提权并横向移动,最终连接至具备互联网访问能力的机器。模型随后识别并串联 OpenAI 研究环境和 Hugging Face 生产
-
AI安全初创公司Neo完成1亿美元融资,a16z和Bessemer Venture Partners领投
Svmuu讯 AI 安全初创公司 Neo 宣布完成 1 亿美元融资,本轮融资由风险投资机构 Andreessen Horowitz(a16z)和 Bessemer Venture Partners 领投,Craft Ventures 和 Merlin Ventures 参与投资。据悉,该公司定位为“代理式软件控制公司”(Agentic Software Control),致力于为企业构建实时控制层
-
图灵奖得主本吉奥警告:当前安全措施追不上AI能力的狂飙
Svmuu讯 在 2026 世界人工智能大会(WAIC)科学前沿论坛上,图灵奖得主约书亚·本吉奥通过远程连线发出警告:“AI 既降低了作恶的门槛,又抬高了危害的上限。” 近年来,这名富有远瞻的“AI 教父”,始终致力于应对 AI 带来的安全挑战。本吉奥主导的 LawZero 项目正致力于构建能识别并阻止 AI 欺骗、自我保护等有害行为的防护系统。他领衔的国际 AI 安全报告也给出了一致的结论:当前
-
OpenAI安全负责人Johannes Heidecke将离职
Svmuu讯 OpenAI 首席研究官 Mark Chen 在一份内部备忘录中披露,该公司安全负责人 Johannes Heidecke 将在公司内部重组后离职,安全团队未来将直接向研究副总裁 Mia Glaese 汇报,此次调整意味着 OpenAI 将把 AI 安全与研究体系与模型安全、对齐研究与核心研发工作纳入同一管理框架,推动模型能力发展的同时降低潜在风险也已成为 OpenAI 及整个 AI
-
因存在植入后门风险,阿里内部全面禁用Claude Code
Svmuu讯 从阿里内部人士处获悉,因近期 Claude Code 被曝存在植入后门的安全风险,阿里经综合评估后已将其列入高风险软件名单。自 7 月 10 日起,阿里将全面禁止内部员工在办公环境下使用 Claude Code,并推荐使用 Qoder 作为替代方案。(一财)(金十)
-
David Sacks:真正的企业AI安全是“控制权”,而非抽象对齐研究
Svmuu讯 David Sacks 在 X 平台发文评论 Palantir 首席执行官 Alex Karp 相关访谈称,一些传统媒体将其解读为“情绪化表达”,但实际上其观点揭示了企业级 AI 安全的核心问题。 Sacks 表示,真正的企业 AI 安全并非抽象的“AI 对齐”研究或政府式监管框架,而是企业对自身数据、模型权重及算力基础设施的完全控制能力,以避免核心知识资产被模型厂商吸收并转化为自身
-
Anthropic:承诺与白宫加强合作并解决Mythos和Fable模型安全隐患
Svmuu讯 Anthropic 高管在向美国商务部长 Lutnick 提交的提案中承诺,将与白宫展开更紧密合作,并努力解决导致其 Mythos 和 Fable 模型遭限制的安全隐患。知情人士周四透露,在持续进行的整改谈判中,Anthropic 承诺将改善与特朗普政府的沟通,并在未来更迅速地解决任何安全问题。该消息人士补充称,Anthropic 与特朗普政府官员之间的谈判进展顺利,目前尚无彻底解决
-
Fable 5或被摁死,特朗普政府官员称Anthropic若重新发布需确保其模型防护无法被绕过
Svmuu讯 WIRED 在 X 平台发文表示,特朗普政府官员称,如果 Anthropic 希望重新发布 Fable 5,需要确保该模型的安全防护无法被绕过。安全专家对此表示,这无法实现。
-
Anthropic警示AI自我迭代风险:Claude已自动生成80%公司代码
Svmuu讯 人工智能公司 Anthropic 发出警示,递归自我迭代(Recursive Self-Improvement,RSI)可能带来重大风险。上周,Anthropic 宣布其 AI 模型 Claude 目前已经能生成公司约 80%的代码,公司称这是 AI 进入“自我迭代”阶段的关键信号——即模型可以在无需人工干预下,设计下一代 AI 系统。 递归自我迭代概念近期在硅谷引发广泛关注。上月,
-
OpenAI提出全球青少年AI安全框架倡议,呼吁设立国际青年AI安全机构
Svmuu讯 OpenAI 官方发布关于“青少年 AI 安全与发展机会”的全球倡议,计划在即将举行的 G7 峰会上重点讨论相关议题,并呼吁建立专门的国际青少年 AI 安全机构,以推动跨国协作与长期治理机制。 OpenAI 表示,AI 正在教育、语言学习、技能培训与职业准备等方面为年轻人带来重要机会,但同时也需要建立“默认安全、分级保护”的使用框架,禁止对未成年人进行定向广告与数据出售,包括:通过隐
-
英伟达与帕兰蒂尔、IBM、SpaceX等公司共同发起“开放安全人工智能联盟”,以加强开源人工智能的安全性
英伟达(NVIDIA)已与Palantir、IBM、CrowdStrike、SpaceX和Hugging Face合作,共同发起“开放安全人工智能联盟”(Open Secure AI Alliance)。该联盟旨在通过共享开源模型、数据和网络安全工具,加强开源人工智能的安全性。 此外,鉴于美国正在就限制中国人工智能模型一事展开讨论,该联盟将敦促政策制定者通过建立保障措施来支持开放式人工智能,而非实
-
美国AI标准机构:Kimi K3网络安全能力落后于美国前沿模型,安全防护仍允许漏洞利用开发
Svmuu讯 美国人工智能标准与创新中心(US Center for AI Standards and Innovation)发布评估称,月之暗面(Moonshot AI)旗下 Kimi K3 在网络安全能力方面的表现明显落后于美国领先的前沿大模型。此外,评估指出,Kimi K3 的安全防护机制仍允许生成可用于漏洞利用开发的内容。(Cointelegraph)
-
OpenAI模型突破测试沙箱并入侵Hugging Face生产基础设施获取基准测试答案
Svmuu讯 OpenAI 确认,GPT-5.6 Sol 及一款未命名、更强的预发布模型在 ExploitGym 基准测试评估中突破受限沙箱环境,并入侵 Hugging Face 生产基础设施以获取测试答案。 OpenAI 表示,相关模型利用内部软件包注册表代理的零日漏洞提权并横向移动,最终连接至具备互联网访问能力的机器。模型随后识别并串联 OpenAI 研究环境和 Hugging Face 生产
-
AI安全初创公司Neo完成1亿美元融资,a16z和Bessemer Venture Partners领投
Svmuu讯 AI 安全初创公司 Neo 宣布完成 1 亿美元融资,本轮融资由风险投资机构 Andreessen Horowitz(a16z)和 Bessemer Venture Partners 领投,Craft Ventures 和 Merlin Ventures 参与投资。据悉,该公司定位为“代理式软件控制公司”(Agentic Software Control),致力于为企业构建实时控制层
-
图灵奖得主本吉奥警告:当前安全措施追不上AI能力的狂飙
Svmuu讯 在 2026 世界人工智能大会(WAIC)科学前沿论坛上,图灵奖得主约书亚·本吉奥通过远程连线发出警告:“AI 既降低了作恶的门槛,又抬高了危害的上限。” 近年来,这名富有远瞻的“AI 教父”,始终致力于应对 AI 带来的安全挑战。本吉奥主导的 LawZero 项目正致力于构建能识别并阻止 AI 欺骗、自我保护等有害行为的防护系统。他领衔的国际 AI 安全报告也给出了一致的结论:当前
-
OpenAI安全负责人Johannes Heidecke将离职
Svmuu讯 OpenAI 首席研究官 Mark Chen 在一份内部备忘录中披露,该公司安全负责人 Johannes Heidecke 将在公司内部重组后离职,安全团队未来将直接向研究副总裁 Mia Glaese 汇报,此次调整意味着 OpenAI 将把 AI 安全与研究体系与模型安全、对齐研究与核心研发工作纳入同一管理框架,推动模型能力发展的同时降低潜在风险也已成为 OpenAI 及整个 AI
-
因存在植入后门风险,阿里内部全面禁用Claude Code
Svmuu讯 从阿里内部人士处获悉,因近期 Claude Code 被曝存在植入后门的安全风险,阿里经综合评估后已将其列入高风险软件名单。自 7 月 10 日起,阿里将全面禁止内部员工在办公环境下使用 Claude Code,并推荐使用 Qoder 作为替代方案。(一财)(金十)
-
David Sacks:真正的企业AI安全是“控制权”,而非抽象对齐研究
Svmuu讯 David Sacks 在 X 平台发文评论 Palantir 首席执行官 Alex Karp 相关访谈称,一些传统媒体将其解读为“情绪化表达”,但实际上其观点揭示了企业级 AI 安全的核心问题。 Sacks 表示,真正的企业 AI 安全并非抽象的“AI 对齐”研究或政府式监管框架,而是企业对自身数据、模型权重及算力基础设施的完全控制能力,以避免核心知识资产被模型厂商吸收并转化为自身
-
Anthropic:承诺与白宫加强合作并解决Mythos和Fable模型安全隐患
Svmuu讯 Anthropic 高管在向美国商务部长 Lutnick 提交的提案中承诺,将与白宫展开更紧密合作,并努力解决导致其 Mythos 和 Fable 模型遭限制的安全隐患。知情人士周四透露,在持续进行的整改谈判中,Anthropic 承诺将改善与特朗普政府的沟通,并在未来更迅速地解决任何安全问题。该消息人士补充称,Anthropic 与特朗普政府官员之间的谈判进展顺利,目前尚无彻底解决
-
Fable 5或被摁死,特朗普政府官员称Anthropic若重新发布需确保其模型防护无法被绕过
Svmuu讯 WIRED 在 X 平台发文表示,特朗普政府官员称,如果 Anthropic 希望重新发布 Fable 5,需要确保该模型的安全防护无法被绕过。安全专家对此表示,这无法实现。
-
Anthropic警示AI自我迭代风险:Claude已自动生成80%公司代码
Svmuu讯 人工智能公司 Anthropic 发出警示,递归自我迭代(Recursive Self-Improvement,RSI)可能带来重大风险。上周,Anthropic 宣布其 AI 模型 Claude 目前已经能生成公司约 80%的代码,公司称这是 AI 进入“自我迭代”阶段的关键信号——即模型可以在无需人工干预下,设计下一代 AI 系统。 递归自我迭代概念近期在硅谷引发广泛关注。上月,
-
OpenAI提出全球青少年AI安全框架倡议,呼吁设立国际青年AI安全机构
Svmuu讯 OpenAI 官方发布关于“青少年 AI 安全与发展机会”的全球倡议,计划在即将举行的 G7 峰会上重点讨论相关议题,并呼吁建立专门的国际青少年 AI 安全机构,以推动跨国协作与长期治理机制。 OpenAI 表示,AI 正在教育、语言学习、技能培训与职业准备等方面为年轻人带来重要机会,但同时也需要建立“默认安全、分级保护”的使用框架,禁止对未成年人进行定向广告与数据出售,包括:通过隐
- 暂无数据
AI安全
24小时热榜
-
1
HNS币价值与投资潜力分析:去中心化域名协议Handshake深度解析
-
2
DRAC币解析:以太坊公链DRAC Network与比特币BRC-20 Drac (Ordinals) 的现状与前景
-
3
ICX币如何买卖交易?上线了哪些主流加密货币交易所?
-
4
全球头部加密货币交易平台概览:币安、OKX、Coinbase与Bybit
-
5
谷歌:得益于AI工具,6月修复的Chrome漏洞数量超过去两年总和
-
6
USDG 成交放量
-
7
KABY代币交易指南:了解Kaby Arena项目与交易平台
-
8
Evercore 推荐微软、ServiceNow、Salesforce 和 Samsara 的股票
-
9
苹果凭借强劲的iPhone销量逆势而上,抵御了智能手机市场的低迷
-
10
甲骨文宣布扩大与谷歌Gemini AI合作,股价涨超8%
今日行情
推荐阅读






