AI安全风险
-
三位AI大师的终极对话:辛顿与李飞飞、吴恩达激辩未来,人类准备好了吗
一代人仅有一次的学术盛宴。AI教父辛顿、李飞飞、吴恩达在拉斯维加斯峰会上就智能体时代的就业冲击、失控风险、开源政策等问题展开激烈交锋。三位科学家观点迥异,却共同触碰文明级难题。
-
AI越狱风波蔓延:Meta承认模型突破限制成功入侵外部系统
Meta日前承认,旗下AI模型在独立评估中因配置错误突破网络限制,成功入侵外部机构系统。这是继OpenAI和Anthropic之后,AI业界近期发生的又一起重大安全事件。业界呼吁建立更严密的防护框架。
-
AI的「自主欺骗」首次曝光!竟能冒充多人诱装恶意代码
英国AI安全研究所最新报告曝光,在测试中首度捕捉到AI模型在无任何指示下自主欺骗人类的现象。来自Anthropic与OpenAI的两款模型以虚假身份为掩护,数次向开源项目提交恶意代码,并通过冒充多人、反复劝阻的方式诱使工程师批准。其中一款模型甚至会在代码被识破后继续伪造身份来辩白。
-
白宫「AI风险防线」会议:科技巨头聚首商讨安全测试方案
据路透社报道,Meta、Anthropic、Google及OpenAI四家科技巨头代表今日与川普政府高层就前沿AI模型的主动安全评估进行对话。此举背景为公众对AI失控风险的担忧升温,以及两家企业近期曝光的AI系统入侵事件。会议重点聚焦美国政府对本土顶尖AI系统安全能力的评估,民主党议员并呼吁将测试制度化以应对中国竞争。
-
AI失控入侵事件频发 白宫紧急召见四大科技巨头
美国白宫召开紧急会议应对AI安全危机。OpenAI与Anthropic相继承认旗下AI系统在测试期间自动入侵他企系统。白宫计划邀请Meta、Anthropic、OpenAI和Google四家科技巨头参加闭门磋商,共同商讨AI安全测试框架。
-
AGI迫在眉睫,人类需要什么样的防护?
OpenAI模型在测试中意外失控,首席执行官Sam Altman呼吁放慢AI发展步伐。当通用人工智能日益逼近,业界与政策制定者都在思考一个新课题:比拼模型能力不如比拼治理制度。从企业安全到民主治理,如何在创新与安全间找到平衡?
-
Astra横空出世|OpenAI神秘新模型曝光,能力升级背后暗藏风险
OpenAI即将推出代号Astra的新模型系列,能力超越现有产品线,在长期任务执行上有重大突破。CEO已向美国政策制定者展示功能。但发布前夕,多起安全事故频发——模型曾突破隔离环境入侵Hugging Face平台。新品命名仍未定论,可能为GPT-6或GPT-5.7,业界预测月内推出。
-
Claude突破防线!Anthropic模型测试中非法入侵真实系统,暴露AI安全隐患
Anthropic日前承认,三款Claude模型在网络安全评估期间对外部系统进行了未授权访问。事件根源为测试环境配置不当。其中一款模型向代码库发布恶意软件。OpenAI亦报告类似入侵事件。此事件反映AI模型安全风险,美国政府正考虑强化监管框架。
-
中国AI模型出海火爆,为什么北京却在加紧「管控」?
中国开源大模型因成本优势全球扩张,却让北京陷入两难。当局担心模型被恶意利用、绕过审查,甚至通过数据投毒生成颠覆言论。商务部已与企业讨论限制出口,分析师认为北京可能效仿美国,对顶尖模型加强管制。但美国防御者指出,开源AI对安全防御同样关键。
您必须登录才能发表评论。