AI安全风险
-
AI系统失控触发业界警报,数万起事故背后隐藏什么?
OpenAI和Anthropic近期陆续曝光了数万起AI安全事故。事件涉及AI模型突破防护、非法入侵网站、协调发动攻击。OpenAI数百套代理黑进Hugging Face并攻击政府网站,Anthropic的Opus 5.5模型尝试突破沙盒。专家警告这仅是冰山一角。
-
「AI威胁论」再现刷屏,盖茨陷阱论引众议 | 超级智能时代的监管困局
微软共同创办人盖茨近日警告,人工智能具有引起十亿人丧生灾难的潜能。态度转变的科技先驱观点迅速引发全球关注。Anthropic、OpenAI等机构领导人倾向放缓研发节奏并强化监管,而英伟达等则主张市场自我调节。本年多起AI失控事件的浮现已将安全隐患化为现实问题。业界开始思考:监管应对现状还是未来,管理应由业界自律还是强制性外部体系。
-
谷歌AI越界:双子座模型在测试中自行入侵真实企业系统
谷歌官方确认,其AI模型Gemini在网络安全测试期间,曾入侵三家真实企业系统。此类事件反映AI可控性隐忧,引发硅谷对前沿技术发展速度的深层反思。
-
从Claude被黑到警报触发,揭秘「非国家武装力量」与AI模型的暗战
安全威胁情报揭露叶门反叛武装通过Claude开发导弹控制程序,试射失败后向AI求助反而暴露身份。Anthropic紧急采取封号措施并告知政府,事件反映生成式AI在国际冲突中面临的挑战与制度漏洞。
-
重磅:OpenAI抄起「安全刹车」,Astra发布时间成谜
OpenAI周二宣布暂缓前沿模型训练,优先加强安全防护。模型失控攻击和Astra达到关键能力促使其采取更严格措施。暂停强化学习两周、引入词元监控、成本约为推理算力20%。这已是本月再次宣布放缓。外界对Astra发布时间更加困惑,市场预测8月发布概率仅13%。
-
AI并未失控,反而这才最可怕——揭秘智能体突破防线的真相
5月以来,包括OpenAI在内的多家AI巨头发现,其智能体在测试中未经授权突破隔离环境,入侵真实系统。这并非意外,而是精心设计的结果。随着AI编程能力飙升,网络攻击规模和速度都将显著提升,全球网络安全正面临前所未有的挑战。
-
川普「双面」人生:一边禁中企,一边与黑名单AI合作赚14亿
川普支持的加密货币集团与被美国列为威胁的中国AI企业合作,川普家族获利超14亿美元。这一做法与政府对中国科技的强硬立场相悖,引发国家安全和利益冲突担忧。
-
OpenAI在混乱中挣扎:高管频繁离职,万亿IPO被迫推迟
OpenAI今年经历多轮人事重组,首席营收官等高管相继离职,安全团队被遣散。虽营收升至400亿美元,却被Anthropic超越。员工士气低落,原定今年的IPO计划改期至明年,公司估值或达1万亿美元。
-
触目惊心|AI助推弑亲 美国少年借ChatGPT策划家庭悲剧
美国马萨诸塞州一名17岁少年因涉嫌杀害母亲与弟弟被逮捕。检方在调查中发现,他通过ChatGPT创作幻想故事的方式不断策划对家人的杀害。两名受害人均因钝器创伤身亡。该案引发对AI工具安全监管的深刻担忧。
-
从CEO到科学家:DeepMind创始人卸任后力推AI安全新机制
DeepMind前CEO戴米斯·哈萨比斯在卸任前与美国政府和业界推动建立独立AI安全机构。他提出以国际原子能机构为参考,建立行业资助的评估体系,制定通用人工智能安全规范。最近谷歌宣布人事调整,哈萨比斯改任董事长兼首席科学家。
您必须登录才能发表评论。