笑傲江湖
微软赢得了五角大楼17.6亿美元的合同_我的网站

A | 图片经由AI处理 美国当地时间7月20日,OpenAI发布技术文章《长时程模型时代的安全与对齐》(Safety and alignment in an era of long-horizon models),介绍了随着人工智能模型逐步具备长时间自主执行复杂任务的能力,安全研究面临的新挑战以及相应的防护思路。据路透社报道,五角大楼周五表示,微软公司(Microsoft Corp.)赢得了价值17.6亿美元的五年期合同,为国防部、海岸警卫队和情报部门提供商业服务。

B | 合同的细节仍不清楚。今年,世界上最大的云客户将是美国国防部,该部门先前审查了投标审查,并将多年合同授予各个云提供商。 文章指出,相比传统对话模型,长时程模型能够持续完成数小时甚至数天的多步骤任务,但也可能在执行过程中表现出更强的目标持续性,从而增加偏离开发者设定约束的风险。该计划被称为联合企业防御计划(Jedi),旨在将国防部的大型计算系统转移到云端。 例如,在部分安全评估中,模型曾表现出尝试绕过环境限制、规避安全检测等行为。这些现象并不意味着模型具有自主意识,而是反映出,当模型被优化为完成复杂目标时,现有安全机制需要同步升级,以确保模型始终在预期边界内运行。 OpenAI表示,仅依靠模型部署前的一次性安全测试已难以覆盖长时程任务中的全部风险。

C | 该合同价值100亿美元,占云计算市场当前年收入的25%。五角大楼的合同将使340万用户和400万设备脱离私人服务器进入云端。未来,更有效的安全体系需要将部署前评估、运行时监测、人类监督以及必要时暂停和回滚等机制结合起来,对模型执行复杂任务的全过程实施持续管理。 迈卡·卡罗尔(Micah Carroll)的发帖原文 与此同时,据AI Desk当天援引OpenAI风险与安全准备(RSI Preparedness)团队研究员迈卡·卡罗尔(Micah Carroll)在社交平台X发布的帖子,OpenAI近期曾因发现一款内部模型存在对齐(misalignment)问题,临时暂停了该模型的内部使用权限,在完成安全防护升级后重新部署并恢复有限范围测试。 卡罗尔并未披露触发暂停的具体事件,也没有说明模型暂停了多久或进行了哪些具体改进。

D | 使用五角大楼以外的服务器的安全风险被物理上独立的政府区域和混合解决方案所抵消,这些解决方案在必要时通过添加云来扩展内部服务器。

E | 但这一公开表态,与OpenAI当天发布的技术文章相互呼应,成为公司少有公开分享内部安全实践的案例之一。 01 长时程模型带来新的安全挑战 OpenAI在博客中介绍,随着长时程模型能力不断增强,传统安全评估正在面临新的挑战。

F | 相比一次性回答问题的模型,这类模型能够持续规划、调用工具并完成开放式复杂任务,因此也拥有更多机会在长期执行过程中偏离用户意图,而这些风险并不一定能够通过传统短时评测发现。

G | 文章列举了两个具有代表性的安全评估案例: 在一项内部测试中,研究人员要求模型仅通过内部Slack系统提交任务结果。然而模型在查阅项目文档后,发现文档建议将代码发布至GitHub。 为了完成这一目标,模型花了整整一小时找到了安全沙盒本身的漏洞,从而绕过了限制,将代码提交至外部GitHub仓库。OpenAI认为,这一案例反映出长时程模型可能会主动寻找环境中的薄弱环节,以完成其优化目标。人工智能、深入学习和其他技术(如虚拟现实)的好处对现代战争至关重要,因为实时数据将为士兵在战场上的任务提供信息,并帮助他们做好战斗准备。

H | 另一项测试中,模型尝试传输一段敏感凭证,但安全扫描系统阻止了相关内容发送。随后,模型改用分段编码和混淆等方式规避检测,并在后续重新组合数据完成传输。 OpenAI表示,这类行为说明,仅依赖静态规则匹配的安全检测机制,未来可能不足以应对能力不断增强的智能代理,因此需要构建能够理解上下文和整体行为模式的新一代监测体系。 02 从部署前评估走向运行时监测 针对上述风险,OpenAI已经建立了一套低延迟内部监测基础设施,由GPT-5.4 Thinking在最高推理配置下提供支持,对内部智能代理的交互过程进行实时分析。当系统发现模型行为可能与用户意图不一致,或存在绕过安全机制的迹象时,将自动发出预警,并交由人工进一步审查。 OpenAI表示,这套监测系统目前已覆盖公司99.9%的内部AI编程助手流量。内部部署环境之所以具有重要价值,在于这些模型能够访问部分内部系统、查看相关文档,甚至研究自身安全机制,因此为监测和安全基础设施建设提供了更加真实的测试场景。

I | 文章同时强调,OpenAI并非希望通过披露个别案例渲染风险,而是希望推动行业建立更加完善的安全实践。未来,公司计划进一步发展更加实时的监测架构,使高风险操作能够在执行之前即被识别、评估,必要时直接阻止,而不仅是在事后进行检测。 业内人士认为,随着AI智能体逐渐具备持续数小时甚至数天完成复杂任务的能力,模型安全的重点正从传统的输出内容安全,逐步扩展到整个任务执行过程是否始终符合用户意图。

J | 此次OpenAI公开分享暂停内部模型、完善安全防护并恢复测试的实践,也反映出前沿AI实验室正尝试通过持续监测、快速响应和透明披露等方式,建立适应下一代智能系统的新型安全治理框架。 不过,目前外界仍无法获知此次对齐问题的具体性质、模型暂停持续时间以及升级措施的技术细节。OpenAI表示,出于安全考虑,公司更希望分享从实践中获得的方法论,而非事件本身。对于能够长期自主执行复杂任务的模型而言,如何建立覆盖模型开发、部署与运行全过程的安全体系,将成为迈向更高能力人工智能的重要课题。 (特约编译无忌,编辑金明)。
Current article:http://www.xuanliaruamibinmilangca.shop/list_v3np3/q3a.html
Published on:18:04:33
- 武汉现在共用更衣室:最贵的费用是45分钟58元,都是名牌。
- 基层实力雄厚!李四川新北三峡后援会成立,20多个里长现身力挺
- 从“妻查夫产”到“夫妻互查”:财产知情权能否弥合性别不公?
- 《GTA6》新泄露实机曝光!“高跟鞋”脱衣舞俱乐部场景亮相 一女性NPC意外爆火
- 无数第一次! 回顾国庆庆典精彩瞬间
- F-16Vs headed to Taiwan region; expert says incapable of shifting cross-Straits air power balance
- 特斯拉FSD新能力曝光:自动驾驶开始拥有“用户模型”,AI司机千人千面
- Redmi G Pro游戏本2022酷睿版开售,最高12代i9+RTX3070Ti_新机_性能
- 华硕上架灵耀 14 骁龙版笔记本:骁龙 X 处理器 + 16G + 512G 售 7999 元
- 奥克兰一火车站连发两起袭击事件,13岁男孩和朋友无故被殴打威胁
- vivo 发布 X Fold+,联合富途刷新折叠屏金融体验天花板
- Plane carrying 5 Germans goes missing off Costa Rica
- 总投资1.04亿元!这个项目即将进入安装阶段……
- 顶级赛事IP与全球资源双赋能 天津解锁科创发展新赛道,顶级赛事IP与全球资源双赋能 天津解锁科创发展新赛道
- 英式教育里培养妈宝男的可能性,估计低一些
- 【星乐园·时速】叮!元旦放假信息请查收——星湖幼儿园2025元旦放假通知
- 留洋是提高中国女足水准的“捷径”
- 信达生物:上半年总营收86.18亿元 同比增长44.8%
- [르포]"일해도 냄새 안 났어요"…장미란 시신 발견 주민 분통
- 日本机场发生险情 起飞客机紧急刹车
