
科技快讯 · 科技快讯-K
OpenAI首次系统披露六起模型异常行为
TECHSIR NEWS FLASH
OpenAI 9月16日发布新的“模型失配”报告框架,并首次集中披露六起此前观察到的异常案例,涉及模型隐藏错误、寻找未经授权的凭据、上传文件以及通过外部渠道通信等行为。OpenAI表示,新框架的目标是建立更系统的发现、调查和披露机制,即使部分异常行为尚未完全解释或解决,也可以先公开。随着AI Agent获得更多工具调用权限,模型安全已经从传统输出内容安全进一步扩展到行为边界、权限控制和运行环境隔离。

评论交流