Anthropic 的模型硬件标准是接口,而不是安全认证
Anthropic 的模型硬件标准为代理提供了通用设备接口,但物理联锁、身份、时序、观测和恢复仍然是外部控制。
分类
13篇文章属于此分类.
Anthropic 的模型硬件标准为代理提供了通用设备接口,但物理联锁、身份、时序、观测和恢复仍然是外部控制。
阅读 Anthropic 的《2026 年 8 月风险报告》时,应区分报告覆盖日期、公司评级、披露的失败、删节内容和外部审查。
Twitch 现在允许创作者拒绝部分未来的 Amazon 生成式 AI 训练,但这个开关并不承诺删除历史数据,也不公开下游执行情况。
只有当审查员能够看到相反证据、暂停自动化路径、推翻自动化决定并纠正实际结果时,工作流中的人员才算进行了有意义的审查。
Cloudflare 现在允许用户为 Wrangler 和 MCP 客户端拒绝可选 OAuth 作用域,但必需权限、令牌处理和工具行为仍是独立风险。
Cloudflare AI Gateway User Insights 可以检测异常的会话成本,但警报无法确定意图、归因每个请求,也无法遏制相关活动。
HarnessRisk 报告不同模型与代理 harness 组合之间存在广泛的安全差异,并发现配置阶段比其测试的其他生命周期阶段更脆弱。
Claude Skills 可以捆绑指令、脚本和依赖。正式可用让不可变版本与运行时边界变得更加重要。
Slack Code 让团队看见编码代理的工作,但 Slack 不负责控制仓库合并、CI 完整性、构建产物或生产部署。
OpenAI 因 Astra 的网络安全担忧暂停前沿训练。了解暂停了什么、新监控如何工作,以及为什么 20% 的估算范围很窄。
Claude 可以标记部分生成的文本和文件,但这些信号证明的是处理历史,而不是作者身份、真实性或完整的第 50 条合规性。
Google 对 Spirit Airlines 数据的竞价涵盖企业消息、代码和运营记录。去标识化解决个人身份问题,但无法单独解决机密性或下游使用问题。
不受信任的 issue 文本在 Snowflake 的 GitHub Actions 工作流中变成了 shell 代码。尽管是一个自主智能体发现并调整了这条路径,但注入方式本身是传统的。