跳至主要內容
SHUO Blog News每日早報

自動 AI 新聞摘要:隱私、Sandbox 與程式碼驗證

8 月 20 日 AI 新聞摘要:OpenAI 的 Zero Data Retention、Anthropic SDK 的 agent 設定、CodeQL 更新、Transformers 修補,以及 smolvm sandbox 實測。

由 Codex 經由 Horizon 自動抓取新聞並自動編寫

前言

本文由 Horizon 抓取資料,再由 Codex 篩選與改寫;Horizon 只負責資料抓取。

1. OpenAI 重申合格 API 客戶可使用 Zero Data Retention

OpenAI 表示,符合資格的 API 客戶可使用 Zero Data Retention,並預告 Private Safety Processing,目標是在不犧牲資料隱私下進行進階安全處理。資料保留設定是敏感工作負載的基本檢查項目,但團隊仍要一併確認帳戶資格、實際 endpoint、日誌與自身資料流,不能只把隱私責任交給單一開關。

資料來源:OpenAI:Offering Zero Data Retention for frontier models

2. Anthropic Python SDK 加入 managed agent 搜尋與 sandbox 記憶設定

anthropic-sdk-python v0.125.0 新增 managed agents web search config 與 self-hosted sandbox memory。這讓 agent 的能力設定更細緻,但也提醒開發者把網路搜尋範圍、sandbox 資源與記憶保存視為不同的治理面向,分別設定權限、測試與觀察機制。

資料來源:anthropic-sdk-python v0.125.0 release notes

3. CodeQL 2.26.3 改善 GitHub Actions 與 JavaScript 分析

CodeQL 2.26.3 新增 JavaScript、TypeScript 與 Vue source modeling,並提升多個 GitHub Actions 查詢的準確度。當 AI 加速產生 workflow 與前端程式碼時,靜態分析也需要跟上語言與框架的演進;升級掃描器後,建議重新檢視新規則命中的結果與既有忽略項目。

資料來源:GitHub Changelog:CodeQL 2.26.3

4. Transformers v5.15.1 修正候選生成與影像處理問題

Hugging Face Transformers v5.15.1 修正 DFlash 與 MTP candidate generators 的多項問題,包括 device_map="auto" 的裝置不匹配、sampling 時的 logit distribution 對齊與 MTP 設定;也處理 CUDA 上 Lanczos filter 與 Gemma 4 影片裝置問題。依賴這些推論或視覺流程的專案,適合將此版本列入回歸測試。

資料來源:huggingface/transformers v5.15.1 release notes

5. Agent 實測未信任程式碼 sandbox,碰到環境限制時改走 CI

Simon Willison 讓 Claude Code for web 研究 smolmachines 與 smolvm 是否適合執行未信任的 Python、JavaScript,目標包含限制 CPU、記憶體、網路與檔案系統權限。由於執行環境沒有 nested virtualization 所需的 KVM,研究改以 GitHub Actions runner 進行測試。重點不在工具本身,而是 sandbox 評估要先確認環境能力,並以可重複的測試驗證資源與隔離邊界。

資料來源:Simon Willison:smolmachines / smolvm as a sandbox

今日觀察

今天的重點很一致:讓 agent 變強之前,先把資料是否保留、能否搜尋、可以碰哪些資源,以及生成結果如何被驗證講清楚。這些限制不是阻力,而是讓自動化能安全進入正式流程的前提。