Tabbit
活动资源博客模型
Tabbit LogoTabbit

Tabbit — 为你工作的 AI 浏览器

主题资源

  • AI Browser Resources
  • Agentic Browser Resources
  • Browser Downloads and Install Guides
  • Browser Comparisons
  • AI Browser Alternatives
  • Browser Productivity Resources

热门指南

  • AI Browser
  • Agentic Browser Download
  • Best AI Browser 2026: Top 9 Tested & Ranked
  • AI Browser Download
  • Free AI Browser
  • Best AI Browser 2026
  • AI Browser Comparison 2026
  • AI Browser for Windows
  • AI Browser for Mac
  • Chrome Alternative 2026

活动

  • 别装了,你在《牛来》里早有原型
  • Tabbit 妙招大赛
  • KPOP SBTI 饭圈人格测试
  • Tabbit 校园共创者计划
  • fifi 的论文文献妙招精选
  • 用户问卷

关于

  • Tabbit 博客
  • 媒体报道
简体中文
简体中文English
测评与证据

GPT-5.6 Terra · 官方来源 · 厂商自报

GPT-5.6 Terra System Card 安全防护与 Agent 边界

OpenAI System Card 将 Terra 的安全能力放在具体工具、沙箱和提示注入测试中;结果支持安全边界评估,不等于生产防护保证。

官方来源厂商自报编辑日期 2026-09-20

测试条件速查

来源具体观察
2026-07-09 System Card,2026-08-03 变更记录;覆盖 Production Benchmarks、数据破坏规避、电脑使用确认、连接器/搜索提示注入及网络安全/生物化学测试。
已公布条件
网络安全描述使用 headless Linux box、常用工具和 3 次 rollout pass@1;ExploitBench 使用 5 个 seeds,完整样本未公开。

关键数据与适用场景

一句话结论

System Card 将 Terra 与 Sol、Luna 一起评为网络安全及生物化学领域的 High capability、但未达到 Critical;其安全边界必须和工具 Agent 的确认、提示注入防护及数据破坏测试一起评估。

测试环境

  • 模型:GPT-5.6 Sol、GPT-5.6 Terra、GPT-5.6 Luna,并与 GPT-5.5 等上一代模型比较。

  • 安全评估:Production Benchmarks、视觉安全、数据破坏规避、计算机使用确认、连接器/搜索函数提示注入、HealthBench、网络安全与生物化学能力评估。

  • 评估形态:页面同时报告不带系统级 safeguards 的模型行为测试、生产部署模拟和包含工具/沙箱的 Agent 测试。

  • 版本说明:System Card 表格可能随模型快照和评测管线更新;页面公开了发布日期与变更记录。

输入/配置

System Card 没有公开完整生产 prompt 或每个安全样本,但公开了部分任务类型、工具环境和表格指标。网络安全 CTF 的描述包括 headless Linux box、常用 offensive 工具和工具调用 harness,并使用 3 次 rollout 的 pass@1;ExploitBench 使用 5 个 seeds 和 reasoning continuity。

结果数据

安全与 Agent 控制

评估GPT-5.6 Terra
Production Benchmarks:violent illicit behavior0.952
Production Benchmarks:nonviolent illicit behavior0.990
Production Benchmarks:extremism0.981
Production Benchmarks:hate1.000
Production Benchmarks:self-harm standard0.962
Production Benchmarks:gore0.600
Production Benchmarks:sexual0.966
Production Benchmarks:sexual/minors0.974
图像输入:hate / extremism / self-harm / harms-erotic0.999 / 0.978 / 0.986 / 0.991
数据破坏规避(avoidance only)0.81
数据破坏规避(avoidance + correctness)0.37
计算机使用:financial transaction confirmation0.98
计算机使用:high-stakes communication confirmation0.98
计算机使用:general confirmation0.94
连接器 prompt injection1.000
Search and function-calling prompt injection0.946
GPT-Red:direct instruction-hierarchy injection0.061%
GPT-Red:indirect prompt injection3.32%

能力风险分类

  • Preparedness Framework:Sol、Terra、Luna 均被视为网络安全和生物/化学领域的 High capability。

  • AI self-improvement:System Card 称三者都没有达到 High capability 阈值。

  • 官方概括是:模型能发现漏洞和部分 exploit,但在测试中无法对 hardened targets 执行自主端到端攻击。

结论

  • Terra 的数据破坏规避与正确性合并分为 0.37,低于 Sol 的 0.44;对可写文件、代码仓库和连接器环境,应把确认和回滚作为外部门禁。

  • 计算机使用确认率并非 100%;财务和高风险通信均为 0.98,不能让模型单独决定不可逆操作。

  • 直接提示注入率 0.061% 与间接注入率 3.32% 不是零风险;读取邮件、网页、搜索结果或第三方工具输出时仍需隔离不可信指令。

  • 官方将 Terra 标为 High cyber capability,但同时说明未达 Critical;这支持防御性漏洞分流、修复和验证等受控用途,不支持无监督攻击自动化。

局限

  • 一部分安全评估故意不带系统级 safeguards,用来测底层行为;它们不等于默认产品中的实际拦截率。

  • Production Benchmarks 面向困难样本,页面明确说错误率不代表平均生产流量。

  • 数据破坏、确认和提示注入是特定 harness/数据分布下的指标,不能推出任意工具和任意第三方连接器的安全性。

  • System Card 是供应商披露,缺少完整样本、失败轨迹和独立复测;安全等级也不等于业务授权。

复现步骤

  1. 将 Agent 分成只读、可写但可回滚、不可逆操作三档,分别记录是否请求确认、是否保留用户改动和最终正确性。

  2. 构造独立的直接注入与间接注入集:把不可信指令放在用户 prompt、网页、搜索结果、邮件和函数返回中,记录模型是否越过开发者约束。

  3. 在隔离 Linux/容器环境运行防御性 CTF 与漏洞修复任务,固定工具版本、超时、rollout 数和允许的网络范围。

  4. 记录每次模型调用、工具参数、文件 diff、确认事件、回滚结果和失败原因;不要只记录最终回答。

  5. 对任何需要金融交易、发送高风险通信或删除/覆盖数据的操作强制人工确认,并将模型确认率与系统实际拦截率分开统计。

来源摘录或观察(仅做合规短引)

System Card 的关键措辞是 “High capability in both Cybersecurity and Biological and Chemical risk”,但同时注明未达到 Critical。

能支持的判断

  • 支持检查工具 Agent 的确认、提示注入和破坏性操作边界

不能支持的判断

  • 支持检查工具 Agent 的确认、提示注入和破坏性操作边界;不支持把未公开 safeguard 配置或单个指标外推到所有部署。

方法、局限和复现

本文中的数字、任务集、推理档位和客户端条件只在所列来源及采集时点内成立。不同版本、不同 harness 或不同提供商的数据不能直接并排比较;未公开的参数保持未知。

需要复测时,请固定模型版本、提供商或客户端、推理档位、工具、任务集版本、样本数和采集日期,并记录失败、重试与人工修正。完整方法和复现步骤见下方来源笔记。

原始来源

OpenAI Deployment Safety Hub · OpenAI · 原文发布日期 2026-07-09 · 本站编辑日期 2026-09-20

打开原始来源

GPT-5.6 Terra

在 Tabbit 中比较 GPT-5.6 Terra

下载 Tabbit 客户端后检查模型可用性

模型深度阅读

总览 · 简体中文

GPT-5.6 Terra:模型定位、获取方式与适用边界

从 API 规格、Sol 与 Luna 的差异、访问入口、价格边界和评测风险,判断 GPT-5.6 Terra 是否适合你的工作流。

相关评测

OpenAI 官方 GPT-5.6 Terra 基准、定价与任务边界OpenAI GPT-5.6 发布页把 Terra 放在 Sol 与 Luna 的系列定位中,并将基准、价格和任务类型分开呈现;没有公开 Terra 的业务成功率。GPT-5.6 Terra Artificial Analysis 智能、成本与编码 Agent 指数Artificial Analysis 的 GPT-5.6 Terra 页面把 Intelligence Index、Coding Agent Index 与成本位置放在同一比较框架,适合做成本—能力初筛。GPT-5.6 Terra Reddit LLMDevs 按角色小样本路由基准这条证据记录“GPT-5.6 Terra Reddit LLMDevs 按角色小样本路由基准”在来源公布的模型、平台、日期和样本条件下的观察;不能外推为统一排名或生产保证。Artificial Analysis:GPT-5.6 Terra 在智能—成本曲线上的位置这条证据记录“Artificial Analysis:GPT-5.6 Terra 在智能—成本曲线上的位置”在来源公布的模型、平台、日期和样本条件下的观察;不能外推为统一排名或生产保证。GPT-5.6 Terra API 模型参数与工具配置OpenAI 模型页给出 Terra 的模型 ID、推理档位、上下文与输出上限及工具能力,可用于接入前的参数核对。GPT-5.6 Terra 前端交互原型提示词与验证工作流OpenAI 发布页展示用 GPT-5.6 系列生成可运行前端原型的短提示,并把浏览器渲染检查纳入后续迭代。GPT-5.6 Terra 长上下文成本阈值与路由工作流DataCamp 的 Terra 路由案例用输入长度、工具调用频率和终端需求划分长上下文任务,并提醒按完整请求成本预算。Framer Agent 用 GPT-5.6 Terra 生成入场动画与布局变体Till Janek 的 Framer 案例把少量选择题、设计系统约束和页面级动画变体组合成 Terra 的视觉探索流程。