科研栈 · 可控执行

可控执行:用计划、权限与审批约束科研智能体

能调用工具的智能体不仅会生成文字,也可能读取资料、保存结果或触发动作。可控执行把计划审阅、权限确认、运行环境和边界说明放在任务链中。

计划批准和单步权限是两层控制

计划模式用于先检查整体方案;工具权限用于决定具体调用是否逐次确认。即使减少单步确认,计划卡和高影响动作仍可以保留人工批准。

在受控环境中执行

需要运行代码或处理文件的能力应在受控 Sandbox 中执行,并受时间、资源、网络和可用工具限制。执行成功不等于科研结论正确。

让边界在操作前可见

涉及敏感资料、保存修改、外部网站、正式发布或不可逆动作时,应先说明范围、预期副作用和需要的权限。资料缺失时应报告阻塞,而不是猜测。

研究者可以停止和复核

任务应保留当前步骤、工具结果和错误状态,便于研究者中止、调整计划或缩小权限。自动授权只减少交互,不取消研究责任。

可验证的产品能力

以下能力均可在当前公开帮助文档中核查具体入口、使用方式与边界。

工具权限模式

人工审核适合首次使用、敏感资料或保存修改;自动授权只减少确认步骤。

查看工具权限

计划模式审批

复杂任务先只读调研,计划卡批准后才进入后续执行。

查看计划模式

公开技能风险边界

SkillHub 详情展示来源、版本和风险提示,公开状态不等于自动获得应用执行准入。

了解技能准入

常见问题

自动授权是否代表所有操作都不再询问?

不代表。它只减少部分工具调用的确认步骤;计划批准、账号权限、受控环境和产品边界仍然生效。

Sandbox 能保证代码或结果安全吗?

受控环境可以限制执行范围,但不能保证代码逻辑、输入数据和科研结论正确。运行结果仍需检查。

什么时候应使用人工审核?

首次使用新能力、处理未公开资料、保存或修改资源、连接外部服务、或者动作可能产生副作用时,应优先使用人工审核。

把当前研究任务带进工作台

从一个明确问题开始,连接需要的文献与文件,先检查计划和权限,再逐步核查证据与产出。

打开攻玉工作台