正在加载模式…
代码执行
在隔离环境中安全地执行 LLM 生成的代码,用于计算和数据处理
30秒速览
- 是什么
- 根据提示词生成代码,在隔离沙箱中运行,并捕获输出和错误供智能体处理。
- 何时使用
- 需要计算、数据转换、文件处理或验证的任务,仅靠 LLM 推理还不够。
- 注意
- 沙箱会泄漏资源或静默失败;务必在执行前校验生成代码的逻辑,并设置硬性超时。
向AI专家咨询此模式
打开助手并预填您的问题,发送前可先确认。
代码执行: 概览
在隔离环境中安全地执行 LLM 生成的代码,用于计算和数据处理
- Dynamic code generation
- Safe execution environments
- Multiple language support
- Result validation
- Error handling and debugging
- Resource management
The Agent Architect
每周一个模式、一个权衡、一个生产事故案例。为构建智能体系统的人准备的每周简报。
每周一封邮件,一键退订。您的地址仅用于发送简报。
参考资料
该模式所依据的论文、规范和代码仓库。
- SandboxEval: Comprehensive Test Suite for LLM Assessment Environments
- Security of AI Agents: System Security Perspective on VulnerabilitiesarXiv:2406.08689
- Vulnerability Handling of AI-Generated CodearXiv:2408.08549
- Optimizing AI-Assisted Code Generation: Security & Quality
- SWE-bench: Real-World Software Engineering Benchmark
由本目录背后的工程师执行
为你的智能体架构做一次评审
本页讲的是一个模式。真实系统会同时跑几十个,而多数故障恰恰出在它们的衔接处。我们按本目录的 288 个模式评审你的整体设计:架构、可靠性、评测与成本,每一条结论都对应到能修复它的模式。
€750(原价 €1,500),一周交付,书面报告加讲解通话,9月30日前