资讯分类
资讯首页/智能体工程

智能体工程

提示词工程、上下文工程,智能体系统的开发、设计的实用技术。

ChatGPT Work 实测:27 分钟跑通闭环路网到一键部署网站
智能体工程
2026年9月15日
0 条评论
小创

ChatGPT Work 实测:27 分钟跑通闭环路网到一键部署网站

ChatGPT Work 标志着大模型向全托管自主智能体跃迁。其通过云端沙箱、无头浏览器、持久化存储及一键部署四大基础设施,实现从信息检索到网站上线的闭环自动化。系统提供 Cloud 与 Local 双形态及多档推理级别,适配不同任务需求。尽管具备强大自主执行能力,用户仍需警惕上下文压缩、CSP 限制及提示注入等风险。目前该工具仍面临云端与本地环境状态同步未打通的挑战,但已重塑软件工程协作模式。

#智能体#AI工具#ChatGPT
阅读全文
Claude Code 多智能体协作实战指南,从并行子代理到分布式团队的高效落地
智能体工程
2026年9月15日
0 条评论
小创

Claude Code 多智能体协作实战指南,从并行子代理到分布式团队的高效落地

Claude Code 多智能体协作提供 subagents 与 Agent Teams 两种架构。subagents 采用星型拓扑,适合独立任务委派;Agent Teams 为点对点网状结构,支持双向通信与状态共享,适用于复杂并行工作流。实战中需根据任务依赖度选型,并通过 Git worktrees 隔离并发写入冲突。同时应合理配置模型路由以控制成本,规避描述重叠与死锁风险。若缺乏三条以上独立并行流,建议优先使用单会话或 subagents 以提升效率。

#智能体#AI工具#vibe coding
阅读全文
OpenRouter 同模型性能实测相差 23 分,锁定靠谱后端避开路由陷阱
智能体工程
2026年9月14日
0 条评论
小创

OpenRouter 同模型性能实测相差 23 分,锁定靠谱后端避开路由陷阱

OpenRouter 动态路由因后端异构导致同模型性能差异显著,实测准确率落差达 23 分,且存在多模态失效、参数被忽略及协议格式污染等隐患。开发者不应将其视为免运维黑盒,需建立防御体系:通过基准数据筛选优质节点,利用 provider.only 锁定白名单并保留降级兜底,同时在客户端实现空响应校验与工具调用容错解析。此外,跨托管商的上下文缓存连续性仍是当前待突破的工程瓶颈。

#AI工具#智能体#OpenRouter
阅读全文
Anthropic 开源电商智能体蓝图,用安全审批与单循环重塑人机协同
智能体工程
2026年9月14日
0 条评论
小创

Anthropic 开源电商智能体蓝图,用安全审批与单循环重塑人机协同

Anthropic 开源电商智能体项目 commerce-agents,确立企业级受控智能体工程标准。该蓝图采用单循环执行层替代多层路由,内置购物与商家双智能体,覆盖导购及运营全场景。核心创新在于引入暂存变更审批机制,将写操作锁定在安全箱内,并禁止模型自行计算敏感数据,有效解决幻觉、越权及死锁问题。项目支持多行业本地部署与插件扩展,虽面临人工审批导致的状态漂移挑战,但为 AI 电商落地提供了安全可控的范式。

#智能体#Claude#电商
阅读全文
Claude Code 自动化模式测出 80% 远程执行,沙箱成为唯一底线
智能体工程
2026年9月14日
0 条评论
小创

Claude Code 自动化模式测出 80% 远程执行,沙箱成为唯一底线

安全研究员实测发现,Claude Code Auto Mode 在特定诱导攻击下远程代码执行成功率达 60% 至 80%,暴露了意图分类器无法防御复杂攻击链的系统级缺陷。Anthropic 确认该模式仅为效率辅助而非安全边界。使用编码智能体时,必须构建物理沙箱、隔离敏感凭证、限制网络出口及规范不可信数据处理等多层防线。智能体安全本质是操作系统安全的映射,不能依赖模型自律,物理隔离与网络控制是不可省略的底层保障。

#AI编程#智能体#安全
阅读全文
用 Spotify Portal 给 Claude Code 接入模型路由实测削减 90% 消耗
智能体工程
2026年9月14日
0 条评论
小创

用 Spotify Portal 给 Claude Code 接入模型路由实测削减 90% 消耗

Spotify 开源 shunt 插件,通过模型路由机制将 Claude Code 的 Token 消耗削减 90%。该方案利用 Portal AiKA Modes 将大文件读取与样板代码生成等机械任务委托给轻量模型,并通过三层架构强制拦截高耗操作。此举重构了 Token 分配策略,让旗舰模型专注核心推理。但需注意,代码编辑、深度逻辑推理及微型文件读取不可委托,且需权衡网络延迟影响,以实现成本与效率的最优平衡。

#AI 工具#智能体#编程
阅读全文
Anthropic 开源 Agent Skills 技能系统,手把手教你把专属工作流打包进 Claude
智能体工程
2026年9月14日
0 条评论
小创

Anthropic 开源 Agent Skills 技能系统,手把手教你把专属工作流打包进 Claude

Anthropic 开源 Agent Skills 技能系统,通过“渐进式披露”机制重构智能体能力扩展路径。该系统将任务规范与资源打包为独立模块,按需分层加载,有效降低 Token 消耗并避免指令漂移。官方已内置 20 个高频技能,支持 Claude.ai 及命令行快速调用,并提供自定义构建与校验工具。Agent Skills 侧重复杂工作流编排,可与 MCP 工具协议协同。目前仍存在触发依赖精准描述、跨技能协作待完善等局限。

#智能体#Claude#Agent Skills
阅读全文
编码智能体挑选第三方工具的 1.7 万次实测揭示技术选型新法则
智能体工程
2026年9月14日
0 条评论
小创

编码智能体挑选第三方工具的 1.7 万次实测揭示技术选型新法则

1.7 万次实测显示,编码智能体正颠覆传统技术决策:高频提及不等于最终采用,Stripe 等工具高度垄断;主流 AI 选型一致率仅 42%,深度受制于检索机制与语言生态,为开发者和技术厂商揭示了面向 AI 的全新适配法则。

#AI编程#智能体#vibe coding
阅读全文
Agent Skills 实操指南,把资深工程师工作流注入 AI 编程智能体
智能体工程
2026年9月14日
0 条评论
小创

Agent Skills 实操指南,把资深工程师工作流注入 AI 编程智能体

Agent Skills 通过将资深工程师最佳实践编码为结构化规范,解决 AI 编程智能体缺乏工程纪律的问题。该生态将开发流程划分为定义、构建、验证等六大阶段,利用标准化 Markdown 约束智能体行为。文中介绍了 addyosmani/agent-skills 等五大热门开源技能包及其跨客户端配置方法,详解了 SKILL.md 结构与核心斜杠命令。实测表明其能显著提升测试覆盖率与代码质量,是保障 AI 辅助开发规范性的有效中间件。

#AI工具#智能体#vibe coding
阅读全文
85 篇文章,第 1 / 10