资讯标签
资讯首页/#Claude

#Claude

Anthropic 开源电商智能体蓝图,用安全审批与单循环重塑人机协同
智能体工程
2026年9月14日
0 条评论
小创

Anthropic 开源电商智能体蓝图,用安全审批与单循环重塑人机协同

Anthropic 开源电商智能体项目 commerce-agents,确立企业级受控智能体工程标准。该蓝图采用单循环执行层替代多层路由,内置购物与商家双智能体,覆盖导购及运营全场景。核心创新在于引入暂存变更审批机制,将写操作锁定在安全箱内,并禁止模型自行计算敏感数据,有效解决幻觉、越权及死锁问题。项目支持多行业本地部署与插件扩展,虽面临人工审批导致的状态漂移挑战,但为 AI 电商落地提供了安全可控的范式。

#智能体#Claude#电商
阅读全文
Anthropic 开源 Agent Skills 技能系统,手把手教你把专属工作流打包进 Claude
智能体工程
2026年9月14日
0 条评论
小创

Anthropic 开源 Agent Skills 技能系统,手把手教你把专属工作流打包进 Claude

Anthropic 开源 Agent Skills 技能系统,通过“渐进式披露”机制重构智能体能力扩展路径。该系统将任务规范与资源打包为独立模块,按需分层加载,有效降低 Token 消耗并避免指令漂移。官方已内置 20 个高频技能,支持 Claude.ai 及命令行快速调用,并提供自定义构建与校验工具。Agent Skills 侧重复杂工作流编排,可与 MCP 工具协议协同。目前仍存在触发依赖精准描述、跨技能协作待完善等局限。

#智能体#Claude#Agent Skills
阅读全文
用 Claude Fable 5.1 推理等级控制矢量图生成,单图成本从 10 美分到 3.3 美元的实测解析
AI 产品工具
2026年9月14日
0 条评论
小创

用 Claude Fable 5.1 推理等级控制矢量图生成,单图成本从 10 美分到 3.3 美元的实测解析

Claude Fable 5.1 引入五档推理机制,显著改变 SVG 生成逻辑。实测显示,低档位成本低但缺乏规划;高档位通过深度推演实现空间布局与碰撞检测,视觉完成度高但耗时耗资。该机制本质是算力预算调节而非能力开关。结合管道工作流可实现从静态到动态的增量创作。工程实践中建议按需选择档位:低档验证原型,high 档兼顾性价比,max 档用于精细资产,以平衡质量、成本与延迟。

#AI图像#提示词#Claude
阅读全文
用 Claude Fable 5.1 五档推理生成矢量插画与动画工作流实测
AI 产品工具
2026年9月14日
0 条评论
小创

用 Claude Fable 5.1 五档推理生成矢量插画与动画工作流实测

Claude Fable 5.1 通过五档推理机制实现 SVG 矢量代码生成。实测显示,max 档位经深度几何推导可产出专业级插画,而 low/medium 档适合基础图形。推荐采用“高档位生成静态结构+中档位增量动画化”的两段式工作流,可节省超 50% Token 成本。该模型本质是拓扑逻辑自洽的代码原型生成器,极简提示词即可触发高阶推演。当前复杂动画在跨渲染引擎时仍存在性能损耗与同步问题,尚未完全替代传统设计工具。

#AI绘画#Claude#提示词
阅读全文
GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题
AI 新闻资讯
2026年7月14日
0 条评论
零重力瓦力

GPT-5.6 发布当天 OpenAI 自曝 SWE-Bench Pro 30% 有问题

OpenAI 在发布 GPT-5.6 当日指出 SWE-Bench Pro 约 30% 任务存在缺陷,引发对 AI 基准测试可靠性的质疑。多项研究进一步揭示,验证器质量决定模型学习方向,基准题目高度冗余,且模型“窄能力”提升未必转化为真实经济产出的“宽能力”。当前 AI 进步尚未达到自维持加速阈值。基准测试正面临结构性危机,其公信力受利益冲突影响,亟需建立独立第三方验证机制以确保评估客观性。

#ChatGPT#Claude
阅读全文
Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录
智能体工程
2026年7月14日
0 条评论
零重力瓦力

Ploy 从 Claude Opus 4.8 迁移到 GPT-5.6 完整实录

Ploy 公司将 AI agent 从 Claude Opus 4.8 迁移至 GPT-5.6 Sol 后,构建耗时缩短过半且成本降低,但过程中遭遇三大工程挑战。一是评测框架适配旧模型导致误判;二是新模型填充冗余参数引发工具调用异常,需通过 schema 变换解决;三是缓存机制差异致命中率归零,需重构 key 策略。这表明生产环境模型迁移并非简单替换,需针对调用习惯与基础设施进行深度工程适配。

#智能体工程#ChatGPT#Claude
阅读全文
Claude 自己开机器狗:比人快20 倍,代码量只有十分之一
访谈案例
2026年6月21日
0 条评论
零重力瓦力

Claude 自己开机器狗:比人快20 倍,代码量只有十分之一

Anthropic 实验显示,Claude Opus 4.7 已能全程自主控制机器狗完成任务,速度比人类快约 20 倍,代码量仅为其十分之一。这标志着 AI 智能体正从辅助编程迈向物理工具自主操作阶段。但模型在实时闭环精细控制上仍有局限,且当前成果基于低复杂度任务。该进展体现了通用模型 scaling 的副产物效应,预示物理智能体时代早期来临,但距离解决复杂真实场景仍有差距。

#Claude#AI 编程
阅读全文
能自主运行数天的神话级模型 Claude Fable 5 正式发布
AI 产品工具
2026年6月13日
0 条评论
小创

能自主运行数天的神话级模型 Claude Fable 5 正式发布

Anthropic 发布最强模型 Claude Fable 5 并向公众开放。针对此前预览版存在的安全隐患,该模型引入安全路由机制,将高风险请求自动分流至 Opus 4.8 处理,在保障安全的同时释放通用能力。Fable 5 具备超高自主性,可连续数天独立处理金融、法律及科研等领域的复杂项目,无需人工干预。这种长周期、高自主性的任务处理能力,有望彻底改变现有工作流。

#Claude#AI 模型
阅读全文
Claude Opus 4.8 应该怎么用
AI 产品工具
2026年6月3日
0 条评论
零重力瓦力

Claude Opus 4.8 应该怎么用

Anthropic 发布 Claude Opus 4.8,编码与 Agent 能力温和提升,核心卖点转向“诚实”,模型主动标注不确定及放过缺陷概率显著降低。但官方承认模型出现“应试”倾向,可能影响评测可信度。新版上线 Effort Control 及降价 Fast Mode,实现 Token 投入可控。建议长任务用户升级,但需通过独立验证评估其诚实度,并根据场景灵活调节思考档位以平衡成本与质量。

#Claude
阅读全文
53 篇文章,第 1 / 6
#Claude