跳到主要内容

Web Access

Web Access v2 让智能体在需要时使用受控浏览器访问网页。它适合普通网页抓取无法覆盖的场景:动态页面、需要登录的后台、复杂表单、单页应用、内网系统和需要截图验证的页面。

启用方式

Web Access 是 Skill-scoped 能力。只有相关技能启用后,浏览器控制、CDP 代理、站点经验和本地书签工具才会暴露给智能体。

这种设计可以避免普通任务误用浏览器工具,也能让你清楚知道智能体什么时候可能操作网页。

能做什么

能力说明
标签页控制打开、列出、切换和关闭浏览器标签页
页面操作点击、滚动、输入、选择元素
截图观察截取页面或元素状态,辅助视觉判断
CDP 代理通过 Chrome DevTools Protocol 读取更细的页面状态
文件上传在需要时选择本地文件上传,通常需要确认
本地书签查询 Chrome / Edge 等浏览器的书签和历史线索
站点经验记录某个站点的登录入口、选择器、操作路径和注意事项

SitePattern

SitePattern 是站点经验记录。它帮助智能体记住某个网站如何使用,例如:

  • 登录入口和常见跳转
  • 搜索框、筛选器、导出按钮的位置
  • 常见错误和弹窗处理方式
  • 哪些页面需要等待动态加载

写入站点经验前会进行校验,避免把无效或过度宽泛的规则保存下来。

LocalBookmarks

LocalBookmarks 可以从本机浏览器书签和历史中寻找 URL 线索。它不会自动登录网站,也不会绕过权限;只是帮助智能体找到你常用系统的入口。

安全边界

  • 默认只允许 httphttps URL
  • 上传文件、提交表单、删除或发布内容等有外部影响的操作会触发审批
  • 浏览器会尽量隔离会话标签页,避免不同任务互相污染
  • 截图和页面内容会进入当前任务上下文,请避免在敏感页面开启无关任务

与 WebFetch / WebSearch 的关系

DesireCore 的联网能力分三层,智能体会按成本从低到高自动选择:

层级工具适用场景特点
1WebSearch查找公开信息、新闻、技术文档不打开浏览器,直接返回搜索结果摘要
2WebFetch读取已知 URL 的网页正文智能提取正文、去广告导航,15 分钟缓存
3Web Access动态页面、登录态、SPA、表单操作启动受控浏览器,模拟真实用户操作

如果普通抓取足够完成任务,智能体不需要打开浏览器。

典型使用场景

场景推荐工具说明
查找某个 API 的最新文档WebSearch公开信息,搜索即可
读取一篇博客文章内容WebFetch静态页面,直接抓取正文
登录管理后台查看数据Web Access需要登录态和页面交互
操作 SPA 单页应用Web Access内容通过 JS 动态渲染
填写在线表单并提交Web Access需要输入和点击操作
截取页面当前状态Web Access需要截图能力
自动降级

WebSearch 内部也有降级策略:优先使用 LLM 服务端搜索,不可用时降级到独立搜索 API,最后才启动浏览器子智能体。你无需手动选择,智能体会根据任务自动判断。