
Browser Task
- 9 installs
- 1.9k repo stars
- Updated August 5, 2026
- openakita/openakita
Helps with ai & agent building tasks.
About
browser-task is a Claude Code skill for ai & agent building. It helps solo builders move faster with AI-assisted coding.
- browser-task
- AI & Agent Building
- AI-coding skill
Browser Task by the numbers
- 9 all-time installs (skills.sh)
- +2 installs in the week ending Aug 4, 2026 (Skillselion tracking)
- Ranked #12,152 of 16,546 AI & Agent Building skills by installs in the Skillselion catalog
- Data as of Aug 5, 2026 (Skillselion catalog sync)
npx skills add https://github.com/openakita/openakita --skill browser-taskAdd your badge
Show developers this skill is listed on Skillselion. Paste this into your README.
| Installs | 9 |
|---|---|
| repo stars | ★ 1.9k |
| Last updated | August 5, 2026 |
| Repository | openakita/openakita ↗ |
What it does
Helps with ai & agent building tasks.
Files
browser_task - 智能浏览器任务
推荐优先使用 - 这是浏览器操作的首选工具。
基于 browser-use 开源项目实现。
用法
browser_task(
task="要完成的任务描述",
max_steps=15 # 可选,默认 15
)参数
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| task | string | 是 | 任务描述,用自然语言描述你想完成的操作 |
| max_steps | integer | 否 | 最大执行步骤数,默认 15 |
何时使用(优先)
- 任何涉及多步骤的浏览器操作
- 网页搜索、表单填写、信息提取
- 不确定具体操作步骤时
- 复杂的网页交互流程
示例
搜索任务
browser_task(task="打开百度搜索福建福州天气")表单填写
browser_task(task="打开 example.com 的注册页面,填写用户名 test123")信息提取
browser_task(task="打开 GitHub 首页,获取今日热门项目的名称")截图任务
browser_task(task="打开百度搜索福建福州,截图保存")浏览器 & 网站操作工具选用指引
系统提供多条路径操作网站和浏览器,按场景选择最可靠的方案:
| 场景 | 推荐工具 | 说明 |
|---|---|---|
| 目标网站有 opencli adapter | opencli_run(最可靠) | 确定性命令 + JSON 输出,复用 Chrome 登录态 |
| 需要登录但无 adapter | browser_task → 手动组合 | 先尝试 browser_task,失败则用 click/type 手动操作 |
| 仅需读取网页内容 | web_fetch | 最快最省资源,无需浏览器 |
| 仅需搜索 | web_search | DuckDuckGo 直接搜索 |
| 复杂多步浏览器交互 | browser_task | 适合登录、填表、筛选等 |
| 单步浏览器操作 | browser_navigate/browser_click 等 | 精确控制单个操作 |
| 操作用户已登录的 Chrome | call_mcp_tool("chrome-devtools", ...) | 需用户 Chrome 开启调试端口 |
决策顺序:opencli_run(有 adapter 时)→ web_fetch/web_search(只读时)→ browser_task → 手动 browser_click/type 组合 → chrome-devtools MCP。
何时使用细粒度工具
仅在以下情况使用 browser_navigate、browser_click 等细粒度工具:
browser_task执行失败需要手动介入- 仅需单步操作(如只截图
browser_screenshot) - 需要精确控制特定元素
返回值
{
"success": true,
"result": {
"task": "打开百度搜索福建福州",
"steps_taken": 5,
"final_result": "搜索完成,已显示福建福州相关结果",
"message": "任务完成: 打开百度搜索福建福州"
}
}注意事项
1. 任务描述要清晰具体,避免歧义 2. 复杂任务可能需要增加 max_steps 3. 首次使用会自动启动浏览器(可见模式) 4. 自动继承系统 LLM 配置,无需额外配置 API Key
技术细节
- 通过 CDP (Chrome DevTools Protocol) 复用 OpenAkita 已启动的浏览器
- 自动继承 OpenAkita 系统配置的 LLM(来自 llm_endpoints.json)
- 基于 browser-use 开源项目
高级:操作用户已打开的 Chrome
如果想让 OpenAkita 操作你已打开的 Chrome 页面,需要以调试模式启动 Chrome:
Windows:
"C:\Program Files\Google\Chrome\Application\chrome.exe" --remote-debugging-port=9222macOS:
/Applications/Google\ Chrome.app/Contents/MacOS/Google\ Chrome --remote-debugging-port=9222Linux:
google-chrome --remote-debugging-port=9222启动后,OpenAkita 会自动检测并连接,可以操作你已打开的标签页。
相关技能
browser_screenshot- 单独截图browser_navigate- 单独导航deliver_artifacts- 发送结果给用户
interface:
display_name: Browser Task
short_description: 智能浏览器任务 - 描述任务,自动完成(推荐优先使用)
default_prompt: Use $browser-task
i18n:
zh:
name: 浏览器任务
description: 智能浏览器任务——描述任务目标,自动完成操作(推荐优先使用)。