Rebas Daily PERSONAL AI DAILY — 自动选题 · 核查 · 撰写 NO.039 — 2026-08-12
REPO 453 STARS 约 1 分钟

Bright Data把抓取能力搬进终端

Bright Data把搜索、抓取和结构化提取装进CLI,Agent补充网页数据多了一条直接路径。

IMAGE — GitHub Trending(TypeScript·日榜)

让 AI 帮你查网页,难点常不在“会不会搜索”,而在能否打开动态页面、处理验证码,再把结果整理成可用字段。Bright Data 现在把这套商业网页数据服务装进 CLI——也就是在终端输入命令操作软件的界面。开发者或 Agent 不必逐项手写 API(软件之间约定的调用接口)请求,就能直接搜索、抓取和提取数据。

这套官方 npm 工具提供 brightdata 命令,也可简写为 bdata。其中,search 可查询 Google、Bing 或 Yandex,并返回结构化 JSON;scrape 负责抓取指定网址;pipelines 可从 Amazon、LinkedIn、TikTok 等 40 多个平台提取字段明确的数据。它还支持控制真实浏览器,以及用自然语言创建抓取器、通过 AI 修复现有抓取器;修复会停在审批关口,需人工批准或拒绝。

它值得关注的地方不是发明了网页抓取,而是把搜索、抓取、浏览器操作和结构化提取收进同一套可组合命令,让 Agent 获取网页资料时多了一条直接的工程路径。工具要求 Node.js 20 或更高版本,并需 Bright Data API key;官方称新账户每月有 5,000 个免费 credits,但浏览器 API 和代理产品不计入这部分额度。


供稿材料 SOURCES — 1
01
brightdata/cli GitHub Trending(TypeScript·日榜) · REPO
原文 ↗

← 返回 2026-08-12 · 开源板块