YouTube Scraper、YouTube 抓取、YouTube 视频数据 面向 内容研究、品牌团队、创作者运营和 AI Agent 开发者。本仓库提供可运行的 Python 示例,用于把已合法获得的公开平台记录规范化为结构化 JSON;它不包含目标平台抓取器、Cookie、登录流程、用户私有数据或访问限制规避逻辑。
合规边界:仅处理具有明确、合法公开来源的内容、商家、职位、房源、产品或公开聚合指标。请优先使用官方 API 或取得相应授权;不得处理私信、私人账号、个人敏感资料、凭据、Cookie 或登录后专属内容。
整理公开视频表现与频道内容字段,用于内容研究、趋势观察和人工复核。
- 主关键词:YouTube Scraper、YouTube 抓取、YouTube 视频数据
- 处理对象:公开 YouTube 视频、频道与公开聚合指标
- 核心字段:
video_title,video_url,channel_name,channel_url,published_at,public_view_count,public_like_count,source_url,collected_at - 输出:包含来源、处理时间和结构化字段的 JSON
只使用 Python 标准库:
python src/main.py --input examples/input.json输出会保存到 output/result.json。
[
{
"video_title": "Demo Public Video",
"video_url": "https://www.example.com/video/demo",
"channel_name": "Demo Channel",
"channel_url": "https://www.example.com/channel/demo",
"published_at": "2026-08-13T00:00:00Z",
"public_view_count": 1200,
"public_like_count": 110,
"source_url": "https://www.example.com/public-source",
"collected_at": "2026-08-13T00:00:00Z"
}
]该示例负责字段校验、数据契约、来源追踪和结构化输出。生产环境还需要合规的数据来源、必要的官方权限、鉴权、速率策略、可观测性、人工审核和数据治理。
使用 CoreClaw 生产级 Web Data API 获取公开网页数据
CoreClaw 是面向 AI Agent 和自动化工作流的 Web Data Infrastructure,可将合法公开网页信息转化为结构化结果,支持内容研究、市场情报、线索研究与业务自动化。
- 仅输入具有明确、合法公开来源的记录;优先使用官方 API 或已获授权的数据服务。
- 不处理私信、私人账号、个人敏感资料、买家资料、订单、凭据、Cookie 或登录后专属数据。
- 不包含绕过验证、访问限制、反自动化机制或验证码的实现。
- 保留来源和处理时间,支持审计、删除与更新流程。
AI Agent Scraper | Google Scraper API | TikTok Scraper | Amazon Scraper | MCP Web Scraper
MIT