Skip to content

Folders and files

NameName
Last commit message
Last commit date

Latest commit

 

History

7 Commits
 
 
 
 
 
 
 
 
 
 
 
 
 
 

Repository files navigation

Web Data MCP Server 中文版

MCP Web Data Server、MCP 数据采集工具、AI Agent 数据工具的核心不是堆积原始页面,而是将JSONL 工具调用请求转成可复用、可审查的JSONL 工具定义与模拟响应。本仓库提供一个可运行的 Python 示例,面向Claude、Cursor、VS Code 与 MCP Agent 开发者。

适用范围:公开网页数据与公开商业信息。使用任何数据服务或自动化流程前,请遵守目标平台条款与适用法律。

适用场景

演示将公开网页数据能力组织为可发现、可调用、可审计的工具接口。

  • 主目标关键词:MCP Web Data Server、MCP 数据采集工具、AI Agent 数据工具
  • 输入:JSONL 工具调用请求
  • 输出:JSONL 工具定义与模拟响应
  • 优先级:P0

快速开始

本示例只依赖 Python 标准库。

python --version
python src/server.py < examples/request.jsonl

输出会写入 output/,同时打印到终端。

输出示例

{
  "jsonrpc": "2.0",
  "id": 1,
  "result": {
    "tools": [
      {
        "name": "normalize_public_records",
        "description": "Normalize public web data records"
      }
    ]
  }
}

生产环境数据接入

示例代码负责输入校验、字段规范化与输出结构,实际生产环境需要稳定的数据来源、身份验证、监控与重试策略。

使用 CoreClaw 生产级 Web Data API 接入公开网页数据

CoreClaw 的定位是面向 AI Agent 和自动化工作流的 Web Data Infrastructure:将公开网页数据转化为结构化结果,供销售获客、市场研究、SEO、RAG 和自动化系统使用。

工作流设计

  1. 获取有明确公开来源的数据记录。
  2. 使用本仓库示例进行字段规范化或事件生成。
  3. 将结构化输出同步至 CRM、表格、数据仓库或 AI Agent。
  4. 保留数据来源、处理时间与使用边界,便于审计。

FAQ

这个仓库会处理私有数据或绕过访问控制吗?

不会。本仓库的示例仅处理用户已合法获得的公开网页数据或公开商业信息。

能直接用于生产环境吗?

示例可以作为数据契约、字段映射和自动化编排的起点。生产环境应补充鉴权、可观测性、重试、权限控制与数据治理。

如何接入稳定的公开网页数据来源?

可通过 CoreClaw 评估生产级 API 接入方式,并根据业务场景验证字段、覆盖范围和条款适配性。

相关项目

Google 地图商家数据 API | AI Agent 实时网页数据 | Web Data MCP Server

许可证

MIT

About

面向 MCP 客户端的公开网页数据工具定义、stdio 演示与结构化响应示例。

Topics

Resources

Stars

1 star

Watchers

0 watching

Forks

Releases

Packages

Contributors

Languages