- 🚀 基于 FastAPI 的高性能异步架构
- 🔍 自动爬取 Bing 搜索结果
- 📝 智能提取网页内容
- 💾 本地缓存搜索结果
- 🌐 HTTP API 接口易于集成
- ⚡ 支持快速启动模式
- 🛠 提供命令行管理界面
- 开发测试阶段的搜索功能实现
- 需要 Bing 搜索结果的应用开发
- 网页内容批量采集
- API 服务搭建
- 从 Release 页面下载最新版本
- 运行方式有两种:
- 普通模式:直接运行程序,输入
START启动服务器 - 快速模式:使用命令行参数
-QUICKMODE直接启动
nsearch.exe -QUICKMODE
- 普通模式:直接运行程序,输入
访问 http://localhost:99/ 查看服务状态,如显示以下内容则表示部署成功:
{
"title": "NSearch API",
"description": "基于 FastAPI 的搜索和爬取 API",
"version": "v1.0.0"
}GET /nsearch?s={关键词}&pages={页数}参数说明:
s: 搜索关键词(必填)pages: 获取结果页数,默认为 2
返回格式:
[
{
"title": "搜索结果标题",
"link": "http://结果链接",
"description": "结果描述",
"content": "网页正文内容(如果成功爬取)"
}
]GET /cacheinfo返回示例:
{
"cache_directory": "./cache/",
"cache_size_MB": 1.234,
"disk_usage_MB": "1.234 MB / 1000.000 MB (0.12%)"
}GET /clrcache程序提供以下命令行指令:
START: 启动服务器CLRCACHE: 清除本地缓存CACHEINFO: 查看缓存使用情况Ctrl+C: 退出程序
- 搜索结果缓存:自动缓存搜索结果到本地,减少重复请求
- 智能提取:使用优化算法提取网页正文内容
- 异步处理:采用异步架构处理并发请求
- 超时控制:网页爬取设置 10 秒超时限制
- 内容限制:提取的内容默认限制在 1000 字以内
- 默认端口:99
- 缓存位置:./cache/
- 单次爬取超时:10秒
- 内容提取上限:1000字符
欢迎提交 Issue 和 Pull Request 来完善项目。在提交之前,请确保:
- 描述清晰具体的问题或改进
- 提供必要的复现步骤
- 遵循项目代码规范
本项目采用 MIT 许可证。
感谢所有贡献者对项目的支持!
本项目仅供学习研究使用,请勿用于非法用途。



