返回市场
米亚米网页搜索-mcp

米亚米网页搜索-mcp

作者:ankushthakur20076 星标更新:2025-11-22

项目介绍

MiyaMi WebSearch MCP

npm 版本 许可证: MIT

将您的大语言模型连接到互联网!使用模型上下文协议搜索网络并从任何网页中提取内容。

🌟 功能

  • 🔍 网络搜索 - 在Google、DuckDuckGo、Bing、Brave、Wikipedia上进行搜索
  • 时间范围过滤器 - 按最近的时间(天、周、月、年)筛选结果 - 新增!
  • 📄 增强的内容提取 - 使用Trafilatura(Firecrawl质量)提取
  • 📝 Markdown 输出 - 从网页获取结构化的Markdown
  • 🎯 丰富的元数据 - 自动提取作者、日期、站点名称
  • 快速且简单 - 一行安装,零配置
  • 🤖 优化的大语言模型 - 格式化响应,适合AI消费
  • 🆓 100% 免费 - 无需API密钥,无需注册,无需配置
  • 🔒 隐私优先 - 不跟踪,不收集数据

📦 安装

选项 1:使用 npx(推荐 - 无需安装)

添加到您的Claude Desktop配置(~/Library/Application Support/Claude/claude_desktop_config.json):

{
  "mcpServers": {
    "miyami-websearch": {
      "command": "npx",
      "args": ["-y", "miyami-websearch-mcp"]
    }
  }
}

选项 2:全局安装

npm install -g miyami-websearch-mcp

然后配置Claude Desktop:

{
  "mcpServers": {
    "miyami-websearch": {
      "command": "miyami-websearch-mcp"
    }
  }
}

就这样! 重启Claude Desktop,您就可以开始搜索网络了!🎉

🚀 快速开始

在添加到Claude Desktop配置并重启后,尝试这些提示:

搜索有关AI的最新新闻
搜索Python教程并总结最佳结果
从https://example.com抓取内容并总结

🛠️ 可用工具

1. web_search

使用多个搜索引擎进行网络搜索,可选时间范围过滤。

参数:

  • query(必需) - 搜索查询
  • categories(可选) - general, news, images, videos, science
  • language(可选) - 语言代码(默认:en)
  • page(可选) - 页面编号(默认:1)
  • time_range(可选) - 新增! 按最近的时间筛选:day, week, month, year

示例:

在新闻类别中搜索“量子计算突破”
搜索过去24小时内的AI新闻,使用time_range: day
查找过去一周的Python教程,使用time_range: week

2. fetch_webpage

使用Trafilatura(Firecrawl质量提取)从任何网页中提取干净的内容。

参数:

  • url(必需) - 网页URL
  • include_links(可选) - 包含链接(默认:true)
  • include_images(可选) - 包含图片(默认:true)
  • max_content_length(可选) - 最大长度(字符数,默认:50_000)
  • format(可选) - 新增! 输出格式:text, markdown(默认),html
  • extraction_mode(可选) - 新增! 引擎:trafilatura(默认,最佳质量),readability(更快)

增强功能:

  • 📝 Markdown 输出 - 获取像Firecrawl那样的结构化Markdown
  • 🎯 丰富的元数据 - 自动提取作者、日期、站点名称
  • 📊 提取统计信息 - 单词计数、内容长度、格式信息

示例:

以markdown格式抓取并总结https://en.wikipedia.org/wiki/Artificial_intelligence

3. search_and_fetch推荐

搜索并自动从顶级结果中抓取完整内容,使用Trafilatura质量提取。

参数:

  • query(必需) - 搜索查询
  • num_results(可选) - 要抓取的结果数量(1-5,默认:3)
  • categories(可选) - 搜索类别
  • time_range(可选) - 新增! 按最近的时间筛选:day, week, month, year
  • format(可选) - 新增! 输出格式:text, markdown(默认),html

它做了什么:

  • ✅ 搜索您的查询(可选时间过滤)
  • ✅ 获取前N个结果
  • ✅ 自动抓取完整内容(并行)
  • ✅ 使用Trafilatura进行Firecrawl质量提取
  • ✅ 返回搜索片段和完整网页内容

示例:

研究“气候变化解决方案”,并给我来自前3个来源的详细信息
获取过去24小时内的人工智能突破性文章(time_range: day, num_results: 5)
研究过去一周的网络开发教程(time_range: week, format: markdown)

💡 使用示例

研究一个主题

使用search_and_fetch研究“通用人工智能最新发展”从前3个结果中,并给我一个全面的总结

获取近期新闻(时间范围过滤)

使用time_range: day搜索过去24小时的AI突破

近期教程(时间范围过滤)

使用time_range: week搜索过去一周的Python教程

抓取Markdown格式

以markdown格式抓取这篇文章:https://example.com/article

研究近期发展

使用search_and_fetch研究“量子计算”从过去一周,使用time_range: week并获取完整的文章内容以markdown格式

查找特定信息

搜索“东京最佳餐厅”并显示前5个结果

多步骤研究

1. 搜索“Python网络爬虫库”
2. 以markdown格式抓取文档页面
3. 解释如何使用它并提供示例

🔧 配置

无需配置! 🎉

此MCP服务器会自动连接到免费公共API。只需将其添加到您的Claude Desktop配置中即可立即使用。

如果您正在寻找高级配置选项,这里没有 - 我们故意保持简单!

🐛 故障排除

“MCP服务器未出现在Claude Desktop”

  1. 检查您的claude_desktop_config.json是否为有效JSON
  2. 完全重启Claude Desktop(退出并重新打开)
  3. 检查Console.app(macOS)中的错误消息

“首次搜索速度慢(30-60秒)”

这是正常的!免费层API在不活动后会休眠。后续请求速度快。

“连接超时”

后台API在Render免费层上运行,可能会唤醒。等待60秒后重试。

“工具无法工作”

  1. 确保已安装Node.js 18+:node --version
  2. 尝试全局安装而不是npx
  3. 检查GitHub问题

📡 API 后端

此MCP服务器连接到免费公共SearXNG API:

注意:不活动后的首次搜索可能需要30-60秒来唤醒服务。这是免费层的正常现象!

🤝 贡献

欢迎贡献!请:

  1. 分叉仓库
  2. 创建功能分支
  3. 进行更改
  4. 提交拉取请求

报告问题

发现bug?打开一个问题

📄 许可证

MIT 许可证 - 详情见LICENSE文件

🌟 星标历史

如果这个工具帮助了您,请给仓库加星!⭐


由❤️为大语言模型社区制作

几秒钟内将您的AI连接到互联网,而不是几个小时。