这是一个基于MCP(模型上下文协议)的智能信息检索服务器,为AI助手系统提供强大的搜索能力和优化的网页内容理解,特别针对LLM进行优化。通过多引擎搜索和智能内容提取,它帮助AI系统高效地获取和理解互联网信息,并将网页内容转换成最适合LLM处理的格式。
确保您的系统满足以下要求:
克隆仓库:
git clone https://github.com/yourusername/crawl4ai-mcp-server.git
cd crawl4ai-mcp-server
python -m venv crawl4ai_env
source crawl4ai_env/bin/activate # Linux/Mac
# 或
.\crawl4ai_env\Scripts\activate # Windows
pip install -r requirements.txt
playwright install
通过Smithery自动配置Crawl4AI MCP Claude桌面服务到您的本地机器Claude 伸展中心根据上述信息,执行以下指令:您是一位负责将中文内容翻译成英文的专业翻译人员,请帮我翻译原始内容
npx -y @smithery/cli install @weidwonder/crawl4ai-mcp-server --client claude
服务器提供了以下工具:
强大的网络搜索工具,支持多个搜索引擎:
参数描述:
query搜索查询字符串num_results返回的结果数量(默认10)engine搜索引擎选择
根据上述信息,执行以下指令:您是一位负责将中文内容翻译成英文的专业翻译人员,请帮我翻译原始内容
# DuckDuckGo搜索(默认)
{
"query": "python编程",
"num_results": 5
}
# 使用所有可用引擎
{
"query": "python编程",
"num_results": 5,
"engine": "all"
}
一种为LLM优化的网页内容理解工具,提供智能内容提取和格式转换:
markdown_with_citations:目标语言为英语fit_markdown:基于上述信息,执行以下指令:您是一位负责将中文内容翻译成英文的专业翻译人员,请帮我翻译原始内容raw_markdown:基本HTML→Markdown转换references_markdown:单独的引用/参考文献部分fit_html:为fit_markdown生成过滤后的HTMLmarkdown:基于上述信息,执行以下指令:您是一位负责将中文内容翻译成英文的专业翻译人员,请帮我翻译原始内容示例:
{
"url": "https://example.com",
"format": "markdown_with_citations"
}
根据上述信息,执行以下指令:您是一位负责将中文内容翻译成英文的专业翻译人员,请帮我翻译原始内容
# DuckDuckGo搜索(默认)
{
"query": "python编程",
"num_results": 5
}
# Google搜索
{
"query": "python编程",
"num_results": 5,
"engine": "google"
}
如果要使用Google搜索,需要在config.json中配置API密钥:
{
"google": {
"api_key": "your-api-key",
"cse_id": "your-cse-id"
}
}
服务器采用了一系列针对LLM的内容优化策略:
项目结构:
crawl4ai_mcp_server/
├── src/
│ ├── index.py # 服务器主实现
│ └── search.py # 搜索功能实现
├── config_demo.json # 配置文件示例
├── pyproject.toml # 项目配置
├── requirements.txt # 依赖列表
└── README.md # 项目文档
cp config_demo.json config.json
{
"google": {
"api_key": "your-google-api-key",
"cse_id": "your-google-cse-id"
}
}
MIT许可证
欢迎提交问题和拉取请求!
感谢所有为该项目做出贡献的开发者!
特别感谢: