该项目基于 emzimmer 的原始 server-moz-readability 实现。 (对于原始的README文档,请参阅 原始README.md。)
此Python实现将原始概念调整为使用FastMCP运行的基于Python的MCP。
这是一个基于Model Context Protocol (MCP)的Python实现的服务器,用于提取并转换网页内容为干净、适合LLM处理的Markdown。
与简单的获取请求不同,该服务器:
git clone https://github.com/jmh108/MCP-server-readability-python.git
cd MCP-server-readability-python
python -m venv venv
source venv/bin/activate # 在Windows上使用:venv\Scripts\activate
pip install -r requirements.txt
fastmcp run server.py
curl -X POST http://localhost:8000/tools/extract_content \
-H "Content-Type: application/json" \
-d '{"url": "https://example.com/article"}'
extract_content抓取并转换网页内容为干净的Markdown。
参数:
{
"url": {
"type": "string",
"description": "要解析的网站URL",
"required": true
}
}
返回值:
{
"content": "Markdown内容..."
}
要配置MCP服务器,在您的MCP设置文件中添加以下内容:
{
"mcpServers": {
"readability": {
"command": "fastmcp",
"args": ["run", "server.py"],
"env": {}
}
}
}
然后可以使用MCP协议启动服务器,并通过parse工具访问它。
MIT许可证 - 详情见LICENSE。