返回市场
像素世界-MCP

像素世界-MCP

作者:PixVerseAI30 星标更新:2025-10-22

项目介绍

技术文档摘要

PixVerse MCP

<div align="left"> <a href="https://app.pixverse.ai" style="margin: 2px"> <img alt="Webapp" src="https://img.shields.io/badge/PixVerse-Web-3961F1?style=flat-square&labelColor=2C3E50" style="display: inline-block; vertical-align: middle;"/> </a> <a href="https://platform.pixverse.ai?utm_source=github&utm_medium=readme&utm_campaign=mcp" style="margin: 2px"> <img alt="API" src="https://img.shields.io/badge/PixVerse-API-3961F1?style=flat-square&labelColor=2C3E50" style="display: inline-block; vertical-align: middle;"/> </a> </div>

一个全面的工具,允许您通过支持模型上下文协议(MCP)的应用程序(如Claude或Cursor)访问PixVerse最新的视频生成模型。从文本生成视频、动画图像、创建过渡效果、添加唇同步、音效等!

中文文档

https://github.com/user-attachments/assets/08ce90b7-2591-4256-aff2-9cc51e156d00

概览

PixVerse MCP是一个强大的工具,它使您能够通过支持模型上下文协议(MCP)的应用程序访问PixVerse最新的视频生成模型。这种集成允许您生成具有高级功能的高质量视频,包括文本到视频、图像到视频、视频扩展、过渡效果、唇同步、音效等。

主要特性

  • 文本到视频生成:使用文本提示生成创意视频
  • 图像到视频动画:将静态图像转换成动态视频
  • 灵活参数控制:调整视频质量、长度、宽高比等
  • 视频扩展:无缝延长现有视频以形成更长序列
  • 场景过渡:在不同图像之间创建平滑过渡
  • 唇同步:为带有语音合成(TTS)或自定义音频的视频头部添加真实的唇同步
  • 音效:根据视频内容生成情境音效
  • 融合视频:将多个主体组合到一个场景中(仅限v4.5)
  • 资源管理:从本地文件或URL上传图像和视频
  • 与AI助手协同创作:与像Claude这样的AI模型合作,增强您的创作流程

系统组件

系统由两个主要组件组成:

  1. UVX MCP服务器
    • 基于Python的云服务器
    • 直接与PixVerse API通信
    • 提供完整的视频生成能力

安装与配置

先决条件

  1. Python 3.10或更高版本
  2. UV/UVX
  3. PixVerse API密钥:从PixVerse平台获取(此功能需要购买API积分,可在PixVerse平台上单独购买)

获取依赖项

  1. Python

    • 从官方Python网站下载并安装
    • 确保Python已添加到系统路径中
  2. UV/UVX

    • 安装uv并设置我们的Python项目和环境:

Mac/Linux

curl -LsSf https://astral.sh/uv/install.sh | sh

Windows

powershell -ExecutionPolicy ByPass -c "irm https://astral.sh/uv/install.ps1 | iex"

如何使用MCP服务器

1. 获取PixVerse API密钥

2. 下载所需依赖项

  • Python:安装Python 3.10或以上版本
  • UV/UVX:安装最新稳定的UV及UVX版本

3. 配置MCP客户端

  • 打开您的MCP客户端(例如桌面版Claude或Cursor)
  • 查找客户端设置
  • 打开mcp_config.json(或相关配置文件)
  • 根据您使用的配置方法添加配置:
{
  "mcpServers": {
    "PixVerse": {
      "command": "uvx",
      "args": [
        "pixverse-mcp"
      ],
      "env": {
        "PIXVERSE_API_KEY": "your-api-key-here"
      }
    }
  }
}
  • 将从platform.pixverse.ai获取的API密钥添加到"PIXVERSE_API_KEY": "xxxx"
  • 保存配置文件

5. 重启MCP客户端或刷新MCP服务器

  • 完全关闭并重新打开您的MCP客户端
  • 或者如果支持的话,使用“刷新MCP服务器”选项

客户端特定配置

Claude桌面版

  1. 打开Claude应用程序
  2. 导航至Claude > 设置 > 开发者 > 编辑配置
  3. 打开claude_desktop_config.json文件
    • Windows
    • Mac : ~/Library/Application\ Support/Claude/claude_desktop_config.json
  4. 添加上述配置并保存
  5. 重启Claude
    • 如果连接成功:首页不会显示任何错误,MCP状态会变为绿色
    • 如果连接失败:首页会显示错误消息

Cursor

  1. 打开Cursor应用程序
  2. 转到设置 > 模型上下文协议
  3. 添加新服务器
  4. 填写服务器详情,如同JSON配置中的信息
  5. 保存并重启或刷新MCP服务器

高级用法示例

文本到视频

使用Claude或Cursor中的自然语言提示来生成视频。

基本示例

生成一段夕阳照耀海洋的视频。金色阳光反射在水面上,波浪轻轻拍打着岸边。

带参数的高级示例

生成一段夜景城市视频,参数如下:
内容:高楼大厦在夜空中闪烁,车灯在道路上形成光轨
宽高比:16:9
质量:540p
时长:5秒
运动模式:正常
负面提示:模糊、抖动、文字

支持的参数

  • 宽高比:16:9, 4:3, 1:1, 3:4, 9:16
  • 时长:5s或8s
  • 质量:360p, 540p, 720p, 1080p
  • 运动模式:正常或快速

脚本+视频

使用详细的场景描述或镜头列表来创建结构化的视频。

场景描述示例

场景:清晨的海滩。
太阳正在升起,金色的光线照射在海面上。
脚印延伸到沙滩上。
轻柔的波浪在退去时留下白色的泡沫。
远处有一艘小船缓缓驶过平静的海面。
宽高比:16:9,质量:540p,时长:5秒。

逐镜头示例

基于这个故事板生成视频:
- 开始:俯视镜头拍摄一杯冒着蒸汽的咖啡
- 特写:咖啡表面的涟漪和纹理
- 过渡:搅拌产生漩涡
- 结束:杯子旁边的一本打开的书和一副眼镜
格式:1:1正方形,质量:540p,运动:快速
  • Claude桌面版也支持故事板图像输入。

一键视频

快速生成特定主题或风格的视频,无需详细描述。

主题示例

生成一段未来科技主题的视频,包括霓虹灯和全息投影。

风格示例

生成一段水彩风格的视频,展示盛开的花朵,色彩明亮梦幻。

创意+视频

结合AI的创造力进行视频生成。

风格转移示例

这是一张城市景观的照片。用复古风格重新诠释,并提供视频提示。

故事提示示例

如果这张街道照片是电影的开场场景,接下来会发生什么?提供一个简短的视频概念。

情感场景示例

看看这张森林小径的照片,设计一个简短的视频概念,可以是一个微故事或一个情感进展的场景。

功能使用指南

文本到视频

生成一段夕阳照耀海洋的视频,金色阳光反射在水面上

带参数的示例

提示:"一只雄鹰在日出时分翱翔在山峰之上"
质量:720p
时长:5
模型:v5
宽高比:16:9

参数:质量(360p-1080p),时长(5s/8s),宽高比(16:9/1:1/9:16),模型(v4.5/v5)

图像到视频

1. 上传图像 → 获取img_id
2. 使用img_id生成动画视频

带参数的示例

提示:"角色穿过一棵棵发光的树的魔法森林"
img_id:12345
质量:720p
时长:5s
模型:v5

视频扩展

使用source_video_id扩展现有视频

带参数的示例

提示:"场景继续,角色发现了一个隐藏的洞穴"
source_video_id:67890
时长:5s
质量:720p
模型:v5

场景过渡

上传两张图像以创建平滑过渡动画

带参数的示例

提示:"从阳光明媚的海滩过渡到暴风雨的夜晚天空"
第一帧图像:11111
最后一帧图像:22222
时长:5s
质量:720p
模型:v5

唇同步

视频:
TTS:选择说话人 + 输入文本
音频:上传音频文件 + 视频

带参数的示例

# 方法1:生成视频 + TTS
source_video_id:33333
lip_sync_tts_speaker_id:"speaker_001"
lip_sync_tts_content:"欢迎来到我们精彩的视频教程"

# 方法2:生成视频 + 自定义音频
source_video_id:33333
audio_media_id:44444

# 方法3:上传视频 + TTS
video_media_id:55555  # 先上传您的视频
lip_sync_tts_speaker_id:"speaker_002"
lip_sync_tts_content:"这是自定义旁白"

# 方法4:上传视频 + 自定义音频
video_media_id:55555  # 先上传您的视频
audio_media_id:44444  # 先上传您的音频

音效

描述效果:"海浪声、海鸥叫声、轻风"

带参数的示例

# 方法1:生成视频 + 音效
sound_effect_content:"轻柔的海浪声、海鸥叫声、柔和的风"
source_video_id:55555
original_sound_switch:true  # 保留原始音频

# 方法2:上传视频 + 音效
sound_effect_content:"城市交通声、脚步声、城市氛围"
video_media_id:66666  # 先上传您的视频
original_sound_switch:false  # 替换原始音频

# 方法3:完全替换音频
sound_effect_content:"史诗般的交响乐、雷鸣、戏剧性的紧张感"
video_media_id:77777  # 先上传您的视频
original_sound_switch:false  # 替换为新音频

融合视频

上传多张图像,使用@ref_name引用
示例:@person站在@city前,@drone在头顶飞行

带参数的示例

提示:"@hero站在@city前,@drone在头顶飞行"
图像引用:[
  {类型:"主体", img_id:66666, ref_name:"hero"},
  {类型:"背景", img_id:77777, ref_name:"city"},
  {类型:"主体", img_id:88888, ref_name:"drone"}
]
时长:5s
模型:v4.5
质量:720p
宽高比:16:9

📊 状态监控

每6秒检查一次video_id的状态直到完成

带参数的示例

video_id:99999
# 每6秒检查一次,直到状态变为"已完成"或"失败"
# 通常生成时间:60-120秒

状态:待处理 → 正在处理 → 已完成/失败

常见问题解答

如何获取PixVerse API密钥?

  • 在PixVerse平台上注册,并在账户下的"API-KEY"中生成。

如果服务器没有响应怎么办?

  1. 检查您的API密钥是否有效
  2. 确认配置文件路径正确
  3. 查看错误日志(通常在Claude或Cursor的日志文件夹中)

MCP是否支持图像到视频或关键帧功能?

  • 尚不支持。这些功能仅可通过PixVerse API获得。API文档

如何获得积分?

  • 如果您尚未在API平台上充值,请先进行充值。PixVerse平台

支持哪些视频格式和大小?

  • PixVerse支持从360p到1080p的分辨率,以及从9:16(竖屏)到16:9(横屏)的宽高比。
  • 我们建议从540p和5秒的视频开始测试输出质量。

生成的视频在哪里可以找到?

  • 您将收到一个链接,用于查看、下载或分享视频。

视频生成需要多长时间?

  • 通常30秒到2分钟,具体取决于复杂度、服务器负载和网络状况。

遇到spawn uvx ENOENT错误怎么办?

  • 这个错误通常是由于UV/UVX安装路径不正确引起的。您可以按照以下步骤解决:

对于Mac/Linux:

sudo cp ./uvx /usr/local/bin

对于Windows:

  1. 在终端运行以下命令以确定UV/UVX的安装路径:
where uvx
  1. 打开文件资源管理器并定位到uvx/uv文件。
  2. 将文件移动到以下目录之一:
    • C:\Program Files (x86) 或 C:\Program Files

社区与支持

社区

  • 加入我们的Discord服务器,接收更新、分享创作、寻求帮助或提供反馈。

技术支持

发行说明

v2.0.0(最新)

  • 新增:图像到视频动画
  • 新增:视频扩展以形成更长序列
  • 新增:图像之间的场景过渡
  • 新增:与TTS和自定义音频的唇同步
  • 新增:AI生成的音效
  • 新增:复合场景的融合视频
  • 新增:TTS说话人选择
  • 新增:资源上传(图像/视频)通过文件或URL
  • 新增:实时状态监控
  • 改进:增强错误处理和用户反馈
  • 改进:支持并行视频生成

v1.0.0

  • 支持通过MCP进行文本到视频生成
  • 实现视频链接检索
  • 与Claude和Cursor集成以增强工作流程
  • 支持基于云的Python MCP服务器