一个全面的工具,允许您通过支持模型上下文协议(MCP)的应用程序(如Claude或Cursor)访问PixVerse最新的视频生成模型。从文本生成视频、动画图像、创建过渡效果、添加唇同步、音效等!
https://github.com/user-attachments/assets/08ce90b7-2591-4256-aff2-9cc51e156d00
PixVerse MCP是一个强大的工具,它使您能够通过支持模型上下文协议(MCP)的应用程序访问PixVerse最新的视频生成模型。这种集成允许您生成具有高级功能的高质量视频,包括文本到视频、图像到视频、视频扩展、过渡效果、唇同步、音效等。
系统由两个主要组件组成:
Python:
UV/UVX:
curl -LsSf https://astral.sh/uv/install.sh | sh
powershell -ExecutionPolicy ByPass -c "irm https://astral.sh/uv/install.ps1 | iex"
{
"mcpServers": {
"PixVerse": {
"command": "uvx",
"args": [
"pixverse-mcp"
],
"env": {
"PIXVERSE_API_KEY": "your-api-key-here"
}
}
}
}
"PIXVERSE_API_KEY": "xxxx"下使用Claude或Cursor中的自然语言提示来生成视频。
基本示例:
生成一段夕阳照耀海洋的视频。金色阳光反射在水面上,波浪轻轻拍打着岸边。
带参数的高级示例:
生成一段夜景城市视频,参数如下:
内容:高楼大厦在夜空中闪烁,车灯在道路上形成光轨
宽高比:16:9
质量:540p
时长:5秒
运动模式:正常
负面提示:模糊、抖动、文字
支持的参数:
使用详细的场景描述或镜头列表来创建结构化的视频。
场景描述示例:
场景:清晨的海滩。
太阳正在升起,金色的光线照射在海面上。
脚印延伸到沙滩上。
轻柔的波浪在退去时留下白色的泡沫。
远处有一艘小船缓缓驶过平静的海面。
宽高比:16:9,质量:540p,时长:5秒。
逐镜头示例:
基于这个故事板生成视频:
- 开始:俯视镜头拍摄一杯冒着蒸汽的咖啡
- 特写:咖啡表面的涟漪和纹理
- 过渡:搅拌产生漩涡
- 结束:杯子旁边的一本打开的书和一副眼镜
格式:1:1正方形,质量:540p,运动:快速
快速生成特定主题或风格的视频,无需详细描述。
主题示例:
生成一段未来科技主题的视频,包括霓虹灯和全息投影。
风格示例:
生成一段水彩风格的视频,展示盛开的花朵,色彩明亮梦幻。
结合AI的创造力进行视频生成。
风格转移示例:
这是一张城市景观的照片。用复古风格重新诠释,并提供视频提示。
故事提示示例:
如果这张街道照片是电影的开场场景,接下来会发生什么?提供一个简短的视频概念。
情感场景示例:
看看这张森林小径的照片,设计一个简短的视频概念,可以是一个微故事或一个情感进展的场景。
生成一段夕阳照耀海洋的视频,金色阳光反射在水面上
带参数的示例:
提示:"一只雄鹰在日出时分翱翔在山峰之上"
质量:720p
时长:5
模型:v5
宽高比:16:9
参数:质量(360p-1080p),时长(5s/8s),宽高比(16:9/1:1/9:16),模型(v4.5/v5)
1. 上传图像 → 获取img_id
2. 使用img_id生成动画视频
带参数的示例:
提示:"角色穿过一棵棵发光的树的魔法森林"
img_id:12345
质量:720p
时长:5s
模型:v5
使用source_video_id扩展现有视频
带参数的示例:
提示:"场景继续,角色发现了一个隐藏的洞穴"
source_video_id:67890
时长:5s
质量:720p
模型:v5
上传两张图像以创建平滑过渡动画
带参数的示例:
提示:"从阳光明媚的海滩过渡到暴风雨的夜晚天空"
第一帧图像:11111
最后一帧图像:22222
时长:5s
质量:720p
模型:v5
视频:
TTS:选择说话人 + 输入文本
音频:上传音频文件 + 视频
带参数的示例:
# 方法1:生成视频 + TTS
source_video_id:33333
lip_sync_tts_speaker_id:"speaker_001"
lip_sync_tts_content:"欢迎来到我们精彩的视频教程"
# 方法2:生成视频 + 自定义音频
source_video_id:33333
audio_media_id:44444
# 方法3:上传视频 + TTS
video_media_id:55555 # 先上传您的视频
lip_sync_tts_speaker_id:"speaker_002"
lip_sync_tts_content:"这是自定义旁白"
# 方法4:上传视频 + 自定义音频
video_media_id:55555 # 先上传您的视频
audio_media_id:44444 # 先上传您的音频
描述效果:"海浪声、海鸥叫声、轻风"
带参数的示例:
# 方法1:生成视频 + 音效
sound_effect_content:"轻柔的海浪声、海鸥叫声、柔和的风"
source_video_id:55555
original_sound_switch:true # 保留原始音频
# 方法2:上传视频 + 音效
sound_effect_content:"城市交通声、脚步声、城市氛围"
video_media_id:66666 # 先上传您的视频
original_sound_switch:false # 替换原始音频
# 方法3:完全替换音频
sound_effect_content:"史诗般的交响乐、雷鸣、戏剧性的紧张感"
video_media_id:77777 # 先上传您的视频
original_sound_switch:false # 替换为新音频
上传多张图像,使用@ref_name引用
示例:@person站在@city前,@drone在头顶飞行
带参数的示例:
提示:"@hero站在@city前,@drone在头顶飞行"
图像引用:[
{类型:"主体", img_id:66666, ref_name:"hero"},
{类型:"背景", img_id:77777, ref_name:"city"},
{类型:"主体", img_id:88888, ref_name:"drone"}
]
时长:5s
模型:v4.5
质量:720p
宽高比:16:9
每6秒检查一次video_id的状态直到完成
带参数的示例:
video_id:99999
# 每6秒检查一次,直到状态变为"已完成"或"失败"
# 通常生成时间:60-120秒
状态:待处理 → 正在处理 → 已完成/失败
如何获取PixVerse API密钥?
如果服务器没有响应怎么办?
MCP是否支持图像到视频或关键帧功能?
如何获得积分?
支持哪些视频格式和大小?
生成的视频在哪里可以找到?
视频生成需要多长时间?
遇到spawn uvx ENOENT错误怎么办?
对于Mac/Linux:
sudo cp ./uvx /usr/local/bin
对于Windows:
where uvx
v2.0.0(最新)
v1.0.0