modelscope·@PsychArch/minimax-mcp-tools
一种MCP服务器实现,它与Minimax API集成,以在Windsurf和Cursor等编辑器中提供由AI驱动的图像生成和文本转语音功能。

这是一个集成了 Minimax API 的模型上下文协议 (MCP) 服务器实现,用于基于 AI 的图像生成和文本转语音功能。
创建或更新您的 MCP 配置文件:
~/.codeium/windsurf/mcp_config.json~/.cursor/config/mcp_config.json两个编辑器使用相同的配置格式:
{
"mcpServers": {
"minimax-mcp-tools": {
"command": "npx",
"args": [
"minimax-mcp-tools"
],
"env": {
"MINIMAX_API_KEY": "your-minimax-api-key",
"MINIMAX_GROUP_ID": "your-minimax-group-id"
}
}
}
}
根据文本提示生成图像:
// Example parameters for image generation
{
"prompt": "A mountain landscape at sunset",
"aspectRatio": "16:9",
"n": 1,
"outputFile": "/absolute/path/to/image.jpg",
"subjectReference": "/path/to/reference.jpg" // Optional: local file or URL
}
参数:
prompt(必需):要生成的图像的描述outputFile(必需):保存生成图像文件的绝对路径。目录必须已经存在。当生成多个图像(n>1)时,文件名将以顺序编号(例如 'image-1.jpg', 'image-2.jpg')。aspectRatio(可选):图像的宽高比(默认:"1:1",选项:"1:1", "16:9", "4:3", "3:2", "2:3", "3:4", "9:16", "21:9")n(可选):要生成的图像数量(默认:1,范围:1-9)。当 n>1 时,输出文件名将自动编号。subjectReference(可选):本地图像文件的路径或用于角色参考的公共 URL。提供时,生成的图像将以此作为角色外观的参考。支持的格式:JPG, JPEG, PNG使用各种自定义选项将文本转换为语音:
// Example parameters for text-to-speech
{
"text": "Hello, this is a test of the text-to-speech functionality.",
"model": "speech-02-hd",
"voiceId": "female-shaonv",
"speed": 1.0,
"volume": 1.0,
"pitch": 0,
"emotion": "happy",
"format": "mp3",
"outputFile": "/absolute/path/to/audio.mp3",
"subtitleEnable": true
}
text (必需): 要转换为语音的文本(最多10,000个字符)outputFile (必需): 保存生成的音频文件的绝对路径model (可选): 使用的模型版本(默认: "speech-02-hd", 选项: "speech-02-hd", "speech-02-turbo")
speech-02-hd: 高清模型,具有出色的音色相似性、节奏稳定性和录音室级音质speech-02-turbo: 快速模型,性能优秀且延迟低,增强了多语言能力voiceId (可选): 使用的声音ID(默认: "male-qn-qingse")speed (可选): 语速(默认: 1.0, 范围: 0.5-2.0)volume (可选): 音量(默认: 1.0, 范围: 0.1-10.0)pitch (可选): 音调(默认: 0, 范围: -12 到 12)emotion (可选): 语音的情绪(默认: "neutral", 选项: "happy", "sad", "angry", "fearful", "disgusted", "surprised", "neutral")timberWeights (可选): 声音混合设置,允许混合最多4种不同的声音及其权重
"timberWeights": [
{ "voice_id": "male-qn-qingse", "weight": 70 },
{ "voice_id": "female-shaonv", "weight": 30 }
]
format (可选): 音频格式(默认: "mp3", 选项: "mp3", "pcm", "flac", "wav")sampleRate (可选): 采样率(Hz,默认: 32000, 选项: 8000, 16000, 22050, 24000, 32000, 44100)bitrate (可选): MP3格式的比特率(默认: 128000, 选项: 32000, 64000, 128000, 256000)channel (可选): 音频声道数(默认: 1, 选项: 1=单声道, 2=立体声)latexRead (可选): 是否读取LaTeX公式(默认: false)pronunciationDict (可选): 发音替换列表
"pronunciationDict": ["处理/(chu3)(li3)", "危险/dangerous"]
stream (可选): 是否使用流模式(默认: false)languageBoost (可选): 加强特定语言的识别
subtitleEnable (可选): 是否启用字幕生成(默认: false)MIT
欢迎贡献!请随时提交Pull Request。
ModelContextProtocol服务器适用于Magic UI,它通过提供诸如跑马灯、动画、特效和互动背景等组件的代码,使AI助手能够轻松为Web应用程序实现UI组件。
一个提供网页开发工具的MCP服务器,例如屏幕捕捉功能,可以让AI代理获取并处理用户屏幕的截图。
一个由人工智能驱动的工具,可以从自然语言描述生成现代UI组件,并与流行的IDE集成,以简化UI开发工作流程。
通过模型上下文协议(MCP)将Blender连接到Claude AI,使Claude能够直接与Blender交互并对其进行控制,从而实现AI辅助的3D建模、场景操作和渲染。
集成了Dify AI API,为Ant Design组件提供代码生成服务,支持文本和图像输入,并具备流式处理能力。
一种模型上下文协议服务器,提供创建、管理和导出Excalidraw绘图的API功能,支持SVG、PNG和JSON等多种格式。