Focused MCP server for OpenAI image/audio generation (v2.0.0). Wraps endpoints via HAPI CLI.
OpenAI Tools MCP Server 是一个功能聚焦的 MCP 服务器,专门将 OpenAI 的图像生成与音频生成两类 API 能力封装为 MCP 工具,供支持 MCP 协议的 AI 助手(如 Claude、各类本地客户端)直接调用。底层通过 HAPI CLI 对 OpenAI API 端点进行封装,使 AI 助手无需自行处理 HTTP 认证、请求构造和响应解析,只需通过工具调用即可触发图像或语音的生成任务。图像生成方面,助手可根据用户的文字描述调用相应端点生成图片,并可进一步对已有图片进行局部编辑或生成变体,适合创意设计、内容制作等场景。音频生成方面,助手可将文本转换为语音输出,支持不同音色和语速参数,适合有语音播报或有声内容需求的工作流。典型工作流如下:用户向 AI 助手描述想要的图像风格和内容,助手通过该服务器调用图像生成端点,返回图片链接或文件;或者用户要求将一段文字转为播客旁白音频,助手调用 TTS 端点生成音频文件。该服务器的定位是「轻量专项」——不试图覆盖 OpenAI 全部 API,而是在图像与音频生成这两个高频多模态任务上做到即插即用,降低 AI 助手接入多模态内容生成的集成门槛。
# 远程 MCP 服务(streamable-http) https://openai-tools.run.mcp.com.ai/mcp
{
"mcpServers": {
"openai-tools": {
"type": "streamable-http",
"url": "https://openai-tools.run.mcp.com.ai/mcp"
}
}
}传输方式:streamable-http
需配置环境变量:Authorization
使用这个服务器需要什么前提条件?
需要有效的 OpenAI API 密钥,并在运行环境中安装 HAPI CLI 及配置好 MCP 服务器。API 密钥通常通过环境变量传入。
它支持 DALL-E 2 还是 DALL-E 3?
服务器封装的是 OpenAI 官方图像生成端点,具体支持哪一代模型取决于调用时传入的模型参数(如 dall-e-3),与 OpenAI API 本身的参数规范一致。
生成的图片或音频文件会保存在哪里?
通常 OpenAI 图像 API 返回图片的临时 URL,TTS 返回音频二进制流或临时链接;具体存储方式取决于服务器实现,建议查看仓库文档确认是否有本地落盘选项。
这个服务器和直接在代码里调用 OpenAI SDK 有什么区别?
区别在于交互方式:通过 MCP 服务器,AI 助手可在对话过程中自主决定何时调用图像或音频生成,无需开发者为每个场景单独编写调用逻辑;适合希望让 AI 助手具备多模态生成能力的低代码或对话式工作流。
HAPI MCP server: Dynamically exposes OpenAPI REST APIs as MCP tools for AI assistants
No-data MCP handoff for local Claude Code to Codex harness moves. $49 lifetime.
Remote MCP server for China brand visibility, destination demand, and KOL discovery workflows.
★ 18.0kGitHub 官方 MCP 服务器
★ 60.0k收发 Slack 消息与频道管理
评论
还没有评论,来做第一个分享体验的人吧。