免费 · 本地运行 · 无需联网

你的 AI 创作
只属于你

图像、视频、音频、文档 —— 全部在你的电脑上完成
数据不上传,隐私不妥协,效果不打折

支持 macOS / Windows · Apple Silicon 深度优化

图像 · 视频 · 音频 · 文档 —— 一个全搞定

不用在多个软件之间来回切换

图像

输入文字,生成图片

描述你想要的画面,AI 帮你画出来。支持多种风格:写实、插画、动漫、油画... 还能上传图片让 AI 帮你修改、去背景、换衣服、修复老照片。

  • 10 种图像能力,一个界面搞定
  • 5 个 AI 模型可选,效果各不相同
  • 全部本地运行,设计稿不外传
视频

一句话,从创意到成片

输入一个主题,AI 自动编写剧本、生成旁白、添加字幕、渲染画面 —— 直接输出完整视频。不用剪辑,不用配音,不用找素材。

  • AI 编剧 + 旁白 + 字幕,全自动
  • 字幕逐字同步,像 MV 一样精准
  • 自媒体创作者的效率利器
音频

让文字开口说话

把文字变成自然流畅的语音,支持中英日韩多种语言。还能克隆任何人的声音 —— 录一段样本,就能用这个声音说任何话。

  • 16+ 种音色,男声女声随你选
  • 声音克隆:录 10 秒,复刻任何声音
  • 语音识别:自动转文字,带时间戳
文档

复杂文档,轻松搞定

PDF、论文、合同、报告... 丢给 AI,秒变结构化数据。还能一键生成 PPT 演示文稿,告别熬夜做幻灯片。

  • PDF 精准解析:表格、公式、多栏布局
  • PPT 一键生成:上传文档自动做幻灯片
  • AI 提示词助手:多轮对话优化提示词
AI 助手

内置提示词大师

还在用 ChatGPT 写提示词?我们内置了大模型,直接在生成界面和它对话。告诉它你想要什么,它帮你优化提示词 —— 中英文都能写,一次搞定,不用切换窗口。

  • 多轮对话,越聊越懂你想要什么
  • 中英文双语提示词,一次生成
  • 写完直接点生成,告别复制粘贴
素材库

你的创作,都在这里

所有生成的作品自动归档到素材库。历史参数一键复用,常用风格自动记忆。下次创作直接调用,越用越顺手。

  • 所有作品自动归档,永不丢失
  • 一键复用历史参数,效率翻倍
  • 素材积累越多,创作越快

产品能力

一站式满足你的创作需求

图像

文生图像 输入文字直接生成图像
图生图像 以图片为基础再创作
AI 指令编辑 自然语言描述精准修图
智能修图 局部重绘 · 区域编辑
人脸替换 一键替换人脸
人脸修复 修复模糊人脸细节
黑白上色 老照片智能彩色化
超分辨率 低分辨率图片放大清晰
虚拟试衣 服装穿到模特身上
服装提取 从照片提取服装款式

视频

文生视频 文字描述生成视频
图生视频 图片转动态视频
AI 视频制作 一句话 → AI 编剧 → 成片
视频渲染 逐字字幕 · 旁白同步

音频

语音合成 TTS 多音色多语言可选
语音识别 STT 语音转文字 · 逐字时间戳
声音克隆 复制声音特征 · 跨语言
字级对齐 逐字高亮 · 字幕同步
多语言支持 中 · 英 · 日 · 韩

文档 & 其他

文档解析 PDF 转结构化数据
PPT 生成 一键生成演示文稿
插件系统 社区扩展新能力
对话 / 扩写 内置 LLM 助手 · 扩写改写

为什么选择 ModStackX?

不只是工具,是你的私密创作空间

你的数据,只属于你

所有 AI 处理都在你的电脑上完成。图片、音频、视频 —— 永远不会上传到任何服务器。隐私,是我们最看重的事。

0 次云上传

内置 AI 提示词助手

不用再打开 ChatGPT 写提示词了。内置大模型多轮对话,帮你优化中英文提示词,写完直接生成,一个界面搞定。

告别复制粘贴

50+ 模型,随你切换

同一个功能,5 个不同的 AI 模型任你挑。写实风、插画风、动漫风 —— 换个模型,换个风格,效果立竿见影。

50+ 集成模型

素材库,越用越懂你

所有生成的作品自动归档到素材库。历史参数一键复用,常用风格自动记忆,下次创作直接调用,效率翻倍。

智能积累

一句话,出完整视频

输入一个主题,AI 自动帮你写剧本、配音、加字幕、生成画面。不用学剪辑,不用找素材,一句话搞定。

全自动流水线

像装 App 一样扩展能力

内置 30+ 核心能力还不够?去功能市场逛逛,一键安装新插件。修图、换脸、去水印... 越用越强大。

插件市场

为你的电脑深度优化

Apple Silicon 原生加速,M1/M2/M3 芯片火力全开。智能内存管理,8GB 内存也能流畅运行。

Apple Silicon 优化

持续进化,每周更新

新模型、新功能、新插件 —— 我们每周都在进步。你的创作工具,会越来越强大。

每周更新

适用场景

从创意到落地,ModStackX 陪你完成每一步

设计师 · 批量素材生成

文生图快速产出多风格素材,AI 指令编辑精细调整,虚拟试衣与服装提取加速选款。全程本地运行,设计稿不外传。

短视频 · 一句话出片

输入主题即可 AI 编剧、生成旁白、渲染逐字字幕,一句话完成从创意到成片的全流程。自媒体创作者的效率利器。

播客 · 语音内容制作

TTS 将文章转语音播报,STT 快速出逐字稿,声音克隆保持频道声音一致性。5 个 TTS 模型自由切换。

电商 · 商品图处理

去背景、超分辨率放大、虚拟试衣、黑白上色,电商商品图一站处理。本地运行,产品图不上传第三方。

文档 · PDF 高效解析

复杂 PDF 转结构化 Markdown/JSON,表格、公式、多栏布局精准还原。PPT Agent 上传文档自动生成演示文稿。

老照片 · 修复上色

人脸修复增强画质,黑白照片智能上色,超分辨率放大清晰度。让珍贵记忆重焕新生,全部本地处理。

50+ 集成模型
30+ 核心能力
100% 本地运行
免费 使用无限制

模型生态

集成主流开源模型,持续扩展能力边界

Flux.2 文生图像 · Klein 4B
Z-Image 文生图像 · 中文友好
HiDream AI 指令编辑
Mage-flow 文生图像 · 高质量
Stable Diffusion 图生图像 · 智能修图
GFPGAN 人脸修复 · 面部增强
RealESRGAN 超分辨率放大
Rembg 智能去背景
LTX 文生视频 · 图生视频
Wan 2.1 文生视频 14B
Wan 2.2 文生视频 · MoE 架构
Kokoro TTS · 16 音色 · 6 语言
Qwen3-TTS TTS · 多语言克隆
Spark-TTS TTS · 轻量级
CosyVoice 声音克隆 · 高质量中文
SenseVoice STT · 快速多语言
Paraformer STT · 字级时间戳
MLX Whisper STT · Apple Silicon
MinerU 文档解析 · PDF/公式/表格
DeepSeek V4 Flash LLM · 对话/扩写/编程
Qwen3.5 LLM · 本地对话/扩展
VTON 虚拟试衣 · 服装上身
TryOnDiff 服装提取 · 衣品款式
InsightFace 换脸 · 人脸替换
CodeFormer 老照片修复 · 黑白上色
IOPaint 去水印 · 去物体
PPT Agent 智能生成演示文稿

为 ModStackX 构建插件

开放插件系统,Python 脚本即可扩展新能力 · 敬请期待

开发文档

完整的插件开发指南和最佳实践

API 参考

IPC 协议 · 权限系统 · 模型接口

示例项目

开源示例插件,快速上手二次开发

系统要求

了解你的设备是否满足运行条件

操作系统

macOS 14+ 或 Windows 10+

处理器

Apple Silicon / Intel / AMD x64

内存

最低 8GB,推荐 16GB+

存储空间

磁盘空间 >(约10GB)

加入 ModStackX 社区

获取最新动态、参与讨论、反馈建议,与创作者和开发者一起交流

  • 第一时间获取新功能和模型更新
  • 与开发者直接交流,反馈问题
  • 分享创作作品,获取灵感
  • 参与插件开发,贡献社区
扫码加入 ModStackX 社区

微信扫码加入

准备开始创作?

免费下载,即刻体验本地 AI 的强大

支持 macOS 14+ / Windows 10+ · Apple Silicon 与 x86 优化