文生图 & 图生图
输入描述即可生成任意风格的图像,支持图生图、局部编辑、智能扩图。本地运行,无需排队。
用 AI 加速你的创作流程
输入描述即可生成任意风格的图像,支持图生图、局部编辑、智能扩图。本地运行,无需排队。
文字转语音、语音识别、声音克隆 — 支持多种中英文模型,本地处理,延迟极低。
从文字描述生成视频,或对现有视频进行剪辑、加封面、转场合并、去除口头禅等操作。
一站式满足你的创作需求
不止是工具,是不断进化的本地创作伙伴
所有 AI 处理在本地完成,你的文件从不离开你的电脑
断网也能用,无延迟无排队,不受服务器状态影响
同一能力提供 3-5 个模型选择,按需切换找到最适合的
输入主题 → AI 编剧 → 旁白 → 字幕 → 成片,一句话完成
AI 智能体自动化执行创作流水线,一句话完成复杂任务
插件系统 + 模型市场,按需安装新能力
macOS MLX 加速 + Windows DirectX 优化,充分发挥本地算力
快速迭代,持续集成最新 AI 模型和能力
图像、视频、音频、文档,全链路创作流程一网打尽
视频字幕逐字高亮同步,Paraformer 字级时间戳精度
从创意到落地,ModStackX 陪你完成每一步
文生图快速产出多风格素材,AI 指令编辑精细调整,虚拟试衣与服装提取加速选款。全程本地运行,设计稿不外传。
输入主题即可 AI 编剧、生成旁白、渲染逐字字幕,一句话完成从创意到成片的全流程。自媒体创作者的效率利器。
TTS 将文章转语音播报,STT 快速出逐字稿,声音克隆保持频道声音一致性。5 个 TTS 模型自由切换。
去背景、超分辨率放大、虚拟试衣、黑白上色,电商商品图一站处理。本地运行,产品图不上传第三方。
复杂 PDF 转结构化 Markdown/JSON,表格、公式、多栏布局精准还原。PPT Agent 上传文档自动生成演示文稿。
人脸修复增强画质,黑白照片智能上色,超分辨率放大清晰度。让珍贵记忆重焕新生,全部本地处理。
集成主流开源模型,持续扩展能力边界
开放插件系统,Python 脚本即可扩展新能力 · 敬请期待
完整的插件开发指南和最佳实践
IPC 协议 · 权限系统 · 模型接口
开源示例插件,快速上手二次开发
了解你的设备是否满足运行条件
macOS 14+ 或 Windows 10+
Apple Silicon / Intel / AMD x64
最低 8GB,推荐 16GB+
首次使用需下载模型(约 30-50GB)
获取最新动态、参与讨论、反馈建议,与创作者和开发者一起交流
微信扫码加入