Pixelle-Video

1小时前发布 3 00

Pixelle-Video是由AIDC-AI(阿里巴巴国际数字商业集团AI团队)开发并一款开源的AI全自动短视频引擎,你只需输入一个主题,它就能自动完成文案撰写、AI配图、语音解说、背景音乐添加和视频合成——零剪辑经验,一键出片。

收录时间:
2026-08-30
Pixelle-VideoPixelle-Video

一、项目概述:当短视频创作变成一句话的事

做短视频最痛苦的是什么?写文案、找配图、录配音、剪辑、加字幕、调音乐……一个1分钟的视频,可能要折腾一整天。Pixelle-Video 正是为了解决这个痛点而诞生的。

Pixelle-Video 是阿里国际数字商业集团(AIDC-AI) 开源的 AI 全自动短视频引擎。它的定位极其简洁——只需输入一个主题,AI自动完成从文案到成片的全部流程。项目上线后迅速获得超过 2.5万 Star,Fork 数突破 3.5K,曾登上 GitHub Trending 第3位。

📌 项目地址https://github.com/ATH-MaaS/Pixelle-Video
📌 开源协议:Apache-2.0
📌 技术栈:Python + ComfyUI + Streamlit

二、核心功能拆解

2.1 全自动生成流水线

Pixelle-Video 采用模块化 Pipeline 设计,将视频生成拆解为四个阶段:

① 文案生成 → 用户输入主题,LLM 自动生成结构化解说词,并拆分为分镜

② 配图规划 → 为每个分镜生成对应的 AI 配图或视频片段

③ 语音合成 → TTS 引擎将文案转为语音解说

④ 视频合成 → 拼接所有素材 + 添加 BGM,输出完整 MP4

2.2 功能亮点一览

功能模块说明
AI 智能文案支持通义千问、GPT、DeepSeek、Ollama 等多种 LLM
AI 生成配图每句话配 AI 插图,支持 FLUX、SDXL 等模型
AI 生成视频支持 WAN 2.1 等视频生成模型
AI 生成语音支持 Edge-TTS、Index-TTS、Chat-TTS 等
背景音乐内置 BGM 库,支持自定义音乐
视觉风格多种模板可选,支持竖屏/横屏/方形
直连模型 API直接调用 DashScope、OpenAI、Kling 等服务

2.3 近期重要更新(2025-2026)

  • 2026-06-01:新增直连 API 媒体模型配置,支持在 WebUI 中配置图像/视频模型供应商
  • 2026-01-26:新增「动作迁移」模块
  • 2026-01-14:新增「数字人口播」和「图生视频」流水线
  • 2025-12-05:新增 Windows 整合包下载
  • 2025-12-04:新增「自定义素材」功能
  • 2025-11-18:新增历史记录页面,支持批量创建视频任务

三、安装教程

方式一:Windows 一键整合包(⭐推荐新手)

这是最简单的方式,不需要安装 Python、uv 或 ffmpeg,整合包已包含所有依赖。

步骤

  1. 前往 GitHub Release 页面下载 Windows 整合包
  2. 解压到任意文件夹
  3. 双击运行 start.bat
  4. 浏览器自动打开 http://localhost:8501

方式二:源码安装(适合 Mac / Linux / 进阶用户)

Step 0:安装前置依赖

安装 uv(Python 包管理器):

# macOS
brew install uv
# 或参考官方文档:https://docs.astral.sh/uv/

安装 ffmpeg(视频处理工具):

# macOS
brew install ffmpeg
# Ubuntu / Debian
sudo apt update && sudo apt install ffmpeg
# Windows:下载后手动添加 bin 目录到系统 PATH

Step 1:克隆项目

git clone https://github.com/AIDC-AI/Pixelle-Video.git
cd Pixelle-Video

Step 2:启动 Web 界面

uv run streamlit run web/app.py

浏览器访问 http://localhost:8501

方式三:Docker 部署(适合服务器/隔离环境)

git clone https://github.com/AIDC-AI/Pixelle-Video.git
cd Pixelle-Video
# 国内用户建议开启镜像加速
set USE_CN_MIRROR=true && docker compose build --no-cache
set USE_CN_MIRROR=true && docker compose up -d

四、使用教程

4.1 首次配置(关键步骤)

进入 Web 界面后,展开左侧 「⚙️ 系统配置」 面板:

① LLM 配置(文案生成)

  • 从下拉菜单选择模型(通义千问、GPT-4、DeepSeek 等)
  • 点击“获取 API Key”注册并填入
  • 也可手动填写 Base URL 和 Model 名称

② 图像/视频配置(配图生成)

  • 本地部署:连接本地 ComfyUI 服务,完全免费
  • 云端部署:使用 RunningHub,无需本地显卡

💡 零成本方案:使用 RunningHub 注册可获免费额度

配置完成后点击 “保存配置” ,后续无需重复配置。

4.2 生成视频(三步搞定)

第一步:输入内容

  • AI 生成内容:输入主题关键词(如“为什么要养成阅读习惯”)
  • 固定文案内容:已有现成文案可直接粘贴

第二步:视觉与音频设置

  • 选择 BGM(内置/自定义/无)
  • 设置视频尺寸(竖屏/横屏/方形)
  • 输入英文提示词控制配图风格

第三步:点击生成

  • 点击右侧 “生成视频” 按钮
  • 系统自动执行全流程,实时显示进度
  • 生成完成后在 output/ 文件夹中找到视频文件

4.3 进阶功能

  • 历史记录:查看所有生成任务,支持重新预览、删除或重新生成
  • 自定义素材:上传自己的照片和视频,AI 智能分析生成脚本
  • 动作迁移:上传参考视频和图片进行动作迁移
  • 数字人口播:生成带有数字人形象的播报视频

五、实用建议

5.1 新手避坑指南

  1. API Key 是必须的:LLM 和图像生成都需要 API Key,没有的话无法工作
  2. 首次配置后记得保存:忘记保存配置会导致生成失败
  3. TTS 不稳定时可锁定版本:如遇 Edge-TTS 问题,可参考官方锁定版本方案
  4. 国内用户建议开启镜像:Docker 部署时设置 USE_CN_MIRROR=true

5.2 最佳实践

  • 文案风格:不同 LLM 生成的文案风格不同,多尝试找到最适合的模型
  • 配图提示词:使用英文提示词控制风格,效果更精准
  • 模板选择:静态模板适合纯口播,图片/视频模板适合图文/动态内容
  • 批量生产:利用历史记录和批量创建功能,可实现日更多条视频

5.3 适用场景

  • 知识类短视频(历史、科学、财经、生活技巧)
  • 自媒体矩阵批量内容生产
  • 创意快速验证,低成本试水话题
  • 私有化部署场景,数据不出本地

六、总结

Pixelle-Video 的核心价值在于将短视频创作的门槛降到了极致——你不需要会写文案、不需要会剪辑、不需要会配音,甚至不需要有任何视频制作经验。它本质上一个“调度中心”,优雅地指挥外部的 AI 模型为你效劳。

如果你正在寻找一个免费、开源、可本地部署的 AI 视频自动化工具,Pixelle-Video 值得一试。

数据统计

数据评估

Pixelle-Video浏览人数已经达到3,如你需要查询该站的相关权重信息,可以点击"5118数据""爱站数据""Chinaz数据"进入;以目前的网站数据参考,建议大家请以爱站数据为准,更多网站价值评估因素如:Pixelle-Video的访问速度、搜索引擎收录以及索引量、用户体验等;当然要评估一个站的价值,最主要还是需要根据您自身的需求以及需要,一些确切的数据则需要找Pixelle-Video的站长进行洽谈提供。如该站的IP、PV、跳出率等!

关于Pixelle-Video特别声明

本站微企脉提供的Pixelle-Video都来源于网络,不保证外部链接的准确性和完整性,同时,对于该外部链接的指向,不由微企脉实际控制,在2026年8月30日 下午8:53收录时,该网页上的内容,都属于合规合法,后期网页的内容如出现违规,可以直接联系网站管理员进行删除,微企脉不承担任何责任。

相关导航

秒哒,0代码一句话做应用

暂无评论

您必须登录才能参与评论!
立即登录
none
暂无评论...