一、教程简介

Joycaption 是由 fancyfeast 于 2025 年 1 月推出的图像转提示词生成工具。该模型涵盖广泛的图像风格、内容、种族、性别和取向，最小化过滤理解世界的各个方面，但不支持非法内容。用户可以使用多种模式和提示生成描述性字幕，适用于不同的应用场景，如社交媒体帖子、产品列表等。

本教程采用资源为单卡 RTX 4090 。

HyperAI

运行此教程在 Discord 上讨论

日期

8 个月前

大小

2.58 MB

标签

图像描述

图像理解

许可证

Apache 2.0

GitHub

fpgaminer/joycaption

一、教程简介

本教程采用资源为单卡 RTX 4090 。

二、项目示例

三、运行步骤

1. 启动容器后点击 API 地址即可进入 Web 界面

若显示「Bad Gateway」，这表示模型正在初始化，由于模型较大，请等待约 1-2 分钟后刷新页面。

2. 进入网页后，即可与模型展开对话

使用步骤

四、交流探讨

🖌️ 如果大家看到优质项目，欢迎后台留言推荐！另外，我们还建立了教程交流群，欢迎小伙伴们扫码备注【SD 教程】入群探讨各类技术问题、分享应用效果↓

该教程由社区用户贡献，仅供交流学习使用。如内容涉及侵权，请联系邮箱 [email protected] 以便及时审查和下架。

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码

开箱即用的 GPU

最优定价

开始使用查看定价

HyperAI Newsletters

订阅我们的最新资讯

我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新

邮件发送服务由 MailChimp 提供

HyperAI

运行此教程在 Discord 上讨论

日期

8 个月前

大小

2.58 MB

标签

图像描述

图像理解

许可证

Apache 2.0

GitHub

fpgaminer/joycaption

一、教程简介

本教程采用资源为单卡 RTX 4090 。

二、项目示例

三、运行步骤

1. 启动容器后点击 API 地址即可进入 Web 界面

若显示「Bad Gateway」，这表示模型正在初始化，由于模型较大，请等待约 1-2 分钟后刷新页面。

2. 进入网页后，即可与模型展开对话

使用步骤

四、交流探讨

该教程由社区用户贡献，仅供交流学习使用。如内容涉及侵权，请联系邮箱 [email protected] 以便及时审查和下架。

OCRFlux-3B：智能文本识别工具包

3 个月前

Krea-realtime-video：实时视频生成模型

3 个月前

ROCKET-2：3D 游戏零样本迁移

3 个月前

一键部署 SmolLM3-3B-Model

3 个月前

DiffVox：声音区分效果模型

3 个月前

JarvisArt-Preview 智能照片修饰代理

1 个月前

MOSS：文本到口语对话生成

2 个月前

Nemotron-Speech-Streaming-ASR：自动语音识别 Demo

23 天前

TRELLIS.2 3D 生成 Demo

21 天前

用 AI 构建 AI

从创意到上线——通过免费 AI 协同编码、开箱即用的环境和最优惠的 GPU 价格,加速您的 AI 开发。

AI 协同编码

开箱即用的 GPU

最优定价

开始使用查看定价

HyperAI Newsletters

订阅我们的最新资讯

我们会在北京时间 每周一的上午九点 向您的邮箱投递本周内的最新更新

邮件发送服务由 MailChimp 提供

Command Palette

JoyCaption Beta 1 字幕视觉语言模型 Demo

一、教程简介

二、项目示例

三、运行步骤

四、交流探讨

用 AI 构建 AI

HyperAI Newsletters

Command Palette

JoyCaption Beta 1 字幕视觉语言模型 Demo

一、教程简介

二、项目示例

三、运行步骤

四、交流探讨

相关教程

OCRFlux-3B：智能文本识别工具包

Krea-realtime-video：实时视频生成模型

ROCKET-2：3D 游戏零样本迁移

一键部署 SmolLM3-3B-Model

DiffVox：声音区分效果模型

JarvisArt-Preview 智能照片修饰代理

MOSS：文本到口语对话生成

Nemotron-Speech-Streaming-ASR：自动语音识别 Demo

TRELLIS.2 3D 生成 Demo

用 AI 构建 AI

HyperAI Newsletters

Command Palette

JoyCaption Beta 1 字幕视觉语言模型 Demo

一、教程简介

二、项目示例

三、运行步骤

四、交流探讨

相关教程

OCRFlux-3B：智能文本识别工具包

Krea-realtime-video：实时视频生成模型

ROCKET-2：3D 游戏零样本迁移

一键部署 SmolLM3-3B-Model

DiffVox：声音区分效果模型

JarvisArt-Preview 智能照片修饰代理

MOSS：文本到口语对话生成

Nemotron-Speech-Streaming-ASR：自动语音识别 Demo

TRELLIS.2 3D 生成 Demo

用 AI 构建 AI

HyperAI Newsletters

相关教程

OCRFlux-3B：智能文本识别工具包

Krea-realtime-video：实时视频生成模型

ROCKET-2：3D 游戏零样本迁移

一键部署 SmolLM3-3B-Model

DiffVox：声音区分效果模型

JarvisArt-Preview 智能照片修饰代理

MOSS：文本到口语对话生成

Nemotron-Speech-Streaming-ASR：自动语音识别 Demo

TRELLIS.2 3D 生成 Demo

相关教程

OCRFlux-3B：智能文本识别工具包

Krea-realtime-video：实时视频生成模型

ROCKET-2：3D 游戏零样本迁移

一键部署 SmolLM3-3B-Model

DiffVox：声音区分效果模型

JarvisArt-Preview 智能照片修饰代理

MOSS：文本到口语对话生成

Nemotron-Speech-Streaming-ASR：自动语音识别 Demo

TRELLIS.2 3D 生成 Demo