资源素材
浏览 496 项 ComfyUI 相关下载与创作资源
混元3D 2.0
使用Hunyuan3D 2.0从单张图像生成3D模型。
混元3D 2.0 多视图
使用Hunyuan3D 2.0 MV从多个视角生成3D模型。
混元3D 2.0 多视图 Turbo
使用Hunyuan3D 2.0 MV Turbo从多个视角生成3D模型。
混元3D:模型重拓扑与UV展开
输入密集网格(来自 AI 生成或摄影测量),输出拓扑良好、UV 已展开的轻量模型,适合 3D 游戏资产优化。
混元3D:UV展开
上传 3D 模型进行 UV 展开,输出 UV 布局优化、便于贴图的模型。
Moge:全景到网格
上传一张等距柱状投影的360°全景图像,生成带有顶点颜色的纹理化GLB网格。
MoGe:透视几何估计
上传图片以估算其透视几何。从输入生成3D深度图和表面法线。
GPT-5.6 Luna
GPT-5.6 Luna 通过分析单张参考图并根据用户提示词生成结构化创意文本,简化了视觉前期制作。它接收1张输入图像,不产生显式视觉输出,专注于快速、标准化的文案撰写。非常适合批量场景描述扩展、镜头列表整理以及高容量创意构思。
GPT-5.6 Terra
使用GPT-5.6 Terra描述一个场景或世界,这是一个平衡的多模态模型,可解读一张上传的图像,以指导视觉叙事和风格一致性。适用于世界构建、情绪板创建以及在一系列作品中保持统一的审美风格。
GPT-5.6: Sol
GPT-5.6 Sol 是一个用于视觉叙事的多模态模型工作流,接收1张输入图像和用户提示词,生成详细的场景描述和叙事序列。非常适合世界构建、多镜头故事板绘制以及在长篇插画或视频项目中保持一致的风格。
Grok: Grok 4.5
Grok 4.5 是旗舰多模态模型,面向复杂工程与创意场景,支持原生视觉解析与高速推理。以创意简报和已生成图像为输入,输出标准化场景描述与迭代视觉分析,适合多镜头分镜、批量图像审查与创意工作流。
Kimi: K3
使用 Kimi K3 生成详细的图像描述与创意简报。该多模态模型支持百万 token 上下文,可统一理解文本与图像。输入一张图像和一个文本提示,即可输出细致的视觉分析或批量描述,适合多镜头视觉系列、节点工作流自动化脚本,以及基于图像反馈迭代优化创意。