博客 | 第 279 页 | AIGC跨境工具导航

ConsiStory – 免训练实现主题一致性的文生图方法 | AI工具集

ConsiStory是什么 ConsiStory是由NVIDIA和特拉维夫大学的研究人员共同开发的一种无需训练的文本生成图像的方法，可以实现让图像在保持风格和主题不变的情况下...

11个月前

Stable Diffusion 3是什么 Stable Diffusion 3 是由 Stability AI 开发的一款先进的文本到图像生成模型，是 Stable Diffusion 系列模型的最新迭代，旨在通过...

11个月前

SDXL-Lightning是什么 SDXL-Lightning是由字节跳动的研究团队推出的一种基于扩散模型的文本到图像生成技术，旨在解决传统扩散模型在图像生成速度和计算成本上...

11个月前

VideoPoet是什么 VideoPoet是由谷歌的研究团队开发的一种基于大模型的AI视频生成方案，支持从文本、图像或视频输入中合成高质量的视频内容，并生成匹配的音频...

11个月前

11个月前

Boximator是什么？ Boximator是由字节跳动的研究团队开发的一种视频合成技术，旨在生成丰富且可控的运动，以增强视频合成的质量和可控性。该技术通过引入两种...

11个月前

11个月前

Depth Anything是什么？ Depth Anything是由来自Tiktok、香港大学和浙江大学的研究人员推出的一个为单目深度估计（Monocular Depth Estimation, MDE）设计的...

11个月前

AnimateDiff是什么？ AnimateDiff是由上海人工智能实验室、香港中文大学和斯坦福大学的研究人员推出的一款将个性化的文本到图像模型扩展为动画生成器的框架，...

11个月前

MotionCtrl是什么 MotionCtrl是由来自腾讯、香港大学、上海AI实验室、清华大学、广东工业大学等机构的研究人员推出的一个为视频生成模型设计的统一且灵活的运...

11个月前