AI工具

Bark – Suno AI 推出的开源文本到音频模型

Bark是什么 Bark是Suno AI 推出的开源文本到音频模型,能生成逼真的多语言语音和多种音频类型,包括音乐、背景噪音等,同时支持非语言交流如笑声和哭泣。Bark...

MARS5-TTS – 开源的AI声音克隆工具,支持140+语言 | AI工具集

MARS5-TTS是什么 MARS5-TTS是CAMB.AI推出开源的AI声音克隆工具,有突破性逼真的韵律,支持140多种语言支持。还能处理复杂韵律场景,如体育解说和动漫AI配音等...

WatermarkRemover – 在线AI背景去除工具 | AI工具集

WatermarkRemover是什么 WatermarkRemover是在线AI背景去除工具,支持PNG、JPEG等多种图片格式。WatermarkRemover通过智能识别技术,快速去除图片背景,同时...

Imagine Yourself – Meta公司推出的个性化AI图像生成模型 | AI工具集

Imagine Yourself是什么 Imagine Yourself 是Meta公司推出的个性化AI图像生成模型,突破了传统方法的局限,无需对每个用户进行单独调整,通过单一模式即可满...

MooER – 摩尔线程推出的业界首个音频理解大模型 | AI工具集

MooER是什么 MooER是摩尔线程推出的业界首个基于国产全功能GPU训练的开源音频理解大模型。不仅能进行中文和英文的语音识别,还具备中译英的语音翻译能力。Moo...

StockBot – 基于Llama3的AI金融Agent,提升股票投资效率 | AI工具集

StockBot 是什么 StockBot 是一个基于Llama3的AI金融Agent,提供实时股票信息、财务数据、新闻和互动图表。支持多资产市场,包括股票、外汇、债券和加密货币...

HeadGAP – 字节跳动推出的3D头像生成模型 | AI工具集

HeadGAP是字节跳动和上海科技大学共同推出的3D头像生成模型,仅用少量图片快速生成逼真的3D头像。采用先验学习和个性化创建阶段的框架,基于大规模多视角动态...

LMMs-Eval – 专为多模态AI模型设计的统一评估框架 | AI工具集

LMMs-Eval是什么 LMMs-Eval 是一个专为多模态AI模型设计的统一评估框架,提供标准化、广泛覆盖且成本效益高的模型性能评估解决方案。包含超过50个任务和10多...

新AutoShorts – 开源的AI视频创作和自动发布平台

新AutoShorts – 开源的AI视频创作和自动发布平台

Still-Moving – DeepMind推出的AI视频生成框架 | AI工具集

Still-Moving是什么 Still-Moving是DeepMind推出的AI视频生成框架,支持用户定制文本到视频(T2V)模型,无需特定视频数据。通过训练轻量级的空间适配器,Still...