标签: AI工具

  • Suno AI 音乐生成器-Suno API

    工具介绍

    Suno API是一个在线Suno AI 音乐生成器,只需要输入歌词、音乐风格和歌曲名字即可以创作独特的 AI MP3 歌曲,免费使用,Suno API基于Python和FastAPI的非官方Suno API,目前支持生成歌曲、歌词等,内置token维护和保活功能,不用担心token过期,体验需要注册登录,提供试用额度。

    工具地址

    演示地址:

    https://sunoai.ai

    GitHub:

    https://github.com/SunoAI-API/Suno-API

  • Hume AI-具备人类情感感知的AI对话机器人

    工具介绍

    Hume AI是一家研究实验室和技术公司,开发了一些自然语言理解工具,可以获取文本、音频、视频或图像,并捕捉情感、动作和其他表达。他们的对话AI产品EVI采用情感大语言模型(eLLM)技术,能够进行流畅的对话并感知用户的情绪变化。EVI注重对话的连贯性和自然性,能够像真人一样停下来听用户说话,使对话体验更接近真实的人际交流。Hume AI的EVI凭借其情感感知能力和流畅的对话体验将对AI对话技术的发展产生深远影响。 此外,Hume AI还提供由同理心 AI 支持的对话式语音API,名为EVI,该API能够测量细微声音调制、指导语言和语音生成。他们的模型基于多年的研究,能够捕捉音频、视频和图像中表达的细微差别,例如笑声中夹杂的情感。同时,Hume AI提供自定义模型API,使用先进的表达测量模型和eLLM的迁移学习,能够准确预测各种结果。这些功能为应用程序提供了同理心和发言权,能够构建定制的见解。

    工具地址

    体验地址:https://demo.hume.ai/ 官网:https://www.hume.ai/ 国外IP打开

  • 开源在线AI漫画生成器-AI Comic Factory AI漫画工厂

    工具介绍

    AI Comic Factory( AI漫画工厂)是一个免费开源的在线AI漫画生成工具/AI漫画生成器,基于Hugging Face平台开发,使用LLM和SDXL技术。用户只需要输入文字描述提示词,AI就能生成精美的漫画作品。该工具支持用户设计漫画书的页面,使每个人都能轻松创作出独一无二的漫画风格照片。

    工具地址

    体验地址:https://aicomicfactory.app/ GitHub:

    https://github.com/jbilcke-hf/ai-comic-factory

  • AI数字人制作工具SadTalker(附教程)

    工具介绍

    AI数字人是一种采用人工智能技术和仿真技术创建的虚拟人物。它结合了人类外貌、语音和认知能力,能够与人类进行交流和互动。AI数字人的外貌通常由计算机图形学和虚拟现实技术生成,可以根据需要设计不同的外表特征、面部表情和肢体语言。

    工具地址

    下载地址:

    夸克网盘

  • 在 Discord 中免费使用 ChatGPT4

    工具介绍

    该项目实现原理是代理 Discord 对话 Coze-Bot,实现以 API 形式请求 GPT4 模型,提供对话、文生图、图生文、知识库检索等功能 完美适配主流开源对话面板如 NextChat、one-api、LobeChat等 Coze 是字节跳动旗下的一个 AI 平台,提供免费 GPT-4

    工具地址

    GitHub:

    https://github.com/deanxv/coze-discord-proxy

  • AI视频生成器 利用大模型-一键生成短视频-MoneyPrinterTurbo

    工具介绍

    MoneyPrinterTurbo是一个AI视频生成器,利用大模型,一键生成短视频,只需提供一个视频 

    主题

     或 

    关键词

     ,就可以全自动生成视频文案、视频素材、视频字幕、视频背景音乐,然后合成一个高清的短视频。由于该项目的 部署 和 使用,对于一些小白用户来说,还是 有一定的门槛,可以使用项目的实例网站体验。

    功能特性

    •  完整的 MVC架构,代码 结构清晰,易于维护,支持API和Web界面
    •  支持视频文案 AI自动生成,也可以自定义文案
    •  支持多种 高清视频 尺寸  竖屏 9:16,1080×1920  横屏 16:9,1920×1080
    •  竖屏 9:16,1080×1920
    •  横屏 16:9,1920×1080
    •  支持 批量视频生成,可以一次生成多个视频,然后选择一个最满意的
    •  支持 视频片段时长设置,方便调节素材切换频率
    •  支持 中文 和 英文 视频文案
    •  支持 多种语音 合成
    •  支持 字幕生成,可以调整 字体、位置、颜色、大小,同时支持字幕描边设置
    •  支持 背景音乐,随机或者指定音乐文件,可设置背景音乐音量
    •  视频素材来源 高清,而且 无版权
    •  支持 OpenAI、moonshot、Azure、gpt4free、one-api 等多种模型接入

    后期计划 📅

    •  GPT-SoVITS 配音支持
    •  优化语音合成,利用大模型,使其合成的声音,更加自然,情绪更加丰富
    •  增加视频转场效果,使其看起来更加的流畅
    •  优化视频素材的匹配度

    工具地址

    体验中文版:

    https://reccloud.cn

    体验英文版:

    https://reccloud.com

    GitHub:

    https://github.com/harry0703/MoneyPrinterTurbo

  • Stylar – 一个更适合小白的 AI 在线设计工具

    工具介绍

    使用非常简单,工具栏只有文生图、图生图、生成填充、脸部套装这几个选项,通过简单的提示词和点击工具就可以轻松创作惊艳的图像 Stylar AI 引入了图层的概念,在画布上通过排版的方式,就能精准控制每个元素,可以将不同风格的元素统一化,对设计小白而言更容易上手 🎁免费用户有200点数,使用一次大概消耗4个点数,用完可以继续注册新号

    工具地址

    地址:

    https://www.stylar.ai/

  • CapsWriter Offline-好用的 PC 端的语音输入 字幕转录工具 无限时长

    软件介绍

    CapsWriter Offline-CapsWriter 的离线版,一个 PC 端的语音输入、字幕转录工具,完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔,按下键盘上的 大写锁定键,录音开始,当松开 大写锁定键 时,就会识别你的录音,并将识别结果立刻输入,将音视频文件拖动到客户端打开,即可转录生成 srt 字幕。

    特性

    1. 完全离线、无限时长、低延迟、高准确率、中英混输、自动阿拉伯数字、自动调整中英间隔
    2. 热词功能:可以在 hot-en.txt hot-zh.txt hot-rule.txt 中添加三种热词,客户端动态载入
    3. 日记功能:默认每次录音识别后,识别结果记录在 年份/月份/日期.md ,录音文件保存在 年份/月份/assets
    4. 关键词日记:识别结果若以关键词开头,会被记录在 年份/月份/关键词-日期.md,关键词在 keywords.txt 中定义
    5. 转录功能:将音视频文件拖动到客户端打开,即可转录生成 srt 字幕
    6. 服务端、客户端分离,可以服务多台客户端
    7. 编辑 config.py ,可以配置服务端地址、快捷键、录音开关……

    如何使用

    对 Windows 端:

    1. 请确保电脑上安装了 Microsoft Visual C++ Redistributable 运行库
    2. 服务端载入模型所用的 onnxruntime 只能在 Windows 10 及以上版本的系统使用
    3. 服务端载入模型需要系统内存 4G,只能在 64 位系统上使用
    4. 额外打包了 32 位系统可用的客户端,在 Windows 7 及以上版本的系统可用
    5. 模型文件较大,单独打包,解压模型后请放入软件目录的 models 文件夹中

    其它系统:

    1. 其它系统,可以下载模型、安装依赖后从 Python 源码运行。
    2. 由于我没有 Mac 电脑,无法打包 Mac 版本,只能从源码运行,可能会有诸多问题要解决。(由于系统限制,客户端需要 sudo 启动,且默认快捷键为 right shift)

    模型说明:

    1. 由于模型文件太大,为了方便更新,单独打包
    2. 解压模型后请放入软件目录的 models 文件夹中

    软件地址

    下载地址:

    夸克网盘

    下载地址:

    百度网盘

      提取码:eu4c GitHub:

    https://github.com/HaujetZhao/CapsWriter-Offline

  • 免费语音视频 文本图片多模态AI能力引擎平台- 思通数科 StoneDT

    网站介绍

    思通数科 StoneDT是一个免费语音视频 文本图片多模态AI能力引擎平台,免费提供自然语言处理、情感分析、实体识别、图像识别与分类、OCR识别、语音识别接口等等,注册即可体验,感兴趣的同学可以试试。

    网站地址

    官网:https://nlp.stonedt.com/ gitee地址:https://gitee.com/stonedtx/free-nlp-api

  • Hugging Chat – Hugging Face 推出的 AI 聊天应用

    工具介绍

    Hugging Chat 内置了 8 个开源大模型如 Llama3、Mixtral、Zephyr 等,支持联网,支持中文

    工具地址

    地址:

    https://huggingface.co/chat/

    Github:

    https://github.com/huggingface/chat-ui

    iOS商店:

    https://apps.apple.com/sg/app/huggingchat/id6476778843