博客

  • AniTalker-开源照片+音频视频生成器 脸部表情 嘴形同步

    工具介绍

    AniTalker是一款开源照片+音频视频生成器框架 ,通过身份解耦面部运动编码制作生动且多样化的说话面孔,可将单个静态肖像照片和输入音频转换为具有自然流动动作的动画对话视频,生成的结果的每一列都使用具有相似姿势和表情的相同控制信号,但包含一些随机变化,展示了我们的多样性产生的结果。

    工具地址

    演示:

    https://x-lance.github.io/AniTalker/

    GitHub:

    https://github.com/X-LANCE/AniTalker

    论文:

    https://arxiv.org/abs/2405.03121

  • 在线专业免费PDF转换器-ONEPDF

    工具介绍

    ONEPDF是一款在线专业免费PDF转换器,包括PDF转换器、压缩PDF、合并PDF、分割PDF、加密PDF、提取PDF、旋转PDF、添加水印等操作,只需上传文件,点击几下即可转换、压缩、合并、分割、提取、添加、删除、旋转、水印、重新排列、加密和签署 PDF 页面。是一款不错的PDF 工具并提高工作效率。

    工具地址

    地址:

    https://www.onepdf.online/

  • HeyBeauty-在线AI虚拟试衣间 无需亲自试穿即可查看效果

    工具介绍

    HeyBeauty是一款在线AI虚拟试衣间工具,无需亲自试穿即可立即查看衣服穿在你身上的效果,只需要上传用户招聘和衣服照片即可,该虚拟试穿技术使用 AI 根据你输入的测量值或照片创建详细的 3D 模型。该模型可让你实时查看不同的衣服穿在您身上的效果,从而在舒适的家中提供逼真的试穿体验。HeyBeauty 支持多种服装类型,包括连衣裙、上衣、裤子、外套等,还在不断更新,提供免费试用,目前可以在线体验,还会推出插件版。

    工具地址

    官网:https://heybeauty.ai

  • 在线AI说唱生成器 一键生成说唱歌词和歌曲-Rap Generator

    工具介绍

    Rap Generator是一款在线AI说唱生成器工具,帮助用户 一键生成说唱歌词和歌曲,目前支持Rap说唱歌曲、下载和说唱歌词生成,使用需要注册登录,提供试用额度,用户可以自定义歌词、音乐风格、标题、乐器、和私人定制,还可以发现其他用户生成的说唱音乐。

    工具地址

    地址:https://rapgenerator.net

  • IC-Light – 让 AI 给图片智能打光

    工具介绍

    上传一张图片,选择光源位置,填写提示词,AI 便会生成一张优秀光影的图片 除了打光,IC-Light 还可以让图片和背景做到完美融合。实际效果非常好,并且使用场景也比较多

    工具地址

    在线体验①:https://huggingface.co/spaces/lllyasviel/IC-Light 在线体验②: https://colab.research.google.com/drive/1-pXSpTH-zNhaAKFmMvh-xj7Zp9781L2f?usp=sharing

  • FunClip-开源、精准、方便的视频切片工具

    工具介绍

    FunClip是一款完全开源、本地部署的自动化视频剪辑工具,通过调用阿里巴巴通义实验室开源的FunASR Paraformer系列模型进行视频的语音识别,随后用户可以自由选择识别结果中的文本片段或说话人,点击裁剪按钮即可获取对应片段的视频。

    工具地址

    在线体验:

    https://modelscope.cn/studios/iic/funasr_app_clipvideo/summary

    GitHub:

    https://github.com/alibaba-damo-academy/FunClip

  • 免费 AI图像描述生成器-AI说图解画

    工具介绍

    AI说图解画/ImageAI.QA是一款免费 AI图像描述生成器,使用 AI 图像描述生成器工具探索图像背后的奥秘,上传你的艺术作品,让人工智能揭示其背后的隐藏细节、情感和含义。艺术家、设计师或任何对此感兴趣的人,这款“说图解画”为你的创作提供全新的视角,且免注册使用。

    工具地址

    地址:

    https://imagedescriptiongenerator.xyz

  • 兆懿 – 强大多功能且易用的安卓模拟器

    工具介绍

    一款类似于微软 WSA 的移动应用运行平台,也就是可以在电脑上运行安卓应用的模拟器。 支持多窗口运行,多个安卓应用同时运行和显示,刷抖音、追网剧、玩游戏、开会议、写文档,各种操作可同步进行,享受多倍的快乐。 还具有自由拉伸、文件拖拽、消息通知、应用分身、键鼠手柄、多点触控、Magisk 支持、快捷菜单等实用功能。

    工具地址

    官网:

    https://www.wndroid.com/

  • UnblockNeteaseMusic-解锁网易云音乐客户端变灰歌曲

    工具介绍

    UnblockNeteaseMusic一款锁网易云音乐客户端变灰歌曲工具,支持多个音源,替换变灰歌曲链接,支持指定网易云服务器 IP,支持设置上游 HTTP / HTTPS 代理,直接下载找到最新版本,然后找到符合你系统架构的可运行文件。下载回来后点两下即可使用,macOS 因为签名问题,暂时不提供可运行文件。请先按照其他做法使用。

    如何运行

    直接打开可运行文件

    去右侧的 Releases 找到最新版本,然后在下方的 Assets 找到符合你系统架构的可运行文件。下载回来后点两下即可使用。

    macOS 因为签名问题,暂时不提供可运行文件。请先按照其他做法使用。

    NPM 安装

    安装成依赖

    npm install @unblockneteasemusic/server
    yarn add @unblockneteasemusic/server # for Yarn users

    用 NPX 运行

    npx -p @unblockneteasemusic/server unblockneteasemusic

    注册成 Windows 服务

    安装服务

    直接 clone 或下载本项目,在项目根目录运行 node ./nw.js。会有弹窗,直接确定即可。如果有安全管家等软件可能会阻止,直接允许即可。运行成功后可在电脑服务中看到该服务。

    配置

    http 代理使用 127.0.0.1,端口默认使用 8080。

    如果想要添加启动参数和环境变量,请在项目根目录中的 nw.js 中配置 scriptOptions 和 env。

    如果想要卸载已安装的服务,请再次运行 node ./nw.js。 安装服务后,会在项目根目录生成 daemon 文件夹。可在这里查看日志。

    工具地址

    下载地址:

    国内网盘

    GitHub:

    https://github.com/UnblockNeteaseMusic/server

  • zh_recogn – 中文语音识别 srt 字幕导出工具

    工具介绍

    一个中文语音识别为字幕的项目,支持中文音频、视频转为 srt 字幕,基于魔塔社区 Paraformer 模型,提供 api 接口和简单界面。 项目仅支持中文语音识别,非中文语音可以利用基于 OpenAI Whisper 和 Faster-Whisper 的项目,如 pyvideotrans 或 stt 目的是为了弥补国外模型在中文支持方面的不足。

    工具地址

    GitHub地址:

    https://github.com/jianchang512/zh_recogn