标签: AI工具

  • kaze.ai – AI免费在线图片水印去除工具

    kaze.ai – AI免费在线图片水印去除工具

    kaze.ai水印去除工具界面

    工具介绍

    kaze.ai 是一款基于人工智能的免费在线图片水印去除工具,能够轻松从照片和图像文件中去除水印或徽标,无需任何技术专业知识即可快速实现清晰美观的效果。

    水印是叠加在图像上的标记或文本,通常半透明,会影响图像的美感。kaze.ai 专业支持 JPEG/JPGPNG 格式,使用方法简单:

    1. 上传需要去除水印的图片
    2. 等待 AI 自动处理
    3. 下载无水印的清晰图像

    功能特点

    • 完全免费:无需付费,无使用次数限制
    • AI智能处理:基于先进的人工智能技术,自动识别并去除水印
    • 操作简单:无需任何技术背景,一键上传即可
    • 多格式支持:支持 JPEG/JPG 和 PNG 主流图片格式
    • 在线使用:无需下载安装,打开网页即可使用

    工具地址

    网站:https://kaze.ai/toolkit/watermark-removal

  • i18n - 一款由 AI 驱动的 JSON 国际化翻译工具

    i18n - 一款由 AI 驱动的 JSON 国际化翻译工具

    i18n JSON国际化翻译工具界面

    工具介绍

    i18n 是一款由 AI 驱动的 JSON 国际化翻译工具,专为开发者设计,支持 40+ 种语言,提供实时预览、批量导出和 AI 实时翻译功能。

    该工具的开发者使用 Cursor AI 完成开发,体现了 AI 在实际项目开发中的强大能力。重要的是,完全开源可自行部署,适合企业和个人开发者使用。

    主要功能

    • 多语言支持:支持 40+ 种语言的互译
    • 实时预览:翻译结果即时可见
    • 批量导出:支持批量导出翻译文件
    • AI 实时翻译:基于 AI 的精准翻译
    • 开源部署:代码完全开源,可私有化部署

    工具地址

    🌐 网站:https://json.uiboy.com/zh

    💻 GitHub:https://github.com/ViggoZ/json-translate

  • GitHub Copilot 可以免费使用了!

    GitHub Copilot 可以免费使用了!

    GitHub Copilot 是一款由 GitHub 和 OpenAI 合作推出的人工智能编程助手,它通过深度学习模型训练而成,旨在帮助开发者提高编程效率、减少重复性工作,并提供高质量的代码建议。

    GitHub Copilot 界面

    工具介绍

    现在免费用户每月可享受以下福利:

    • 2000 个代码建议 - 满足日常编程需求
    • 50 次对话 - 获取编程帮助和解答

    聊胜于无,对于个人开发者和学生来说是非常实用的福利!

    工具地址

    GitHub 官网:
    https://github.com/copilot

  • 白嫖 AI 代理引擎 Genspark :支持 GPT-4o、Claude Sonnet、Gemini、Flux、DALL E 3、等模型

    白嫖 AI 代理引擎 Genspark :支持 GPT-4o、Claude Sonnet、Gemini、Flux、DALL E 3、等模型

     

    工具介绍

    Genspark是一个基于人工智能的搜索和信息整合平台,它通过生成定制化的网页(Sparkpages)来提供准确、无偏见的信息。集 AI 搜索+ AI 模型聚合服务于一身,自动化程度很高,生成图片都直接给你优化提示词。

    支持的AI模型

    • GPT-4o - OpenAI最新旗舰模型
    • Claude Sonnet - Anthropic强大AI助手
    • Gemini - Google多模态AI模型
    • Flux - 高质量AI图像生成
    • DALL-E 3 - OpenAI图像生成模型

    工具地址

    1.点击此链接注册,可获得 1 个月的免费 Genspark Plus

    2. 注册登录之后点击左下方邀请按钮,邀请 20 个新用户最高可获得 20 个月的免费 Genspark Plus

    注册地址:https://www.genspark.ai/invite?invite_code=Yjc1ZDczYmVMYWUxNUxmYWQ0TGU0YWFMYTI1YTA4YzBiZDA1

    Genspark 介绍:http://mainfunc.ai/blog/genspark_intro

  • Google 发布 AI 图像创意工具「Whisk」

    Google 发布 AI 图像创意工具「Whisk」

    在人工智能技术飞速发展的今天,Google 再次带来惊喜。Google Labs 正式推出了一款名为 Whisk 的创新型 AI 图像生成工具,这款工具彻底颠覆了传统以文本提示为核心的创作方式,转而采用图像驱动的全新交互模式。

    什么是 Whisk?

    Google Whisk AI图像工具

    Whisk 是 Google Labs 推出的一款创新 AI 图像生成工具,它通过图像输入快速生成并重混创意图片。与传统 AI 绘图工具不同,Whisk 允许用户上传图像来确定主体、场景和风格,无需撰写复杂的文本提示,为不擅长文字描述的用户提供了更便捷的创作方式。

    核心功能特点

    • 图像驱动的生成:上传图像即可确定创作主体、场景和风格,无需编写文本提示
    • 自动生成详细字幕:Gemini 模型会自动为上传的图像编写详细的字幕描述,精准捕捉图片的主题、情感和风格特征
    • 创意重新混合:可将不同的主体、场景和风格图像进行重新混合,创造出独特设计,如数字玩偶、珐琅别针等创意产品
    • 本质捕捉而非复制:捕捉输入图像的本质特征,而非精确复制,为创意变化提供更多空间
    • 可编辑提示:用户可查看和编辑底层提示信息,自由调整颜色、图案等特征

    技术原理揭秘

    Whisk 的强大能力源于 Google 两大核心技术的协同工作:

    1. Gemini 视觉理解与描述模型:负责为用户上传的图像生成详细的文字描述,精准捕捉图片的主题、情感和风格特征
    2. Imagen 3 图像生成模型:基于 Gemini 生成的丰富描述信息,运用深度学习算法创造出符合用户意图又充满惊喜的新图像

    适用场景

    Whisk 主要定位于创意探索领域,旨在帮助用户快速生成和迭代各种创意想法,而非用于精确的图像编辑。无论是数字艺术品创作、产品设计灵感,还是创意概念探索,Whisk 都能提供独特的帮助。

    工具地址

    • 官方博客:https://blog.google/technology/google-labs/whisk/
    • 使用地址:https://labs.google/fx/zh/tools/whisk

    注意事项:目前 Whisk 仅对美国用户(美国 IP)开放,其他地区用户可能无法直接访问。

    Whisk 的推出标志着 Google 在图像生成领域的重要布局,这款工具不仅简化了图像创作流程,更在技术上实现了质的飞跃,为用户提供了一种独特的图像生成方法。

  • CAPTCHA-automatic-recognition:AI 驱动的验证码自动识别脚本

    CAPTCHA-automatic-recognition:AI 驱动的验证码自动识别脚本

    CAPTCHA-automatic-recognition AI验证码自动识别工具

    工具介绍

    CAPTCHA-automatic-recognition 是一款 AI 驱动的验证码自动识别与填充脚本。它通过人工智能模型对网页验证码进行自动识别,并将识别结果直接填入输入框。该脚本支持 OpenAIGemini 以及 阿里云通义千问 等主流 AI 服务,用户也可以自定义 API 地址和模型。配置一次后,即可在所有网站通用,无需反复设置。

    功能特点

    • 自动识别与填充:自动识别网页验证码,并将结果直接填入输入框,减少手动输入的繁琐操作。
    • 支持主流 AI 服务:支持 OpenAI、Gemini、阿里云通义千问等主流 AI 服务,用户可以根据需求选择合适的 AI 模型。
    • 自定义 API 地址和模型:用户可以自定义 API 地址和模型,满足个性化需求。
    • 通用配置:配置一次后,即可在所有网站通用,无需反复设置,提升使用效率。

    使用场景

    • 在线注册与登录:在需要验证码的在线注册或登录场景中,自动识别验证码并填充,提升用户体验。
    • 自动化测试:在自动化测试中,快速识别验证码,确保测试流程的顺利进行。
    • 数据采集:在数据采集过程中,自动识别验证码,提高数据采集的效率和准确性。

    安装与使用

    安装方法

    1. 在浏览器中添加 TampermonkeyViolentmonkey 扩展
    2. 访问脚本安装地址并完成安装

    使用方法

    1. 打开任意含验证码的网页
    2. 点击验证码图片右侧的小图标
    3. 首次点击时会弹出设置面板,输入 API Key 并选择模型
    4. 保存后即可开始单击识别,也可在设置中勾选“验证码变化时自动识别”
    5. 对于使用前端框架模板的网站,可启用“自动复制到剪贴板”以确保识别结果有效

    工具地址

    GitHub:https://github.com/XiaomingX/openai-captcha-detection

    安装链接:CAPTCHA-automatic-recognition(AI 验证码自动识别填充)

  • GPTalk v4.0.1.0(89) 安卓绿化版

    GPTalk v4.0.1.0(89) 安卓绿化版

    软件介绍

    GPTalk是一款多功能的AI驱动沟通和生产力工具,它利用ChatGPT技术为用户提供智能对话、语言翻译、笔记记录和内容创作等服务。以下是GPTalk的一些核心功能和特点:

    1. 智能对话:GPTalk可以创建和切换不同话题的对话,提供自然和相关的回答。
    2. 语言翻译:它通过AI技术促进全球沟通,打破语言障碍。
    3. 笔记记录和内容创作:GPTalk提供AI辅助的笔记记录和内容创作功能,提高个人和企业的生产力。
    4. 多平台支持:GPTalk支持在多个平台上使用,包括移动设备和电脑。
    5. 自定义聊天界面:用户可以享受自定义的聊天界面和多语言支持。
    6. AI辅助写作:跨多种平台的AI辅助写作功能,帮助用户更高效地创作内容。
    7. 个性化角色生成:GPTalk允许用户根据需求打造心理咨询师、侦探等虚拟角色,无需上传照片,通过文字描述进行定制。
    8. 上下文对话:GPTalk能够理解上下文,在对话中自动获取相关信息,更准确地回答问题。
    9. 语音激活的AI:GPTalk使用OpenAI的ChatGPT和Picovoice的Porcupine响应语音命令和问题。
    10. 文本到语音和语音到文本:GPTalk提供文本到语音和语音到文本的功能,方便用户在不同场景下使用。

    GPTalk通过其多功能性和AI驱动的特性,成为了个人和专业使用的宝贵工具,节省时间并提高沟通和内容创作的质量

    版本特色

    去广告,解锁功能

  • Google 发布旗下最强 AI 大模型「Gemini 2.0 Flash」

    Google 发布旗下最强 AI 大模型「Gemini 2.0 Flash」

    2024年12月,谷歌正式发布了旗下最新人工智能模型——Gemini 2.0 Flash。作为 Gemini 2.0 系列的首个模型,它在多模态处理和 AI Agent 方面实现了重大突破,标志着谷歌在人工智能领域迈入新阶段。

    工具介绍

    Gemini 2.0 Flash 是谷歌最新发布的人工智能模型,它是 Gemini 2.0 系列的首个模型,具有以下特点和功能:

    1. 多模态输入输出

    Gemini 2.0 Flash 支持图片、视频和音频等多模态输入,并且能够进行多模态输出,例如直接生成图像与文本混合的内容,以及原生生成可控的多语言文本转语音(TTS)音频。

    2. 性能提升

    与上一代模型 Gemini 1.5 Flash 相比,Gemini 2.0 Flash 在关键基准测试中的表现是 1.5 Pro 版本的两倍之快。

    3. 原生工具调用

    Gemini 2.0 Flash 可以原生调用谷歌搜索、代码执行以及第三方用户定义的函数等工具。

    4. 智能体时代

    谷歌 CEO 桑达尔·皮查伊表示,如果说 Gemini 1.0 的作用是整合和理解信息,那么 Gemini 2.0 能够做到让信息更加有用,为构建通用助手的愿景更进一步。

    5. AI Agent 功能

    Gemini 2.0 系列模型主打 AI Agent 功能,在原本的功能之外,还加入了多项新的 Agent 功能。

    6. 开发者体验

    从发布之日起,2.0 Flash 的实验版本将通过 Gemini API 和谷歌的 AI 开发平台(AI Studio 和 Vertex AI)提供。然而,音频和图像生成功能仅对“早期接入合作伙伴”开放,并计划在明年1月全面推出。

    7. 新输出模式

    开发人员将能够使用 Gemini 2.0 Flash 生成集成响应,这些响应可以包含文本、音频和图像 — 只需调用一次 API 即可完成。

    8. 多模态实时 API

    谷歌推出了新的多模态实时 API,支持实时音频和视频流输入,并能同时使用多个组合工具,为用户带来更加丰富的交互体验。

    9. 智能体研究原型

    谷歌还展示了三个智能体研究原型:Project Astra、Project Mariner 和 Jules,展现了智能体如何改变我们与数字世界的互动方式。

    核心功能一览

    • ✅ 生成图像和音频
    • ✅ 网页搜索
    • ✅ 代码编写
    • ✅ 游戏指导
    • ⏳ 图片和语音生成功能将于明年1月开放

    Gemini 2.0 Flash 的发布标志着谷歌在人工智能领域的进一步发展,特别是在多模态处理和智能体技术方面。

    工具地址

    • 🌐 官方博客:Google AI 官方博客
    • 🚀 直达链接:Gemini 官网
  • 5ire - 开源跨平台大语言模型桌面客户端

    5ire - 开源跨平台大语言模型桌面客户端

    工具介绍

    一款跨平台 LLMs 桌面客户端,支持 OpenAI、Azure OpenAI、Anthropic、Google、百度、探月、豆包、Grok、DeepSeek 和 Ollama。 软件将 bge-m3 集成为本地嵌入模型,支持 DOCX、XLSX、PPTX、PDF、TXT 和 CSV 文档的解析和矢量化,从而能在本地支持强大的检索增强生成 RAG 功能。 支持本地知识库、使用情况分析、提示库、书签、快速关键字搜索。 支持平台:#Windows #macOS

    工具地址

    官方地址:

    https://5ire.app/

    GitHub:

    https://github.com/nanbingxyz/5ire

  • NSFW Detector - 基于 AI 的 NSFW 内容检测器

    NSFW Detector - 基于 AI 的 NSFW 内容检测器

    NSFW Detector 工具界面

    工具介绍

    NSFW Detector 是一款基于 AI 人工智能技术的内容检测工具,专门用于识别和过滤不适当内容(Not Safe For Work)。相较于传统的 NSFW 检测工具,它具有更强大的功能和更好的使用体验。

    核心功能

    • 多格式支持:支持检测图片、PDF、视频、压缩包中的文件
    • 本地推理:支持在本地纯 CPU 环境下进行推理,无需 GPU 加速
    • 隐私保护:所有检测在本地完成,数据不会上传到服务器

    工具地址

    • 中文指南:https://github.com/tmplink/nsfw_detector/blob/main/README_cn.md
    • 网站:https://www.vx.link/nsfw_detector.html
    • GitHub:https://github.com/tmplink/nsfw_detector