覆盖 AI聊天、AI图像、AI写作、AI编程等方向,持续更新产品官网、使用指南、案例与问答。
已收录栏目 36 个 · 已发布内容 2198 篇
So-VITS-SVC(SoftVC VITS Singing Voice Conversion)是一款基于VITS(Variational Inference Text-to-Speech)
RVC(Retrieval-based Voice Conversion)是一款开源的实时语音转换与歌声合成工具,基于检索式方法实现高保真、低延迟的语音转换。它能够将源说话人的语音或歌声转换为
Riffusion-15是一款基于扩散模型(Diffusion Model)的AI音乐生成工具,能够实时将文本描述或音频输入转化为高质量的音乐片段。它利用深度学习技术,在频谱图上进行扩散和去噪
Riffusion-12是一款基于深度学习模型的AI音乐生成工具,能够通过文本描述或音频输入实时生成音乐片段,并支持频谱图可视化与风格迁移。它利用扩散模型技术将声音转化为图像频谱,再反向生成音
Riffusion-8是一款基于深度学习模型的AI音乐生成工具,通过分析音频频谱图实现实时音乐创作、风格迁移和声音合成。它利用Stable Diffusion架构处理音频数据,支持文本提示生成
Riffusion-6是一款基于扩散模型(Diffusion Model)的人工智能音乐生成工具,能够通过文本提示或音频输入实时生成高质量的音乐片段。它融合了频谱图处理与深度学习技术,支持多种
Riffusion-4是一款基于深度学习技术的AI音乐生成工具,通过频谱图像合成实现实时、高质量的原创音乐创作。它利用Stable Diffusion模型将文本或音频提示转化为独特的音乐片段,
Stability AI Video 是 Stability AI 推出的视频生成工具,基于 Stable Diffusion 模型,支持文本到视频、图像到视频的转换,提供高画质、连贯的视频内
智谱清言是由智谱AI推出的一款基于GLM大模型的智能对话助手,支持多轮对话、内容创作、代码生成、数据分析等多种功能,适用于个人办公、学习辅助及企业智能化场景。
Riffusion-9是一款利用深度学习技术,通过频谱图(spectrogram)实现实时音乐生成与转换的创新型AI工具。它能够将文本描述、音频片段或现有旋律转化为独特的音乐作品,支持多种风格
Riffusion-2是一款创新的AI音乐生成工具,利用深度学习模型将文本或音频输入转化为实时频谱图,并生成高质量、风格多样的音乐片段。它适合音乐创作者、内容制作者和AI爱好者,无需专业音乐知
Ideogram AI 是一款领先的人工智能图像生成工具,利用先进的深度学习模型,将文本描述快速转化为高质量、逼真的图像。它支持多种艺术风格、精准的文字渲染和实时协作,广泛应用于创意设计、广告
Typeface是一款专为企业打造的生成式AI内容创作平台,利用先进的自然语言处理和图像生成技术,帮助用户快速创建高质量的品牌内容,包括文案、图像、视频等,同时确保品牌一致性和合规性。
Consensus是一款专注于学术研究的AI搜索引擎,利用大语言模型和自然语言处理技术,从数百万篇同行评审论文中提取、总结并呈现科学证据。它帮助研究人员、学生和专业人士快速找到可靠答案,节省文
Artbreeder是一个利用生成对抗网络(GAN)和机器学习技术的人工智能平台,允许用户通过混合、调整和“培育”图像来创造独特的数字艺术作品。它专注于将不同图像的特征进行组合,生成全新的视觉
Tabnine是一款由人工智能驱动的代码补全工具,通过深度学习模型理解上下文,为开发者提供精准的代码建议,支持多种编程语言和主流IDE,显著提升编程效率与代码质量。
Bardeen是一款基于人工智能的自动化工具,通过可视化脚本和AI助手,帮助用户自动执行跨应用、跨网站的任务,显著提升个人与团队的工作效率。
Hugging Face Chat 是 Hugging Face 推出的免费对话式 AI 工具,基于开源大语言模型(如 Llama、Mistral 等),提供自然、流畅的文本交互体验,支持多轮
Perplexity Answer Engine 是一款基于先进人工智能技术的智能答案引擎,能够实时检索网络信息,并生成精准、详细的回答。它结合了自然语言处理与搜索引擎技术,为用户提供类似对话
Stable Video Diffusion 是一款基于稳定扩散模型(Stable Diffusion)的AI视频生成工具,能够将静态图像或文本描述转化为连贯、高质量的视频内容。它利用先进的深
Perplexity Ask 是一款基于大型语言模型的智能问答搜索引擎,能够实时从互联网检索信息并生成准确、带有引用的回答。它结合了自然语言理解与实时搜索能力,适用于研究、学习、编程、写作等多
Google Search Generative Experience(SGE)是Google推出的新一代搜索功能,利用生成式AI技术,在搜索结果中直接提供智能摘要、多步推理和对话式交互,帮助
Suno AI是一款先进的人工智能驱动音乐生成平台,允许用户通过文本提示或简单旋律输入,快速创作出包含完整乐器编曲和人声演唱的原创音乐作品。它降低了音乐创作的技术门槛,使任何人都能成为音乐创作
Stable Diffusion WebUI是一款基于Stable Diffusion模型的AI图像生成与编辑工具,提供直观的Web界面,支持文本生成图像、图像修复、风格迁移等功能,适用于设计
D-ID 9.0 是一款基于人工智能的数字人视频生成与实时交互平台,能够将静态照片或文字转化为逼真的动态数字人,支持语音合成、面部表情驱动和实时对话,广泛应用于营销、教育、客服和内容创作等领域
Whisper v3 是 OpenAI 推出的第三代自动语音识别(ASR)模型,基于大规模弱监督训练,支持多语言语音转文字、翻译及说话人识别。其核心优势在于高准确率、强鲁棒性(抗噪、口音适应)
Luma AI Video是一款基于先进人工智能技术的视频生成工具,能够通过文本描述、图像或简单指令自动创建高质量、逼真的视频内容。它利用深度学习模型理解场景、动作和风格,支持从概念到成片的快
Kling Video 2是一款基于先进人工智能技术的视频生成工具,能够将文本描述、图像或简单提示快速转化为高质量、动态丰富的视频内容。本文详细介绍其核心功能、应用场景、技术优势及使用方法,帮
Jasper AI 是一款基于人工智能的写作助手,专为内容创作者、营销人员和团队设计,能够快速生成高质量的博客文章、广告文案、社交媒体内容、电子邮件等。它利用先进的自然语言处理模型,支持多语言
Kling AI 4.5 是一款基于深度学习的先进人工智能视频生成工具,支持从文本、图像或视频片段快速生成高质量、高分辨率的视频内容。它融合了最新的扩散模型与运动控制技术,适用于广告制作、社交
Whisper AI v3 是 OpenAI 开发的第三代自动语音识别(ASR)模型,支持多语言转录、翻译和语音活动检测。基于大规模弱监督训练,具备高准确率、强鲁棒性,适用于实时转写、会议记录
Kling AI 3.5 是一款基于深度学习的先进人工智能视频生成工具,能够根据文本描述、图像或简单提示快速生成高质量、连贯且富有创意的视频内容。它融合了最新的扩散模型与运动控制技术,支持多种
Haiper AI 2.5 是一款基于先进人工智能技术的视频生成与编辑工具,支持文本到视频、图像到视频的转换,以及视频风格迁移、背景替换等功能。它利用深度学习模型,帮助用户快速创建高质量、富有
Writesonic-7是一款基于先进人工智能技术的多功能写作助手,专为内容创作者、营销人员和商务人士设计。它能够快速生成高质量的文章、博客、广告文案、社交媒体内容等,支持多种语言和风格定制,
Claude-4是Anthropic公司推出的最新一代AI助手,基于先进的大语言模型技术,具备卓越的推理能力、代码生成、文本分析和多模态处理功能。本文详细介绍Claude-4的核心特性、技术优
Snapchat AI是Snapchat平台内置的人工智能聊天机器人,基于OpenAI的GPT技术,为用户提供自然对话、创意建议和互动体验。它集成在Snapchat应用中,支持文本对话、图像生
Cleanvoice 是一款基于人工智能的音频处理工具,能够自动识别并去除录音中的背景噪音、填充词(如“嗯”“啊”)、长时间静音以及口齿不清等瑕疵,适用于播客、会议录音、采访、在线课程等多种场
OpenAI Voice是OpenAI推出的语音合成与交互工具,基于GPT-4o等模型,提供自然、流畅的语音生成和实时对话能力。它支持多种语音风格、情感表达和语言,适用于语音助手、有声内容创作
Replicate CogVideo是由清华大学和智源研究院联合开发的先进文本到视频生成模型,基于CogView2架构,能够根据文本描述自动生成高质量、连贯的短视频片段,是开源AI视频生成领域
AutoGPT是一款开源的自主人工智能代理,基于GPT-4等大型语言模型构建,能够自主理解、规划并执行复杂任务,无需人工逐步干预,代表了AI向通用任务自动化迈进的重要一步。
HeyGen 2.0是一款基于人工智能的先进视频生成平台,通过文本输入即可创建高质量、带真人形象和语音的视频内容,极大降低了视频制作门槛,适用于营销、教育、培训等多种场景。
Lexica Art 是一款强大的AI图像生成与编辑工具,利用先进的深度学习模型,帮助用户快速创建高质量、风格多样的艺术作品。支持文本到图像生成、图像风格迁移、细节调整等功能,适用于设计师、艺
Vercel v0是由Vercel公司推出的AI驱动Web应用生成工具,通过自然语言描述或简单草图,即可自动生成React组件代码和完整用户界面,极大提升前端开发效率。
Metaphor Search是一款革命性的智能搜索引擎,它不依赖传统的关键词匹配,而是通过理解自然语言查询的深层语义和上下文来寻找最相关的结果。它专为开发者、研究人员和知识工作者设计,能够精
Andi Search是一款融合了生成式人工智能技术的智能搜索引擎,旨在通过对话式交互和AI摘要,为用户提供更精准、更直观的答案,而不仅仅是传统的关键词匹配链接列表。它代表了搜索技术从“链接检
Andi Search是一款采用人工智能技术驱动的下一代搜索引擎,专注于提供准确、直观的答案而非传统链接列表,同时严格保护用户隐私,不追踪、不记录搜索行为。
Perplexity AI是一款融合了大型语言模型与实时网络搜索能力的AI驱动搜索引擎,通过自然对话方式提供准确、可溯源的答案,旨在重新定义信息获取体验。
Cursor是一款集成了先进人工智能功能的现代化代码编辑器,专为提升开发者的编程效率和代码质量而设计。它通过深度理解代码上下文,提供智能代码补全、错误检测、重构建议和自然语言编程等核心功能,帮
Sweep是一款基于人工智能的代码清理与重构工具,能够自动识别代码中的冗余、错误和不符合最佳实践的部分,并提供智能修复建议。它支持多种编程语言,集成到主流开发环境中,帮助开发者提升代码质量、减
Mubert是一款基于人工智能技术的音乐生成平台,能够根据用户输入的文本、情绪或风格实时生成免版税的背景音乐、音效和完整曲目,广泛应用于内容创作、冥想、学习和工作场景。
Suno V6是一款基于尖端人工智能技术的音乐生成平台,能够根据简单的文本描述或旋律片段,自动创作出包含完整歌词、人声演唱和多种乐器伴奏的原创音乐作品。它极大地降低了音乐创作的门槛,让没有专业
HeyGen 4.0是一款基于人工智能的尖端视频生成与合成平台,它通过先进的AI技术,允许用户仅凭文本、图片或音频,即可快速创建出带有逼真数字人形象的定制化视频内容。该平台极大地降低了高质量视
Bolt.new v27 是 StackBlitz 推出的最新版本 AI 驱动全栈 Web 开发工具。它允许开发者通过自然语言描述或提示,直接在浏览器中创建、编辑、运行和部署完整的生产级 We
BabyAGI 是一个基于 OpenAI 和 Pinecone 等技术的轻量级 AI 代理框架,能够自主创建、排序和执行任务,实现复杂工作流的自动化管理。它模拟人类项目管理流程,通过目标分解与
Windy是一款基于人工智能的气象数据平台,提供全球实时天气可视化、风速风向预测、降水雷达、空气质量监测等功能,广泛应用于户外运动、航空航海、农业和科研领域。其AI算法可生成高精度短期天气预报
Phi 是一款由微软研究院推出的高效、轻量级人工智能开发工具,专注于为开发者提供快速构建和部署智能应用的能力。它基于 Transformer 架构,支持多种自然语言处理任务,如文本生成、问答、