覆盖 AI聊天、AI图像、AI写作、AI编程等方向,持续更新产品官网、使用指南、案例与问答。
已收录栏目 36 个 · 已发布内容 2200 篇
ChatGPT-4o-latest 是 OpenAI 推出的最新版本多模态大语言模型,融合了文本、图像、语音理解与生成能力,支持实时对话、文件分析、图像识别、代码生成等功能,适用于开发、创作、
Hedra 2.0 是一款革命性的AI视频生成工具,支持文本、图像和音频输入,快速生成高质量、富有表现力的虚拟角色视频。适用于内容创作、营销、教育和娱乐等领域,提供实时协作和云端渲染功能。
Mistral AI 是一家专注于开发高性能、开源大语言模型的法国人工智能公司,提供包括 Mistral 7B、Mixtral 8x7B 等先进模型,以及面向开发者的 API 和部署工具,支持
GLM(General Language Model)是由智谱AI研发的先进多模态通用大模型,支持文本、图像、代码等多种任务,提供强大的自然语言理解与生成能力。本文详细介绍GLM的核心特性、应
Marqo是一个开源的、端到端的向量搜索与AI数据平台,支持文本、图像等多模态数据的索引与检索,提供强大的语义搜索、推荐和RAG(检索增强生成)能力,适用于构建智能搜索系统、知识库和AI应用。
Google Gemini Advanced是谷歌推出的最强大、最通用的AI模型,支持文本、图像、音频、视频和代码的多模态理解与生成,提供高级推理、编程辅助、创意协作等功能,适用于专业用户和开
Google Gemini 2.0 Flash是谷歌推出的最新一代多模态AI模型,以极快的响应速度和强大的推理能力著称。它支持文本、图像、音频、视频等多种输入输出形式,适用于开发智能助手、内容
Runway Gen-1 5是Runway公司推出的第五代AI视频生成与编辑平台,利用先进的扩散模型和深度学习技术,支持文本到视频、图像到视频、视频风格迁移、视频修复与扩展等功能。它提供实时协
Runway Gen-6是Runway公司推出的第六代AI视频生成与编辑工具,基于先进的扩散模型和Transformer架构,支持文本、图像、视频片段等多种输入方式,快速生成高质量、高分辨率的
Llama 4 Scout是Meta推出的最新开源多模态大语言模型,采用MoE架构,拥有109B参数但仅需单张H100 GPU即可运行。支持文本、图像多模态输入,具备128K上下文窗口,在代码
Runway Gen-3是Runway公司推出的第三代AI视频生成与编辑平台,基于扩散模型和Transformer架构,支持文本生成视频、图像生成视频、视频风格迁移、视频修复与扩展等功能,为创
文心一言是百度基于文心大模型打造的AI对话与创作平台,支持文本生成、知识问答、代码编写、图像理解、多轮对话等多种任务,适用于内容创作、编程辅助、智能客服、教育学习等场景,提供API和网页端服务
Moonshot 是一款基于大语言模型的智能对话与创作工具,专注于提供高效、自然的多轮对话体验,支持文本生成、信息检索、创意写作、代码辅助等多种场景,帮助用户提升工作与学习效率。
Stable Diffusion WebUI是一款基于Stable Diffusion模型的AI图像生成与编辑工具,提供直观的Web界面,支持文本生成图像、图像修复、风格迁移等功能,适用于设计
Yi是一款集成了人工智能开发、数据管理、内容生成等多功能的智能平台,支持文本、图像、音乐、视频等多种创作形式,并提供强大的API和开发工具,适用于开发者、创作者和企业用户。
ElevenLabs Voice 31 是一款基于深度学习的AI语音合成工具,支持文本转语音、语音克隆、多语言发音及情感调节,提供自然流畅的合成语音,适用于内容创作、配音、有声书、虚拟助手等场
Descript 73是一款集视频编辑、音频编辑、屏幕录制、转录和协作于一体的AI驱动工具,支持文本式编辑、语音克隆、自动字幕生成等功能,适用于内容创作者、教育工作者和团队协作。
Hedra 5.0是一款集视频生成、音频同步、角色动画于一体的AI创作工具,支持文本和图像驱动的高质量视频内容制作,适用于创意设计、营销推广和教育培训等场景。
Riffusion 13是一款基于深度学习模型的AI音乐生成工具,通过频谱图(spectrogram)技术实现实时音乐创作与风格转换,支持文本提示、音频输入及参数调节,适用于音乐制作、声音设计
Pika 9.0是一款先进的AI视频生成与编辑平台,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频。它提供实时编辑、风格迁移、背景替换等功能,适用于内容创作、营销和社交媒体。
Udio v2.5是Udio平台的最新版本,专注于利用人工智能技术生成高质量音乐。它支持文本到音乐、风格模仿、歌词生成等功能,适用于音乐制作人、内容创作者和爱好者,提供快速、灵活的音乐创作体验
Google Gemini Pro 是谷歌推出的强大多模态AI模型,支持文本、图像、音频、视频和代码的深度理解与生成。它通过Google AI Studio和Vertex AI提供API,助力
Descript-62是一款集成了先进AI语音合成、视频编辑和音频处理功能的综合性创作工具,支持文本转语音、语音克隆、多轨编辑和实时协作,适用于内容创作者、教育工作者和企业团队,能够大幅提升多
Riffusion-8是一款基于深度学习模型的AI音乐生成工具,通过分析音频频谱图实现实时音乐创作、风格迁移和声音合成。它利用Stable Diffusion架构处理音频数据,支持文本提示生成
Stable Audio 2.0 是 Stability AI 推出的新一代 AI 音乐生成工具,基于扩散模型技术,支持文本生成完整音乐、音频修复、风格转换等功能。用户只需输入描述性文字,即可
Pika 7.0是一款基于人工智能的视频生成与编辑工具,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频。它提供实时编辑、多风格转换、背景替换等功能,适用于内容创作、营销、教育等场景
Descript-58是一款集音频编辑、视频剪辑、字幕生成、屏幕录制和AI语音克隆于一体的智能创作工具,支持文本驱动编辑,让非专业人士也能轻松制作专业级内容。
Pika Labs 2.0是Pika Labs推出的新一代AI视频生成与编辑平台,支持文本、图像和视频输入,实现高质量视频创作、风格转换、局部编辑等功能,为创作者提供前所未有的灵活性和效率。
Pika 3.5是一款领先的AI视频生成工具,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频。适用于内容创作者、营销人员和开发者,无需专业剪辑技能即可制作动态视觉内容。
Descript Audio是一款基于人工智能的音频编辑和语音合成工具,支持文本转语音、语音克隆、音频修复和降噪等功能,适用于播客制作、视频配音、有声书创作和内容生产等场景。其核心优势在于通过
Lexica Art 是一款强大的AI图像生成与编辑工具,利用先进的深度学习模型,帮助用户快速创建高质量、风格多样的艺术作品。支持文本到图像生成、图像风格迁移、细节调整等功能,适用于设计师、艺
Pika Labs V9是一款基于人工智能的视频生成与编辑平台,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频,适用于创意设计、社交媒体内容制作和营销推广。
Pika Labs V5是一款领先的AI视频生成与编辑工具,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频。它提供实时编辑、风格迁移、背景替换等功能,适用于内容创作、营销和社交媒体
Pika Labs V2是一款基于人工智能的视频生成工具,支持文本、图像和视频输入,快速生成流畅、逼真的动态视频。适用于创意设计、营销推广、社交媒体内容制作等场景,无需专业视频编辑技能。
ElevenLabs Voice Studio 是一款基于深度学习的AI语音合成工具,支持文本转语音、语音克隆、多语言生成和情感语调控制,适用于内容创作、配音、有声书、虚拟助手等场景,提供高保
Leonardo AI V3是专为创意设计、游戏开发和数字艺术领域打造的高性能AI图像生成平台。它基于先进的深度学习模型,支持文本到图像、图像到图像、风格迁移、实时协作编辑等功能,提供从概念草
Stable Audio 3 是 Stability AI 推出的最新 AI 音乐生成工具,支持文本到音频、音频到音频的转换,提供高质量、可商用的音乐和音效生成,适用于音乐制作、视频配乐、游戏
Descript AI Studio 是一款集成了AI语音合成、视频编辑、音频处理、屏幕录制和协作功能的综合性创作工具,支持文本转语音、AI配音、自动字幕生成、视频剪辑和实时协作,适用于内容创
Pika Labs 9是一款基于人工智能的视频生成与编辑平台,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频内容,适用于创意制作、营销推广和教育培训等场景。
Pika-2是一款基于人工智能的视频生成工具,支持文本、图像和视频输入,快速生成高质量、风格多样的短视频,适用于内容创作、广告营销、社交媒体等多种场景。
Haiper AI 2.5 是一款基于先进人工智能技术的视频生成与编辑工具,支持文本到视频、图像到视频的转换,以及视频风格迁移、背景替换等功能。它利用深度学习模型,帮助用户快速创建高质量、富有
Kling AI 3.0是快手推出的最新AI视频生成模型,支持文本和图像生成高质量视频,具备高分辨率、长时长、物理模拟和电影级运镜等特性,广泛应用于内容创作、广告营销和教育培训等领域。
Udio-7是一款基于深度学习技术的AI音乐生成工具,支持文本到音乐、旋律创作、多风格混音及实时协作,适用于音乐制作人、内容创作者和开发者,提供高保真音频输出与灵活的API集成。
You.com AI Pro V4 是一款集成了先进大语言模型、实时搜索、多模态生成与个性化工作流的AI平台,支持文本、图像、代码、音乐等多种内容创作与智能分析,适用于开发者、创作者及企业用户
Gemini 2.0 Flash Exp是Google推出的实验性AI模型,专注于快速响应、多模态理解和高效任务处理。它支持文本、图像、音频等多种输入,适用于内容生成、数据分析、编程辅助等场景
Haiper AI 2.0 是一款基于深度学习的视频生成与编辑工具,支持文本转视频、图像动画、视频风格迁移等功能,无需专业剪辑技能即可快速创建高质量视频内容。
Descript AI Editor是一款集成AI技术的视频和音频编辑软件,支持文本驱动编辑、语音克隆、自动字幕生成、屏幕录制及协作功能,适用于内容创作者、播客制作者和团队协作,大幅提升编辑效
Stability AI 是一家致力于开源人工智能模型研发与部署的领先公司,旗下拥有 Stable Diffusion 系列模型,支持文本生成图像、视频、音频、3D 内容及编程辅助。平台提供
Pika Labs 3.1是一款基于人工智能的视频生成工具,支持文本和图像输入,快速生成高质量、风格多样的短视频,适用于内容创作、营销、教育等领域,无需专业视频编辑技能。
ElevenLabs Voice Design V41是一款先进的AI语音设计与生成工具,支持文本转语音、语音克隆和自定义语音设计,提供高度逼真、富有情感的语音输出,适用于内容创作、播客、有声
Pika Labs 3.0是领先的AI视频生成工具,支持文本和图像直接生成高质量视频,提供风格控制、运动编辑和实时协作功能,适用于创意设计、社交媒体和营销场景。
Descript-27是一款集成了人工智能技术的专业音频和视频编辑工具,支持文本驱动的编辑、语音克隆、自动字幕生成和协作工作流,适用于播客、视频制作和内容创作。
Descript-26是一款集音频编辑、视频编辑、转录、屏幕录制和协作功能于一体的AI驱动工具,支持文本编辑音频、自动填充、语音克隆等创新功能,适合内容创作者、播客制作者和团队协作使用。
Suno 4.0 是领先的AI音乐生成平台,通过先进的深度学习技术,让用户无需音乐专业知识即可创作出高质量、风格多样的音乐作品。支持文本到音乐、歌词生成、多风格混音等功能,适用于个人创作、商业
Midjourney 7.4是Midjourney系列的最新版本,专注于通过先进的深度学习模型生成高质量、艺术化的图像。它支持文本到图像生成、风格迁移、细节增强等功能,适用于设计师、艺术家和内
PixVerse V8是一款基于先进人工智能技术的视频生成工具,支持文本到视频、图像到视频等多种创作模式,提供高分辨率、多风格、多场景的视频生成能力,适用于内容创作者、营销人员、教育工作者等专
Gemini Ultra是Google DeepMind推出的顶级多模态AI模型,具备强大的推理、理解和生成能力,支持文本、图像、音频、视频和代码等多种输入输出形式,适用于复杂任务处理、科研分
Descript-17是一款集成了AI技术的视频和音频编辑软件,支持文本驱动编辑、自动转录、语音克隆、屏幕录制和协作功能,让内容创作变得像编辑文档一样简单。它适用于播客制作、视频剪辑、营销内容
Pixverse 4.0是一款基于人工智能的视频生成与图像创作工具,支持文本、图片和视频输入,快速生成高质量视频内容。它利用先进的深度学习模型,提供风格化视频、动态图像和创意特效,适用于内容创