加载中...
已收录 25 个分类的 AI 工具,输入关键词按需求找工具
OpenAI 的通用 AI 助手,覆盖网页、桌面和移动端。现役模型为 GPT-5.6 系列,按能力分三档:Sol 是旗舰,主打复杂推理、长文档分析和深度编程;Terra 是均衡款,写作、翻译、表格整理、PPT 大纲这类日常办公任务性价比最高;Luna 走快速低价路线,适合批量摘要、改写、客服话术等高频轻活。功能上支持文件上传、联网深度研究、语音对话、图像生成和 Projects 项目空间。免费与 Go 套餐默认用 Luna,付费套餐可选 Sol。日常办公用 Terra、复杂编程切 Sol、批量轻活走 Luna,是比较经济的组合。国内访问官网有网络和支付门槛。
Anthropic 出品的 AI 助手,以长上下文和编程能力见长,被大量开发者当作日常编码主力。产品线分四档:Haiku 4.5 走轻量高速路线,适合批量分类、内容审核这类容错成本低的场景;Sonnet 5 是当前默认主力,主打 agentic 工作流——能自己规划步骤、调用工具、读结果再继续;Opus 5 面向深度调试和复杂判断这类答错代价高的任务;最新的 Fable 5.1 针对长时自主任务和科研场景。四档均支持文本与图像输入,Sonnet 5 及以上提供 100 万 token 上下文。除网页端和 App,还有开发者用的 Claude Code 命令行客户端和团队协作的 Claude Cowork。
GitHub 官方的 AI 编程助手,已从单纯的代码补全扩展为多形态的 agent 平台:除行内补全和 Next Edit Suggestions,还有 Copilot Chat、IDE agent mode、能自主提交 PR 的 cloud agent、代码审查,以及 CLI 和桌面 App。支持 MCP、自定义 agents 和 Spaces,可在 GPT-5.x、Claude、Gemini、Grok、Kimi 等模型之间切换。有免费版(补全额度有限、模型自动分配),付费档解锁高级模型和更多额度。适合深度绑定 GitHub 工作流的团队。
深度求索的 AI 助手,以推理和代码能力见长,网页端和 App 免费开放。当前旗舰是 DeepSeek-V4-Pro,2026 年 8 月转为正式版,轻量档为 V4-Flash,两者都支持 100 万 token 上下文,主打 Agent 与编程任务,原生支持 Responses API,提供 low/high/max 三档思考强度可调;另有实验性的多模态模型 V4-Flash-Vision-Exp。API 按量计费,2026 年 8 月起改为峰谷定价,低价仍是其相对优势,但早期那句「价格极低」已不如从前准确。适合看重推理与代码能力、又希望网页端免费用的人。
OpenAI 的编程智能体,用 Rust 编写、Apache-2.0 开源,GitHub 约 12 万 star 且仍在高频迭代。形态已从一个终端 CLI 扩展为四端:本地命令行、IDE 扩展、桌面 App 和云端 Codex Web,支持 skills、MCP 和 plugins,可跨文件编辑并执行命令。登录用 ChatGPT 账号或 API key;通过 model_provider 配置也能接入非 OpenAI 的模型,所以「只基于 GPT 模型」的说法已不准确。软件本身开源,但推理需要 OpenAI 账号或 API 额度。适合想在终端里把重复编码工作交给智能体的开发者。
Google 的 AI 助手,最大优势是与 Google 生态打通——Workspace、Android、Search 都能直接调用。现役主力 Gemini 3.7 Flash 于 2026 年 8 月转为正式可用,支持 100 万 token 上下文,输入覆盖文本、图像、视频、音频和 PDF,可调节 low/medium/high 三档思考深度来平衡质量与延迟。官方定位是编码和 agent 工作流的主力型号,在调试、生成可直接部署的代码、多步规划与工具调用上比上一代 3.6 Flash 明显提升。产品层面提供 Deep Research(跨多源生成带引用报告)、Gems(可复用指令的自定义助手)、Canvas(文档与原型协作)。开发者可通过 Gemini API 和 Google AI Studio 接入。
主打艺术化创意生图的 AI 图像工具,在概念设计、插画、氛围图这类看重美学的场景里口碑最好。当前默认版本 V8.2(2026 年 7 月起),V8.1 起支持原生 2K 直出、标准任务提速约 4-5 倍,V8.0 alpha 已下线;V8.2 主打美学表现、个性化和新的 Edit Model。没有免费额度,需要付费订阅(分多档,年付有折扣)。画质是否「天花板」属于主观评价,实际选型建议按风格偏好自己试。注意它主要通过 Discord 和网页端使用,工作流与常规设计软件不同。
Stability AI 的开源图像生成模型,是本地部署绘图和模型微调生态的基础之一。截至 2026 年 9 月,官方当前图像模型仍是 Stable Diffusion 3.5 系列(2024 年 10 月首发,含 Large / Turbo / Medium),社区许可下年营收 100 万美元以内可免费自部署商用,超出需企业授权。官方 2026 年的新品集中在 Stable Audio 3.0 和 Brand Studio。网传的「Stable Diffusion 4」在官网和官方 Hugging Face 均无发布记录,不宜采信。适合想本地部署、自己训练或微调模型的用户。
OpenAI 推出的 AI 视频生成模型,可根据文字或图片生成视频片段,在叙事连贯性与长镜头表现上较为突出,适合短片创作、广告概念演示与分镜预演等场景。目前通过 OpenAI 官方渠道提供,可用范围与额度以官网说明为准;生成视频仍需人工筛选与剪辑,最终效果与提示词精细度关系较大。
百度推出的 AI 助手,基于文心大模型,中文理解与表达是其长处。官方定位为一站式解决复杂问题的生产力工具,提供文字创作、图片创作、AI 阅读与智能体应用等能力,并设有「灵感探索」辅助拆解问题;适合写作、学习与日常办公等中文场景,免费可体验基础能力。
阿里的大模型产品,2026 年 3 月品牌已统一为「千问 / Qwen」,原「通义千问」名称停用。当前旗舰是 Qwen3.8-Max(2026 年 8 月发布,2.4T MoE、100 万 token 上下文),开源版 Qwen3.8-2.4T-A95B 同期放出;图像有 Qwen-Image-3.0、视频有 Wan 3.0。定位全模态 + C 端助手,千问 App 免费使用;API 走阿里云百炼按量付费,新用户有免费额度。适合在阿里云生态内做开发、或想直接调用国产开源大模型的用户。
阿里通义实验室推出的大模型产品,具备自然语言理解、文本生成、视觉理解与音频理解等多模态能力,官方站点汇总了全系列模型与行业资讯。开源版本较为丰富,开发者可通过阿里云按量调用;不同版本的开放程度与调用价格差异较大,选型前建议先看官网说明。
在线设计平台,2026 年 4 月发布 Canva AI 2.0,是 2013 年以来最大的一次更新,从模板设计平台转向对话式、代理式创作:基于自研 Canva Design Model 生成可分层编辑的设计,新增连接器、任务排程、联网研究、品牌智能等六类工作流,并与 Claude、ChatGPT 互通。官方称月活超 2.6 亿。免费版可用,高阶 AI 功能需订阅。需要注意 Canva AI 2.0 目前仍是 research preview,尚未完全定型。适合非设计专业但要快速出图、出视频封面和物料的人。
NVIDIA 官方的 LLM 推理优化库,用于在英伟达 GPU 上做高吞吐的生产级推理服务。用 Python API 定义模型,生成 Python / C++ 运行时,覆盖量化、MoE、KV cache 管理等优化。仓库活跃,最新稳定版 v1.2.1(2026 年 4 月),v1.3.0 仍在候选版推进。只支持 NVIDIA GPU,且 release notes 里 Known Issues 较多,版本间兼容性需要实测。适合已经在英伟达卡上跑推理、想把吞吐和延迟压到极致的服务端场景;个人轻量用途不太需要。
C/C++ 写的本地大模型推理框架,GitHub 约 12.7 万 star,几乎每天有提交,是本地部署生态里最常用的推理后端之一。定位早已不限于 LLaMA 系列,官方示例直接用 Qwen,支持各类 GGUF 模型。后端覆盖 CUDA、HIP、Metal、Vulkan、SYCL、CANN、MUSA、WebGPU 甚至 RISC-V,支持 1.5-8bit 量化和 CPU+GPU 混合推理,自带 llama-cli、llama-server(OpenAI 兼容 API + 内置 Web UI)。适合用消费级显卡跑本地模型,也常被其他项目当作底层推理引擎。版本发得极勤,追具体版本号意义不大。
阿里云的音视频转写与会议纪要工具,适合会议、访谈、课堂和长视频整理。能力已从单纯转写扩展为:实时与离线转写、说话人分离、章节速览、全文和发言摘要、待办提取、思维导图、PPT 抽取、口语转书面化、多语种双向互译,2026 年 9 月还更新了智能纪要 Agent。官方称支持中、英、粤、日、韩、德、法、俄语转写。有免费额度,超出按时长计费,另提供按量计费 API。适合经常要整理会议记录或访谈内容的人。
用 Go 写的开源本地 AI 推理服务器,主打 OpenAI 兼容 API,可以直接替换掉依赖 OpenAI 接口的应用而不用改代码。官方称无需 GPU 也能跑 LLM、视觉、语音、图像、视频,最新版 v4.9.0(2026 年 8 月)改为默认拒绝式鉴权,新增端到端上下文压缩和 vllm-cpp 视频模态支持。MIT 协议,GitHub 约 4.9 万 star,仍在活跃维护。适合想在自有硬件上快速挂一个 OpenAI 风格接口的团队;覆盖面广但依赖后端组合,性能调优成本比单一用途框架高。
本地大模型的桌面 / Web 操作界面,Gradio 界面跑在本地 7860 端口,是最老牌的本地模型前端之一。注意:项目仓库已更名为 oobabooga/textgen,是同一个项目的新名字。支持 llama.cpp、Transformers、ExLlamaV3、TensorRT-LLM 多种后端切换,含视觉、文档问答、工具调用与 MCP、LoRA 训练、图像生成,以及 OpenAI / Anthropic 兼容 API。便携版用 Electron 封装、解压即用,但仅支持 GGUF,完整功能需完整安装(约 10GB)。AGPL-3.0,约 4.8 万 star,仍在维护。
让 AI 通过自然语言驱动 Blender 完成 3D 建模的 MCP 服务器,原名 BlenderMCP,GitHub 约 2.6 万 star,2026 年 9 月仍在更新。项目已更名为「MCP for Blender」以区别于 Blender 官方,README 明确声明是第三方集成、非 Blender 出品。支持对象与材质操作、场景查看、执行 Python 代码,并能接入 Poly Haven、Sketchfab、Hyper3D、Hunyuan3D 等资产库。需要本地安装 Blender 3.0+ 和 uv,且同一时间只能运行一个服务端实例。适合想用对话方式提速 Blender 建模流程的人。
腾讯自研大模型,提供对话、生图、生视频、文/图生 3D 和语音识别等多模态能力,适合在腾讯云与腾讯文档生态内使用的企业场景。当前旗舰是 Hy4(2026 年 8 月更新,770B / 49B、100 万 token 上下文),主打 Agent、编程与长文办公,但仍标注 preview 状态;Hy3 于 2026 年 7 月正式发布。多模态侧有 HY Image 3.0 Plus(生图)、生视频、文/图生 3D 和 Hy ASR 3.0。注意版本命名与 preview 状态容易混淆,生产环境接入前建议先确认版本稳定性。
剪映内置的文本转语音功能,中文音色自然度在国内工具里属于第一梯队,适合短视频旁白、课件配音和有声内容。支持热门音色和音色克隆,官网把「文本朗读」列为 AI 功能之一。注意:原先所说的「完全免费」已不准确——基础音色多数可免费使用,但部分精品/真人复刻音色、音色克隆、批量导出和更高导出规格属于会员范围,官方页面未逐项标注免费边界,具体以客户端内标注为准。仅限剪映生态内使用,需要联网。
字节跳动旗下剪映的 AI 创作能力集合,官方定位为「全能 AI 创作伙伴」,涵盖 AI 成片、AI 图片设计、AI 配音与多轨道编辑中的智能功能。新手可零门槛上手,专业创作者也能提升出片效率,适合短视频、口播与图文内容的批量制作;全部能力在剪映客户端内使用,需联网,部分高级音色与导出规格属会员权益。
从语法检查工具转型而来的 AI 写作助手,母公司 2025 年 10 月已更名为 Superhuman,Grammarly 作为产品名保留。功能覆盖拼写语法实时纠正、段落重写、语气建议和校对,另外加了 Humanizer、AI Detector 等 agent。官方称有 4000 万用户、5 万家组织使用。2025 年上线的 Expert Review 因冒用记者与作家名义引发争议,2026 年集体诉讼后已下线。有免费版但生成额度有限,进阶功能需订阅。适合英文写作润色、邮件和学术场景。
从翻译工具扩展而来的 Language AI 平台,现在有 Translator、Voice(会议与当面实时翻译)、Write(写作润色)、Documents、API 五条产品线,主打企业市场,官方称服务超 20 万家企业。文档翻译支持 100 多种语言,但写作辅助只覆盖少数语种。翻译自然度口碑好,但「全球最准确」是 DeepL 的自我表述,近期没有独立机构的统一评测佐证。有免费版,字符数和整页翻译受限;付费版承诺不用于模型训练。适合需要高质量文档翻译和跨语种沟通的人。