开源AI工具
开源AI工具面向重视可控性、二次开发和数据边界的用户,可用于本地部署、模型研究或企业内部集成。选型时需要同时查看许可证、维护活跃度、硬件要求、安装难度与社区生态,而不能只看代码仓库是否公开。
开源AI工具面向重视可控性、二次开发和数据边界的用户,可用于本地部署、模型研究或企业内部集成。选型时需要同时查看许可证、维护活跃度、硬件要求、安装难度与社区生态,而不能只看代码仓库是否公开。
AstronClaw 是讯飞推出的 AI 办公助手,主打快速部署专属 AI 助手与 7×24 小时在线服务。AstronClaw 基于 OpenClaw 核心能力,支持打造可深度定制的个人 AI 助手,并可集成高效 skills,实现多渠道信息交互。作为一款面向效率提升与任务协同场景的 AI 办公产品,AstronClaw 适合用于信息处理、内容生成、办公沟通和日常工作流协作,帮助个人与团队以更低门槛获得持续在线、可扩展的智能办公体验。
PicoClaw 是一款开源的 AI 聊天助手,主打轻量化、跨平台和高效率运行。PicoClaw 采用 Go 构建,具备启动快、资源占用低、部署门槛低等特点,适合开发者和团队在本地设备、边缘硬件或多种系统环境中快速搭建智能助手。作为面向实际使用场景的 AI 聊天产品,PicoClaw 支持连接 Telegram、Discord、Slack、飞书、钉钉、企业微信、LINE 和 QQ 等多种沟通渠道,能够用于消息交互、智能问答、协作沟通和自动化助手场景。对于追求低成本部署与稳定体验的用户来说,PicoClaw 是兼顾性能、灵活性与扩展性的 AI 聊天工具。
献丑AI 是一个专注于AI视频创作的开源社区,围绕“创建、分享、学习、复刻爆款AI视频”打造内容与交流平台。用户可以在献丑AI中浏览热门AI视频案例,获取可参考的创作思路与提示词灵感,快速搭建自己的AI视频创作流程;也能发布作品与经验,和其他创作者一起讨论模型选择、镜头节奏与短视频叙事。对于想提升AI视频效率的个人创作者与团队来说,献丑AI通过社区化沉淀,让AI视频教程、提示词与复刻方法更易搜索、更易复用,帮助持续产出更稳定的AI视频内容。
AudioCraft 是 Meta AI 推出的生成式音频与 AI音乐工具库与在线演示,集合 MusicGen 文本生成音乐、AudioGen 文本生成音效,以及 EnCodec 神经音频压缩等能力。你可以用一句提示词快速生成不同风格配乐、环境声与拟真音效,并通过提示词控制节奏、氛围与时长,适用于短视频配乐、游戏音效原型、广告氛围音与创作灵感验证。AudioCraft 还提供开源代码与模型,方便开发者本地部署、集成到工作流并进行二次开发。
小智AI(XiaoZhi AI)是一套面向开发者与硬件厂商的开源AI硬件项目与控制台服务,主打低延迟语音对话与可扩展的智能体能力。小智AI基于Model Context Protocol(MCP)把语音识别、意图理解、记忆与工具调用串联起来,适配多种常见芯片与开发板,方便快速做出情感陪伴、智能家居控制、桌面语音助手与车载机器人等产品。通过小智AI控制台,用户可创建智能体、配置角色与行为,并完成设备绑定与管理,让小智AI从原型验证到量产接入更省心。
LTX-2 是一款面向创意制作的AI视频生成引擎,主打4K 48fps与音画同步,让AI视频从草稿到成片一体化完成。LTX-2 支持文本到视频与图像到视频,多关键帧与深度控制带来稳定运动与连贯镜头,适用于VFX、广告、故事板预演与影像修复。开放源码与API设计便于工作室、开发者与企业集成,消费级GPU即可运行。通过LoRA微调与流程化工具,LTX-2 在AI视频生成、AI视频编辑与大规模生产场景中实现高保真、高效率与可控性,帮助团队快速构建品牌化的视觉风格与稳定交付能力。
Deta Surf 是一款将浏览与笔记融为一体的 AI 浏览器与智能笔记本,让网页、文件与想法在同一处自然流动。Deta Surf 支持网页搜索、PDF 与 YouTube 内嵌阅读与提问,自动生成要点摘要与深度解析,笔记内可保留可溯源的引用链接。通过 Notebooks 收集站点、图片与文件,借助 Vertical Tabs 井然组织信息,并以 Surflets 创建可互动的小应用与可视化。Deta Surf 开源且本地优先,数据存储在设备上,可导入导出;支持自选大模型或本地 LLM,使用自带密钥,满足隐私、安全与高效研究的需求。
Helium Browser 是一款隐私优先的开源浏览器,默认启用无偏见广告拦截与跟踪防护,阻止第三方 Cookie 并尽力减少指纹识别,上手即安全。基于 Chromium,兼容全部扩展并匿名访问扩展商店;界面轻盈、启动迅速,支持 Split View 分屏与原生 !bangs 快捷直达网站,离线也可用。Helium Browser 不内置云同步与密码管理,提供自托管选项与快速安全更新,适合重视效率、控制力与数据主权的用户与团队。
Browser Operator 是一款开源、隐私友好的 AI 浏览器,面向研究、分析与自动化场景。Browser Operator 基于 Chromium 架构,支持本地 AI 推理与云端大模型协同,提供 AI Agent Studio 构建 AI 代理流程,自动抓取网页信息、提取要点与生成摘要,并能在多站点间完成表单、比价与线索整理。Browser Operator 内置研究助手、智能购物与人才搜寻模板,降低搭建门槛;全程透明可审计,数据本地可控。当前处于 Alpha 阶段,优先支持 macOS,适合重视隐私、安全与效率的个人和团队,将日常浏览升级为可编排的 AI 浏览器工作流。
BrowserOS 是一款开源、隐私优先的 AI 浏览器,主打“把文字变成行动”。BrowserOS 通过本地 AI 代理理解自然语言指令,自动完成点击、输入与跳转等网页操作,适合高频研究与表单流程自动化。它支持 Split View 将 ChatGPT、Claude、Gemini 等模型置于侧栏对话,边读边问更高效;兼容 Chromium 生态,常用 Chrome 扩展与数据可无缝迁移。BrowserOS 提供 MCP 服务器集成,可一键连接 Gmail、Calendar、Docs、Sheets 与 Notion,把浏览器升级为工作中枢;同时支持 Ollama 与 LM Studio 等本地模型或自带 API Key,确保数据本地可控。BrowserOS 跨平台覆盖 macOS、Windows 与 Linux,并内置语义检索与高亮标注,全面提升信息检索与网页办公效率。
Nook Browser 是一款开源、注重隐私与掌控力的现代浏览器。Nook Browser 以本地优先为核心,数据保存在你的设备上,一键导出与删除,减少同步与泄露风险。它通过 Rooms/Spaces 组织工作与兴趣,避免标签泛滥,并提供 Peek 快速预览与 Split View 分屏,让多任务浏览更高效。Nook Browser 追求简洁、干扰更少的上网体验,采用公开路线图与社区共创机制,易于扩展与定制。对于重视隐私、效率与可持续演进的用户与团队,Nook Browser 是兼顾轻量与可扩展性的理想浏览器选择。
Zen Browser 是一款强调专注与效率的开源浏览器,主张“更宁静的互联网”。Zen Browser 以隐私为先,弱化打扰与跟踪,适合需要稳定与安全的日常上网与网页办公。它提供 Workspaces 工作区、Compact Mode 精简界面、Glance 快速切换与 Split View 分屏等特性,让多任务管理更清晰。Zen Browser 由社区持续迭代,界面美观、性能轻快、可扩展性强,可满足开发者与内容创作者的高频使用场景。若你重视隐私、效率与舒适体验,Zen Browser 是兼顾美观与实用的浏览器选择。
Ladybird 是由非营利组织主导的全新独立网页浏览器与网页引擎,强调 Web 标准优先与从零构建。Ladybird 以跨平台为目标,现阶段专注 Linux 与 macOS,追求性能、稳定性与安全性,不引入其他浏览器内核代码,也不通过默认搜索分成或代币等方式商业化。项目开放源代码并欢迎开发者参与,通过 GitHub 与社区协作推进进度,规划在 2026 年推出面向早期用户的 Alpha 版本,适合注重开放、透明与控制力的用户与开发团队。
Scira AI 是一款开源的 AI 搜索引擎与 Perplexity 替代方案,主打“实时、可验证、可自托管”。它将 RAG(检索增强生成)与搜索 Grounding 结合,返回带来源引用的答案,适合研究、学习与知识检索场景。Scira AI 支持多模型切换,涵盖 Grok、Claude、DeepSeek、Qwen、OpenAI 等,提供 PDF 分析、历史记录与语音朗读等能力,并通过 Scira Lookout 实现主题监测与定时追踪。问:Scira AI 是什么?答:Scira AI 是一款开源 AI 搜索工具,提供实时搜索与可信引用。作为 Perplexity 替代,Scira AI 兼顾速度、透明度与可控性,既可直接使用产品站点,也可自建部署,满足个人与团队的 AI 搜索需求。
Cloudflare VibeSDK 是面向 AI编程 的开源参考实现,帮助团队在 Cloudflare Developer Platform 上快速构建与部署 AI 应用。它以“从自然语言到可运行应用”为核心路径,结合 Workers、Pages、KV、Durable Objects、Queues、R2、Vectorize 与 AI Gateway,覆盖生成、存储、推理与观测的全链路场景。简要定义:Cloudflare VibeSDK 是用于在 Cloudflare 边缘网络上进行 AI应用开发 与交付的一体化示例平台。常见用例包括智能客服、检索增强生成与全栈聊天应用,适合希望以低运维成本验证与扩展 AI 产品的团队。
Genmo Mochi 1 是面向创作者与团队的开源 AI 视频生成工具,支持文本生成视频、图像生成视频与逐镜头控制,突出物理一致性、角色连贯与高提示词对齐。Genmo Mochi 1 提供云端 Playground 与私有部署两种使用方式,便于在广告分镜、产品演示、教育动画、社媒短片等场景快速产出。作为“开源的 AI 视频生成模型”,Genmo Mochi 1 兼顾易用性与可扩展性,适合将 AI 视频生成融入现有创作流程与生产系统。
Kilo Code 是一款面向 VS Code 的开源AI编程代理扩展,主打将“架构—编码—调试”一体化联动。内置 Orchestrator、Architect、Code、Debug 四种模式,可自动拆解任务、生成实现、定位并修复错误;支持本地与云端大模型、OpenRouter 与自带 API Key,兼容 MCP Marketplace 与常见开发流程。定义:Kilo Code 是在 VS Code 内完成从方案到交付的端到端AI编程工具,适合个人与团队高效落地复杂项目、减少重复劳动与幻觉代码。
21st.dev 是一款专为前端设计与开发团队打造的 UI 组件发现与管理平台,集成 AI 智能 Agent,可在主流 IDE 中一键检索与导入高质量组件。用户可浏览、分享、复刻并自定义开源组件,支持实时预览与版本控制,助力统一团队视觉风格与开发规范。平台提供完善的 API 接口与 Magic MCP 功能,支持批量生成、参数化定制和快速原型迭代,无缝衔接设计与代码流程。简洁易用的操作界面与社区驱动生态,让设计工程师与“vibe 编码者”在协作中释放创意,提升项目开发效率与一致性。无需本地部署,云端协作与可导出种子项目,让团队轻松扩展与维护组件库,缩短项目上线周期。
Waveformer 是由 Replicate 开发的开源 AI 音乐生成平台,结合 Meta 的 MusicGen 模型,允许用户通过文本提示快速生成原创音乐,并可保存为音频文件或带波形动画的视频。用户只需输入描述性的文本,如“轻快的电子舞曲”或“悠扬的钢琴旋律”,即可生成符合需求的音乐作品,适用于视频制作、播客、游戏等多种场景。平台提供直观的用户界面,支持多种音乐风格和情绪,满足不同创作需求。Waveformer 的源代码已在 GitHub 上开源,支持开发者进行本地部署和二次开发,推动 AI 音乐技术的发展。
Melodisco 是一款集 AI 音乐播放器与生成器于一体的创新平台,允许用户探索、收听并创作 AI 生成的音乐作品。用户可以通过平台浏览热门、新发布或随机的 AI 歌曲,或使用内置的音乐生成工具,根据个人喜好创作独特的旋律。Melodisco 提供直观的用户界面,支持多种音乐风格和情绪,适合音乐爱好者、内容创作者和开发者使用。此外,平台的开源项目已在 GitHub 上发布,支持本地部署和二次开发,鼓励社区共同推动 AI 音乐技术的发展。
Piano Genie 是由 Google Magenta 团队开发的一款 AI 音乐创作工具,旨在帮助没有音乐背景的用户轻松演奏钢琴。用户只需使用键盘上的 1 至 8 数字键或点击屏幕上的彩色按钮,Piano Genie 即可实时将这些简单的输入转换为完整的 88 键钢琴演奏。该系统基于训练自 1400 场国际钢琴比赛表演的循环神经网络自动编码器,能够理解音乐的结构和节奏,生成流畅且富有表现力的旋律。Piano Genie 提供直观的界面,支持 MIDI 输入输出,适用于教育、娱乐和音乐创作等多种场景。其源代码已在 GitHub 上开源,鼓励开发者进行本地部署和二次开发,推动 AI 音乐技术的发展。
OpenVoiceOS(OVOS)是一个由社区驱动的开源语音AI平台,旨在为各种设备创建自定义的语音控制界面。该平台强调隐私和安全,允许用户在本地处理语音数据,避免将敏感信息发送到云端,从而增强数据保护。OVOS支持多种硬件平台,包括Raspberry Pi、Mycroft设备以及Linux桌面和笔记本电脑,适用于嵌入式系统和低规格设备。其模块化架构包括ovos-core、ovos-listener和ovos-messagebus等组件,支持插件化的语音识别(STT)和文本转语音(TTS)引擎,用户可以根据需求选择合适的插件。OVOS还提供了丰富的开发者工具和文档,方便开发者创建和部署自定义的语音应用程序。作为Mycroft项目的延续,OpenVoiceOS致力于提供一个透明、可定制且尊重用户隐私的语音助手解决方案。
n8n 是一款开源的工作流自动化平台,结合了可视化构建与代码灵活性,支持超过 500 种应用集成。用户可以通过拖拽界面或编写 JavaScript/Python 脚本,创建多步骤的自动化流程,适用于 IT 运维、安全响应、销售分析等多种场景。n8n 内置 AI 功能,支持构建基于 LLM 的代理系统,实现自然语言处理、数据提取和自动化决策。平台提供自托管和云端部署选项,确保数据安全与合规性。凭借其强大的扩展性和活跃的社区支持,n8n 成为技术团队实现高效自动化的理想选择。
DorkGPT 是一款基于 AI 的 Google Dork 查询生成工具,旨在帮助用户高效地构建高级搜索语句,以揭示隐藏的网页数据和潜在的安全漏洞。通过自然语言处理技术,用户只需输入简单的查询需求,DorkGPT 即可自动生成精准的 Google Dork 语句,适用于网络安全审计、开源情报(OSINT)研究、学术资料检索等多种场景。该平台强调负责任的使用,鼓励用户在合法和道德的框架内进行信息探索,是安全研究人员、记者和数据分析师的理想辅助工具。
Morphic 是一款完全开源的 AI 搜索引擎,结合生成式用户界面(Generative UI),提供自然语言问答、网页摘要、视频搜索等功能。平台支持多种 AI 模型(如 OpenAI、Anthropic、Google Generative AI、Groq、Ollama 等),并集成 Tavily、SearXNG、Exa 等搜索引擎,满足多样化的搜索需求。Morphic 提供 URL 指定搜索、视频搜索、模型切换、搜索历史记录、结果分享等功能,适用于开发者、研究人员和对数据隐私有高要求的团队。用户可通过 Docker 或 Vercel 部署本地版本,或使用官方托管服务,轻松集成到浏览器作为默认搜索引擎。Morphic 以其灵活性和可扩展性,成为探索 AI 搜索与生成式交互的理想平台。
OSS Insight 是由 PingCAP 推出的开源数据分析平台,专注于 GitHub 开源生态的可视化洞察。其核心功能 GitHub Data Explorer 允许用户通过自然语言提问,自动生成 SQL 查询,实时分析超过 80 亿条 GitHub 事件数据。平台基于 TiDB Cloud 和 Chat2Query 技术栈,支持无需编程经验的用户进行数据探索。主要功能包括:开发者行为分析、仓库趋势对比、技术领域排行榜、贡献者地理分布等。用户还可通过 Collections 模块查看 Web3、AI、数据库等热门技术领域的开源项目趋势。OSS Insight 提供 2D 和 3D 可视化界面,适用于开发者、数据分析师和研究人员深入了解开源社区动态。
LlamaCoder 是由 Together AI 推出的开源 AI 编程平台,旨在通过自然语言提示快速生成完整的 Web 应用。平台基于 Meta 的 Llama 3.1 405B 模型构建,支持生成 React 应用和组件,用户只需描述应用需求,LlamaCoder 即可生成相应的代码。平台提供在线使用和本地部署两种方式,适用于不同开发者的需求。LlamaCoder 集成了 Sandpack、Next.js、Tailwind CSS 等技术栈,支持实时预览和一键部署,适用于快速原型设计和产品迭代。其开源特性和活跃的社区支持,使其成为开发者探索 AI 编程的理想工具。
Dreamlook 是一款面向创意团队和开发者的在线 AI 图像生成与模型微调平台。通过优化 Stable Diffusion,用户无需本地部署即可在几分钟内完成模型训练,提升训练速度至原先的 2.5 倍,支持每日上千次并发运行。平台提供灵活的 API 接口和多档套餐,满足不同规模项目需求,并在训练结束后 48 小时内自动清除所有上传数据,确保隐私安全。丰富的 LoRA 导出与高分辨率输出能力,助力用户快速生成专业级定制化视觉内容。
AIimag.es是一款基于Stable Diffusion的开源离线AI绘图软件,支持Windows系统安装,用户只需输入中文或英文提示词即可快速生成高清图片;程序自动下载并配置模型,无需GPU配置与网络依赖,生成次数不限,商业用途亦可免费授权。内置多风格渲染与负向提示词、分辨率、采样步数等参数调节,满足插画、海报、电商、社媒等多场景设计需求;本地运行保障数据隐私,体积轻巧,解压即用,极大降低AI作图门槛,助力个人与团队高效产出原创视觉内容。
Distillery是FollowFox推出的开源AI文生图平台,支持25+生成参数与单图训练,10次每日免费出图;用户可在Discord或网页上传参考图或输入提示,秒级生成4K高清插画、概念艺术与商业产品图;支持局部修复、风格锁定与模型微调,提供API接入与私有部署,满足设计、电商、广告等多场景高质视觉创作需求。平台开放源码,教学文档完善,适合艺术家、品牌与开发者深入二次开发,快速提升创意效率与视觉差异化。
Invoke是一款面向创意团队的企业级生成式AI图像生产平台,集文生图、图生图、工作流编排与自定义模型训练于一体。支持LoRA、SDXL等开源框架,保障模型与素材完全归属用户;多用户安全空间、SSO权限与Provenance版权链路,确保数据合规及创作溯源。可通过拖拽节点快速构建批量产图流程,细粒度控制分区、参考图和提示权重,秒级生成4K渲染与迭代版本;API及私有化部署助力影视、游戏、电商与广告高效输出高品质视觉资产。
Turbo.Art 是由 Modal Labs 推出的 AI 绘图平台,基于 Stability 的 SDXL Turbo 模型提供实时智能图像生成与编辑功能。用户可在空白画布上自由涂画或输入文字提示,一键生成多风格高清画作,支持赛博朋克、写实、卡通及宫崎骏风等多种艺术样式。平台内置增强算法可对生成结果进行局部微调,并提供高质量 PNG/JPEG 导出。前端代码开源于 GitHub,支持 API 调用与自定义部署,助力设计师、内容创作者和开发者在广告、社交媒体及艺术创作中高效产出原创视觉内容。
Stable Diffusion WebUI是一个基于浏览器的AI图像生成平台,允许用户通过自然语言提示词快速创建高质量图像。平台集成了多种功能,包括文本生成图像(txt2img)、图像到图像生成(img2img)、图像修复(inpainting)和图像扩展(outpainting)等,满足用户在艺术创作、设计草图、广告素材等方面的多样化需求。用户无需本地部署或编程知识,只需通过网页界面操作,即可实现AI绘图。该平台支持多种模型和插件扩展,提供灵活的参数设置,适合设计师、内容创作者和AI爱好者提升创作效率和视觉表现力。