Skip to content
[ Verified actually-free ]

Best free & open-weight tools

Open-source engines (ComfyUI, A1111), local LLM runners (Ollama, llama.cpp), and open-weight diffusion models (Flux, Wan 2.2, Hunyuan). Filter by VRAM, compute location, or Apple Silicon support.

FILTERS //86 / 86 SHOWN
HARDWARE:
86 TOOLS

ComfyUI

The nodal workflow engine for serious diffusion.

OPEN SOURCE6–16 GB VRAM
VRAM fit6–16 GB

Wan 2.2

Open-weight video diffusion from Alibaba.

OPEN SOURCE12–48 GB VRAM
VRAM fit12–48 GB

FLUX.1 [dev]

12B parameter open-weight diffusion model.

OPEN SOURCE8–24 GB VRAM
VRAM fit8–24 GB

Cline

Agentic coding in VS Code — reads, writes, runs, browses.

OPEN SOURCECLOUD · NO GPU

HunyuanVideo

13B open-weight cinematic text-to-video.

OPEN SOURCE24–48 GB VRAM
VRAM fit24–48 GB

vLLM

High-throughput LLM serving for GPUs.

OPEN SOURCE24–80 GB VRAM
VRAM fit24–80 GB

Open WebUI

Self-hosted ChatGPT-style frontend for Ollama / OpenAI.

OPEN SOURCEVIA OLLAMA

F5-TTS

Zero-shot voice cloning TTS — 15 s of audio is enough.

OPEN SOURCE8–12 GB VRAM
VRAM fit8–12 GB

Hunyuan3D-2

Tencent's open 3D generator — multi-view, PBR, ready-to-use meshes.

OPEN SOURCE12–16 GB VRAM
VRAM fit12–16 GB

CrewAI

Role-playing agents working as a crew.

FREEMIUMCPU-CAPABLE

llama.cpp

The C++ inference engine powering most local LLMs.

OPEN SOURCECPU-CAPABLE

Modal

Serverless Python for GPU workloads.

FREEMIUM16–80 GB VRAM
VRAM fit16–80 GB

Continue

Open-source Copilot — VS Code & JetBrains, any model.

OPEN SOURCECPU-CAPABLE

LobeChat

Beautifully designed chat UI with plugins and image generation.

OPEN SOURCECPU-CAPABLE

Mochi 1

Genmo's 10-B open-weight T2V — the first 'genuinely fluid' OSS video model.

OPEN SOURCE24–60 GB VRAM
VRAM fit24–60 GB

Jan

Open-source ChatGPT desktop — runs models locally or via API.

OPEN SOURCECPU-CAPABLE

FluxGym

Dead-simple Flux LoRA training in a Gradio UI.

OPEN SOURCE12–20 GB VRAM
VRAM fit12–20 GB

faster-whisper

Whisper, 4× faster, same accuracy. CTranslate2 backend.

OPEN SOURCE2–6 GB VRAM
VRAM fit2–6 GB

LTX-Video

Real-time-ish open video diffusion from Lightricks.

OPEN SOURCE12–16 GB VRAM
VRAM fit12–16 GB

Msty

Polished local-LLM client with split chats and knowledge stacks.

FREEMIUM · $4.16/MOCPU-CAPABLE

smolagents

Hugging Face's minimal code-writing agent library.

OPEN SOURCECPU-CAPABLE

Kohya_ss

The standard SDXL/Flux LoRA training UI.

OPEN SOURCE12–24 GB VRAM
VRAM fit12–24 GB

Transformers

The library every LLM ships against first.

OPEN SOURCE2–24 GB VRAM
VRAM fit2–24 GB

Diffusers

Hugging Face's go-to library for every diffusion model.

OPEN SOURCE4–12 GB VRAM
VRAM fit4–12 GB

Magi-1

Autoregressive video diffusion at 24 GB.

OPEN SOURCE24–48 GB VRAM
VRAM fit24–48 GB

Aider

Terminal-native AI pair programmer with git awareness.

OPEN SOURCECPU-CAPABLE

TRELLIS

Microsoft Research's structured 3D representation model.

OPEN SOURCE16–24 GB VRAM
VRAM fit16–24 GB

AnythingLLM

RAG-first local LLM workspace with workspaces and agents.

OPEN SOURCECPU-CAPABLE

Agno

High-performance multimodal agents.

FREEMIUMCPU-CAPABLE

OpenAI Whisper

The reference open-source speech-to-text model.

OPEN SOURCE2–10 GB VRAM
VRAM fit2–10 GB

AutoGPT

The first viral autonomous-agent project.

FREEMIUMCPU-CAPABLE

MMAudio

Generate synchronized audio for any silent video.

OPEN SOURCE8–12 GB VRAM
VRAM fit8–12 GB

WhisperX

Whisper + speaker diarisation + word-level timestamps.

OPEN SOURCE4–8 GB VRAM
VRAM fit4–8 GB

SwarmUI

Power-user front-end that wraps ComfyUI.

OPEN SOURCE8–24 GB VRAM
VRAM fit8–24 GB

AutoGen

Microsoft's multi-agent conversation framework.

OPEN SOURCECPU-CAPABLE

CogVideoX 5B

Open-source text-to-video diffusion from THUDM.

OPEN SOURCE12–24 GB VRAM
VRAM fit12–24 GB

Tabby

Self-hosted, GPU-accelerated coding autocompletion.

FREEMIUM · $19/MO4–8 GB VRAM
VRAM fit4–8 GB

TripoSR

Single-image to 3D mesh in under a second on a 4090.

OPEN SOURCE6–8 GB VRAM
VRAM fit6–8 GB

Nerfstudio

The open framework for NeRF and Gaussian Splatting research.

OPEN SOURCE8–24 GB VRAM
VRAM fit8–24 GB

OneTrainer

Modern alternative trainer for SD/SDXL/Flux.

OPEN SOURCE12–24 GB VRAM
VRAM fit12–24 GB

AnimateDiff

Add motion to any SD checkpoint via a motion module.

OPEN SOURCE8–12 GB VRAM
VRAM fit8–12 GB

FaceFusion

The most active open face-swap toolkit.

OPEN SOURCE2–8 GB VRAM
VRAM fit2–8 GB

NVIDIA Cosmos

World-foundation models for physical AI.

OPEN SOURCE24–80 GB VRAM
VRAM fit24–80 GB

InvokeAI

Production-leaning SD studio with canvas & batch.

OPEN SOURCE8–16 GB VRAM
VRAM fit8–16 GB

Inspire Pack

Regional prompting, segs, and the Lora-Block-Weight system.

OPEN SOURCEVIA COMFYUI

Fooocus

Stable Diffusion XL, dialed to one button.

OPEN SOURCE4–8 GB VRAM
VRAM fit4–8 GB

Stable Audio Open

Open-weight text-to-audio — 47-second sound effects and music.

OPEN SOURCE6–8 GB VRAM
VRAM fit6–8 GB

SUPIR

Diffusion-based photorealistic upscaler.

OPEN SOURCE12–24 GB VRAM
VRAM fit12–24 GB

Pyramid Flow

Memory-efficient T2V via pyramidal flow matching.

OPEN SOURCE16–24 GB VRAM
VRAM fit16–24 GB

Bark

Suno's expressive transformer-based TTS.

OPEN SOURCE8–12 GB VRAM
VRAM fit8–12 GB

Stable Zero123

Novel-view synthesis — generate any angle from a single image.

OPEN SOURCE6–8 GB VRAM
VRAM fit6–8 GB

BabyAGI

Minimal task-driven autonomous agent.

OPEN SOURCECPU-CAPABLE

Instant-NGP

NVIDIA's seconds-to-train hash-grid NeRF.

OPEN SOURCE8–12 GB VRAM
VRAM fit8–12 GB

Tortoise TTS

Slow, but the quality is worth the wait.

OPEN SOURCE4–8 GB VRAM
VRAM fit4–8 GB