Python-native deploys
Definieer containers, GPU's en schaling als Python-decorators — geen Dockerfiles of YAML.
Python-native serverless platform voor GPU-jobs en AI-inference
Modal is een serverless platform voor AI- en data-workloads: je schrijft een Python-functie, decoreert die met `@app.function(gpu="H100")` en Modal regelt containers, GPU's, autoscaling en scheduling. Cold starts liggen typisch rond de 2-4 seconden, en je betaalt per seconde alleen voor wat draait — geen idle-kosten. Het platform ondersteunt GPU's van T4 tot H100 en B200, volumes voor model-weights, scheduled jobs, webhooks en sandboxes voor het veilig uitvoeren van agent-gegenereerde code. Modal is uitgegroeid tot dev-favoriet voor batch-inference, fine-tuning en custom AI-pipelines: alle infrastructuur als Python-code, zonder Kubernetes of Dockerfiles te beheren.
Feiten geverifieerd op 6 juni 2026 · hoe wij beoordelen
Modal maakt serverless GPU-jobs in Python triviaal: deploy een functie en draai 'm op A100's. Dev-favoriet voor batch-AI en model-inference; voor één-klik OSS-modellen via API is Replicate eenvoudiger.
Waarom op de site: Modal werd snel een populair platform voor AI-engineers die Python-native workflows willen draaien op serverless GPU-infra zonder Kubernetes te beheren.
Beste alternatief: replicate
AI-engineers en data-teams die Python-workloads op GPU's willen draaien — batch-inference, fine-tuning, custom pipelines — zonder zelf clusters of Kubernetes te beheren.
Definieer containers, GPU's en schaling als Python-decorators — geen Dockerfiles of YAML.
On-demand T4 tot H100 en B200, per seconde afgerekend zonder idle-kosten.
Containers starten typisch in 2-4 seconden, ook met grote model-images.
Schaalt automatisch van nul naar honderden containers op basis van request-volume.
Persistente volumes voor model-weights en datasets, gedeeld over functies.
Geïsoleerde omgevingen om onvertrouwde of agent-gegenereerde code veilig uit te voeren.
Cron-achtige scheduling en HTTP-endpoints om pipelines te orchestreren.
Pay-per-use per seconde compute. Starter-plan gratis met $30/maand aan gratis credits; Team-plan $250/maand plus verbruik. GPU-tarieven circa: T4 ~$0,59/uur, A100 ~$3,72/uur, H100 ~$4,30/uur.
Prijzen indicatief — controleer altijd de actuele tarieven bij de aanbieder.
Typ een toolnaam, categorie of use case
Zoeken...
Geen tools gevonden