# Kubeflow vs Together AI

**Leader by Vioscale score:** Together AI

| Attribute | Kubeflow | Together AI |
|---|---|---|
| **Vioscale score** | 47.1 (44% (low)) | 72.8 (60% (medium)) |
| activity.commits_last_30d | 3 | - |
| adoption.dependent_repos | 40 | - |
| adoption.github_stars | 15,832 | - |
| deployment.options | `{"cloud":true,"on_prem":true,"self_hosted":true}` | `{"cloud":true}` |
| description.long | Kubeflow is an open-source platform that provides composable, Kubernetes-native tools for the entire AI lifecycle, including model training, hyperparameter tuning, pipeline orchestration, model management, and notebook environments. It enables AI teams to build scalable ML systems on any Kubernetes infrastructure. | Together AI provides cloud infrastructure for hosting and serving open-source language, image, audio, and video models through serverless inference, reserved capacity, and dedicated GPU instances. The platform includes fine-tuning capabilities, batch processing, managed storage, and GPU cluster support for custom model development and training—eliminating the need for users to manage underlying infrastructure. |
| features.capabilities | `{"role":"platform","managed_cloud":false,"model_serving":true,"self_hostable":true,"multi_provider":true,"vpc_deployment":true,"no_train_on_data":"yes","framework_agnostic":true,"experiment_tracking":true}` | `{"role":"platform","evaluation":false,"soc2_type_ii":false,"compute_model":"multi_tenant_hybrid","managed_cloud":true,"model_serving":true,"pricing_model":"per_million_tokens","self_hostable":false,"multi_provider":true,"vpc_deployment":true,"otel_compatible":false,"no_train_on_data":"yes","llm_observability":false,"prompt_management":false,"framework_agnostic":true,"experiment_tracking":false,"openai_compatible_rest_api_schema":false,"bring_your_own_weights_byow_hosting":true,"dynamic_batching_and_kv_cache_management":false,"massive_context_window_support_100k_plus":false,"hipaa_baa_compliance_for_medical_inference":false,"multimodal_vision_and_audio_in_out_support":true,"native_function_calling_and_strict_json_mode":false,"streaming_server_sent_events_sse_token_yield":false,"lpu_or_custom_silicon_for_extreme_low_latency":false,"zero_data_retention_training_opt_out_enterprise":true}` |
| integrations.count | 7 | - |
| integrations.list | `[{"name":"PyTorch"},{"name":"TensorFlow"},{"name":"JAX"},{"name":"XGBoost"},{"name":"Spark"},{"name":"HuggingFace"},{"name":"DeepSpeed"},{"name":"Megatron"},{"name":"MLX"}]` | - |
| license.spdx | Apache-2.0 | - |
| market.availability | - | `{"primaryMarkets":["US"],"availabilityScope":"global","availableCountries":[],"notAvailableCountries":[]}` |
| platform.support | `{"cli":true,"web":true}` | `{"cli":true,"web":true}` |
| pricing | `{"type":"open_source","freeTier":true,"sourceUrl":"https://kubeflow.org","retrievedAt":"2026-08-14T11:09:14.539Z"}` | `{"type":"usage","plans":[{"free":false,"name":"Serverless Inference","summary":"From $0.00014–$15/1M tokens depending on model. Pay only for usage.","features":["50+ open-source models","Variable pricing by model and token type","Batch API support","Private endpoints"],"components":[{"per":{"qty":1000000,"unit":"tokens"},"kind":"metered","amount":0.00014,"currency":"USD"}],"contactSales":false},{"free":false,"name":"Provisioned Throughput","summary":"Reserved throughput capacity with 99% SLA. PTU-based pricing structure.","features":["Reserved token capacity","99% uptime SLA","Token-based pricing model","Production-grade reliability"],"commitment":"monthly","contactSales":false},{"free":false,"name":"Dedicated Inference","summary":"$3.69–$8.99 per GPU per hour (on-demand); reserved discounts available.","features":["Single-tenant GPU instances","Guaranteed performance (no resource sharing)","Custom model support","Autoscaling for traffic spikes"],"commitment":"monthly","components":[{"kind":"fixed","amount":3.69,"period":"hour","currency":"USD"}],"contactSales":false}],"addOns":[{"name":"Fine-Tuning","components":[{"per":{"qty":1000000,"unit":"tokens"},"kind":"metered","amount":0.48,"currency":"USD"}]},{"name":"Managed Storage"},{"name":"GPU Clusters"}],"summary":"Usage-based pricing starting from $0.00014/1M tokens for serverless inference. Reserved capacity and dedicated GPU instances available; on-demand GPU pricing from $3.69/hour.","currency":"USD","freeTier":false,"sourceUrl":"https://www.together.ai/pricing","retrievedAt":"2026-08-21T12:44:34.463Z","startingPrice":{"unit":"tokens","amount":0.00014,"currency":"USD"},"billingPeriods":["month"]}` |
| pricing.free_tier | yes | no |
| pricing.model | open_source | commercial |
| pricing.price_level | free | low |
| pricing.starting_price | - | `{"amount":0.00014,"currency":"USD"}` |
| pricing.transparent | yes | yes |
| release.cadence_days | 25 | - |
| release.history | `[{"url":"https://github.com/kubeflow/kubeflow/releases/tag/redirect","date":"2026-04-29T13:58:28Z","type":"stable","version":"redirect"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.10.0","date":"2025-03-25T21:59:50Z","type":"stable","version":"v1.10.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.9.2","date":"2024-10-23T23:52:22Z","type":"stable","version":"v1.9.2"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.9.1","date":"2024-10-02T21:36:38Z","type":"stable","version":"v1.9.1"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.9.0","date":"2024-07-16T21:41:27Z","type":"stable","version":"v1.9.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0","date":"2023-11-01T13:36:46Z","type":"stable","version":"v1.8.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.6","date":"2023-10-31T23:06:29Z","type":"prerelease","version":"v1.8.0-rc.6"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.5","date":"2023-10-25T19:01:42Z","type":"prerelease","version":"v1.8.0-rc.5"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.4","date":"2023-10-25T12:02:17Z","type":"prerelease","version":"v1.8.0-rc.4"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.3","date":"2023-10-24T15:55:58Z","type":"prerelease","version":"v1.8.0-rc.3"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.2","date":"2023-10-16T10:37:58Z","type":"prerelease","version":"v1.8.0-rc.2"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.1","date":"2023-09-21T10:25:13Z","type":"prerelease","version":"v1.8.0-rc.1"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.8.0-rc.0","date":"2023-09-07T14:51:47Z","type":"prerelease","version":"v1.8.0-rc.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.7.0","date":"2023-03-29T15:38:55Z","type":"stable","version":"v1.7.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.6.0","date":"2022-09-07T18:12:53Z","type":"stable","version":"v1.6.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.5.0","date":"2022-03-10T17:21:38Z","type":"stable","version":"v1.5.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.5.0-rc.1","date":"2022-02-14T16:18:02Z","type":"prerelease","version":"v1.5.0-rc.1"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.5.0-rc.0","date":"2022-02-14T15:58:54Z","type":"prerelease","version":"v1.5.0-rc.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.4.0","date":"2021-10-11T21:39:04Z","type":"stable","version":"v1.4.0"},{"url":"https://github.com/kubeflow/kubeflow/releases/tag/v1.4-rc.0","date":"2021-09-14T17:18:05Z","type":"prerelease","version":"v1.4-rc.0"}]` | - |
| reliability.sla_pct | - | 99 |
| reliability.status_page | - | yes |
| security.disclosure_policy | - | yes |
| security.gdpr | - | yes |
| security.iso27001 | - | yes |
| security.scorecard | 5.5 | - |
| security.soc2 | - | yes |
| security.vulnerabilities | `{"count":0,"source":"https://advisories.ecosyste.ms/api/v1/advisories?ecosystem=go&package_name=github.com%2Fkubeflow%2Fkubeflow%2Fcomponents%2Fprofile-controller&per_page=100","last_12m":0,"max_severity":null}` | - |

## Capabilities (MLOps & LLMOps Tools)

| Capability | Kubeflow | Together AI |
|---|:--:|:--:|
| **Core** |  |  |
| Tool role | End-to-end ML platform | End-to-end ML platform |
| **Deployment** |  |  |
| Self-hostable / OSS core | ✓ | ✗ |
| Managed cloud available | ✗ | ✓ |
| On-prem / VPC deployment | ✓ | ✓ |
| **Observability** |  |  |
| LLM tracing / observability | - | ✗ |
| Evaluation (offline / LLM-judge / human) | - | ✗ |
| **Dev** |  |  |
| Prompt management + versioning | - | ✗ |
| **Tracking** |  |  |
| Experiment tracking / model registry | ✓ | ✗ |
| **Serving** |  |  |
| Model serving / inference endpoint | ✓ | ✓ |
| **Interop** |  |  |
| OpenTelemetry / OpenLLMetry compatible | - | ✗ |
| Framework-agnostic | ✓ | ✓ |
| **Gateway** |  |  |
| Multi-provider model support | ✓ | ✓ |
| **Data** |  |  |
| No-train-on-customer-data guarantee | Yes | Yes |

*Source: Vioscale. Generated 2026-09-01T14:46:47.324Z. "-" = undocumented, not absent.*
