diff --git a/tensorrt_llm/llmapi/__init__.py b/tensorrt_llm/llmapi/__init__.py index 1bd895dbd59b..e0967a5cc243 100644 --- a/tensorrt_llm/llmapi/__init__.py +++ b/tensorrt_llm/llmapi/__init__.py @@ -18,13 +18,14 @@ ExtendedRuntimePerfKnobConfig, KvCacheConfig, LlmArgs, LookaheadDecodingConfig, MambaStateConfig, MedusaDecodingConfig, MiniMaxM3SparseAttentionConfig, - MoeConfig, MTPDecodingConfig, NGramDecodingConfig, - PARDDecodingConfig, PrometheusMetricsConfig, - ReorderRequestPolicyConfig, RocketSparseAttentionConfig, - SADecodingConfig, SAEnhancerConfig, - SaveHiddenStatesDecodingConfig, SchedulerConfig, - SkipSoftmaxAttentionConfig, TorchCompileConfig, - TorchLlmArgs, UserProvidedDecodingConfig) + MoeConfig, MTPDecodingConfig, MultimodalConfig, + NGramDecodingConfig, PARDDecodingConfig, + PrometheusMetricsConfig, ReorderRequestPolicyConfig, + RocketSparseAttentionConfig, SADecodingConfig, + SAEnhancerConfig, SaveHiddenStatesDecodingConfig, + SchedulerConfig, SkipSoftmaxAttentionConfig, + TorchCompileConfig, TorchLlmArgs, + UserProvidedDecodingConfig) from .llm_utils import KvCacheRetentionConfig, QuantAlgo, QuantConfig from .mm_encoder import MultimodalEncoder from .mpi_session import MpiCommSession @@ -91,4 +92,5 @@ 'PrometheusMetricsConfig', 'ThinkingBudgetLogitsProcessor', 'add_thinking_budget_logits_processor', + 'MultimodalConfig', ]