---
title: "inputModalities"
sidebar_label: "inputModalities"
description: "Kotlin binding reference: inputModalities."
---

<!-- Generated by tools/api_reference/generate_api_docs.py. Do not edit. -->

//[clika-runtime](../../../index.md)/[io.clika.modelverse](../index.md)/[Capabilities](index.md)/[inputModalities](inputModalities.md)

# inputModalities

[common]\
val [inputModalities](inputModalities.md): [List](https://kotlinlang.org/api/core/kotlin-stdlib/kotlin.collections/-list/index.html)&lt;[String](https://kotlinlang.org/api/core/kotlin-stdlib/kotlin/-string/index.html)&gt;

The modalities the model's requests may carry, in the library's own spellings: `text`, `audio`, `vision`, `video`, `bounding_boxes`, `embedding`, `depth`, `segmentation`, `ranking`, `keypoints`. A model whose inputs carry `vision` takes images in its turns ([ChatMessage.images](../ChatMessage/images.md)); [maxImagesPerRequest](maxImagesPerRequest.md) says how many one request may carry.