//clika-runtime/io.clika.modelverse/Capabilities/inputModalities
inputModalities
[common]
val inputModalities: List<String>
The modalities the model's requests may carry, in the library's own spellings: text, audio, vision, video, bounding_boxes, embedding, depth, segmentation, ranking, keypoints. A model whose inputs carry vision takes images in its turns (ChatMessage.images); maxImagesPerRequest says how many one request may carry.