OptionalexcludeOptionalmaxMax cost per 1K tokens (input + output)
OptionalmaxMax acceptable latency in ms
OptionalminMinimum context window needed
OptionalpreferredSpecific model to prefer
OptionalpreferredSpecific provider to prefer
Required capabilities
Preferred strategy
Exclude these providers