text-generation-webui/extensions/openai/typing.py

import json
import time
from typing import Dict, List

from pydantic import BaseModel, Field


class GenerationOptions(BaseModel):
    preset: str | None = Field(default=None, description="The name of a file under text-generation-webui/presets (without the .yaml extension). The sampling parameters that get overwritten by this option are the keys in the default_preset() function in modules/presets.py.")
    min_p: float = 0
    dynamic_temperature: bool = False
    dynatemp_low: float = 1
    dynatemp_high: float = 1
    dynatemp_exponent: float = 1
    smoothing_factor: float = 0
    smoothing_curve: float = 1
    top_k: int = 0
    repetition_penalty: float = 1
    repetition_penalty_range: int = 1024
    typical_p: float = 1
    tfs: float = 1
    top_a: float = 0
    epsilon_cutoff: float = 0
    eta_cutoff: float = 0
    guidance_scale: float = 1
    negative_prompt: str = ''
    penalty_alpha: float = 0
    mirostat_mode: int = 0
    mirostat_tau: float = 5
    mirostat_eta: float = 0.1
    temperature_last: bool = False
    do_sample: bool = True
    seed: int = -1
    encoder_repetition_penalty: float = 1
    no_repeat_ngram_size: int = 0
    dry_multiplier: float = 0
    dry_base: float = 1.75
    dry_allowed_length: int = 2
    dry_sequence_breakers: str = '"\\n", ":", "\\"", "*"'
    truncation_length: int = 0
    max_tokens_second: int = 0
    prompt_lookup_num_tokens: int = 0
    custom_token_bans: str = ""
    sampler_priority: List[str] | str | None = Field(default=None, description="List of samplers where the first items will appear first in the stack. Example: [\"top_k\", \"temperature\", \"top_p\"].")
    auto_max_new_tokens: bool = False
    ban_eos_token: bool = False
    add_bos_token: bool = True
    skip_special_tokens: bool = True
    grammar_string: str = ""


class CompletionRequestParams(BaseModel):
    model: str | None = Field(default=None, description="Unused parameter. To change the model, use the /v1/internal/model/load endpoint.")
    prompt: str | List[str]
    best_of: int | None = Field(default=1, description="Unused parameter.")
    echo: bool | None = False
    frequency_penalty: float | None = 0
    logit_bias: dict | None = None
    logprobs: int | None = None
    max_tokens: int | None = 16
    n: int | None = Field(default=1, description="Unused parameter.")
    presence_penalty: float | None = 0
    stop: str | List[str] | None = None
    stream: bool | None = False
    suffix: str | None = None
    temperature: float | None = 1
    top_p: float | None = 1
    user: str | None = Field(default=None, description="Unused parameter.")


class CompletionRequest(GenerationOptions, CompletionRequestParams):
    pass


class CompletionResponse(BaseModel):
    id: str
    choices: List[dict]
    created: int = int(time.time())
    model: str
    object: str = "text_completion"
    usage: dict


class ChatCompletionRequestParams(BaseModel):
    messages: List[dict]
    model: str | None = Field(default=None, description="Unused parameter. To change the model, use the /v1/internal/model/load endpoint.")
    frequency_penalty: float | None = 0
    function_call: str | dict | None = Field(default=None, description="Unused parameter.")
    functions: List[dict] | None = Field(default=None, description="Unused parameter.")
    logit_bias: dict | None = None
    max_tokens: int | None = None
    n: int | None = Field(default=1, description="Unused parameter.")
    presence_penalty: float | None = 0
    stop: str | List[str] | None = None
    stream: bool | None = False
    temperature: float | None = 1
    top_p: float | None = 1
    user: str | None = Field(default=None, description="Unused parameter.")

    mode: str = Field(default='instruct', description="Valid options: instruct, chat, chat-instruct.")

    instruction_template: str | None = Field(default=None, description="An instruction template defined under text-generation-webui/instruction-templates. If not set, the correct template will be automatically obtained from the model metadata.")
    instruction_template_str: str | None = Field(default=None, description="A Jinja2 instruction template. If set, will take precedence over everything else.")

    character: str | None = Field(default=None, description="A character defined under text-generation-webui/characters. If not set, the default \"Assistant\" character will be used.")
    bot_name: str | None = Field(default=None, description="Overwrites the value set by character field.", alias="name2")
    context: str | None = Field(default=None, description="Overwrites the value set by character field.")
    greeting: str | None = Field(default=None, description="Overwrites the value set by character field.")
    user_name: str | None = Field(default=None, description="Your name (the user). By default, it's \"You\".", alias="name1")
    user_bio: str | None = Field(default=None, description="The user description/personality.")
    chat_template_str: str | None = Field(default=None, description="Jinja2 template for chat.")

    chat_instruct_command: str | None = None

    continue_: bool = Field(default=False, description="Makes the last bot message in the history be continued instead of starting a new message.")


class ChatCompletionRequest(GenerationOptions, ChatCompletionRequestParams):
    pass


class ChatCompletionResponse(BaseModel):
    id: str
    choices: List[dict]
    created: int = int(time.time())
    model: str
    object: str = "chat.completion"
    usage: dict


class ChatPromptResponse(BaseModel):
    prompt: str


class EmbeddingsRequest(BaseModel):
    input: str | List[str] | List[int] | List[List[int]]
    model: str | None = Field(default=None, description="Unused parameter. To change the model, set the OPENEDAI_EMBEDDING_MODEL and OPENEDAI_EMBEDDING_DEVICE environment variables before starting the server.")
    encoding_format: str = Field(default="float", description="Can be float or base64.")
    user: str | None = Field(default=None, description="Unused parameter.")


class EmbeddingsResponse(BaseModel):
    index: int
    embedding: List[float]
    object: str = "embedding"


class EncodeRequest(BaseModel):
    text: str


class EncodeResponse(BaseModel):
    tokens: List[int]
    length: int


class DecodeRequest(BaseModel):
    tokens: List[int]


class DecodeResponse(BaseModel):
    text: str


class TokenCountResponse(BaseModel):
    length: int


class LogitsRequestParams(BaseModel):
    prompt: str
    use_samplers: bool = False
    top_logits: int | None = 50
    frequency_penalty: float | None = 0
    max_tokens: int | None = 16
    presence_penalty: float | None = 0
    temperature: float | None = 1
    top_p: float | None = 1


class LogitsRequest(GenerationOptions, LogitsRequestParams):
    pass


class LogitsResponse(BaseModel):
    logits: Dict[str, float]


class ModelInfoResponse(BaseModel):
    model_name: str
    lora_names: List[str]


class ModelListResponse(BaseModel):
    model_names: List[str]


class LoadModelRequest(BaseModel):
    model_name: str
    args: dict | None = None
    settings: dict | None = None


class LoraListResponse(BaseModel):
    lora_names: List[str]


class LoadLorasRequest(BaseModel):
    lora_names: List[str]


def to_json(obj):
    return json.dumps(obj.__dict__, indent=4)


def to_dict(obj):
    return obj.__dict__
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`import json`
			`import time`
[OpenAI Extension] Add 'max_logits' parameter in logits endpoint (#4916) 2023-12-14 22:22:43 -05:00			`from typing import Dict, List`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00
			`from pydantic import BaseModel, Field`


			`class GenerationOptions(BaseModel):`
Document the "preset" option in the API 2023-11-07 11:23:17 -05:00			`preset: str \| None = Field(default=None, description="The name of a file under text-generation-webui/presets (without the .yaml extension). The sampling parameters that get overwritten by this option are the keys in the default_preset() function in modules/presets.py.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`min_p: float = 0`
Add dynamic_temperature_low parameter (#5198) 2024-01-07 15:03:47 -05:00			`dynamic_temperature: bool = False`
dynatemp_low, dynatemp_high, dynatemp_exponent parameters (#5209) 2024-01-08 21:28:35 -05:00			`dynatemp_low: float = 1`
			`dynatemp_high: float = 1`
			`dynatemp_exponent: float = 1`
Quadratic sampling (#5403) --------- Co-authored-by: oobabooga <112222186+oobabooga@users.noreply.github.com> 2024-02-03 22:20:02 -05:00			`smoothing_factor: float = 0`
Cubic sampling w/ curve param (#5551) --------- Co-authored-by: oobabooga <112222186+oobabooga@users.noreply.github.com> 2024-03-03 11:22:21 -05:00			`smoothing_curve: float = 1`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`top_k: int = 0`
			`repetition_penalty: float = 1`
Parameters: change max_new_tokens & repetition_penalty_range defaults (#4842) 2023-12-07 18:04:52 -05:00			`repetition_penalty_range: int = 1024`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`typical_p: float = 1`
			`tfs: float = 1`
			`top_a: float = 0`
			`epsilon_cutoff: float = 0`
			`eta_cutoff: float = 0`
			`guidance_scale: float = 1`
			`negative_prompt: str = ''`
			`penalty_alpha: float = 0`
			`mirostat_mode: int = 0`
			`mirostat_tau: float = 5`
			`mirostat_eta: float = 0.1`
Reorder a parameter 2023-11-06 10:11:49 -05:00			`temperature_last: bool = False`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`do_sample: bool = True`
			`seed: int = -1`
			`encoder_repetition_penalty: float = 1`
			`no_repeat_ngram_size: int = 0`
DRY: A modern repetition penalty that reliably prevents looping (#5677) 2024-05-19 22:53:47 -04:00			`dry_multiplier: float = 0`
			`dry_base: float = 1.75`
			`dry_allowed_length: int = 2`
			`dry_sequence_breakers: str = '"\\n", ":", "\\"", "*"'`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`truncation_length: int = 0`
			`max_tokens_second: int = 0`
Add prompt_lookup_num_tokens parameter (#5296) 2024-01-17 15:09:36 -05:00			`prompt_lookup_num_tokens: int = 0`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`custom_token_bans: str = ""`
Add custom sampler order support (#5443) 2024-02-06 09:20:10 -05:00			`sampler_priority: List[str] \| str \| None = Field(default=None, description="List of samplers where the first items will appear first in the stack. Example: [\"top_k\", \"temperature\", \"top_p\"].")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`auto_max_new_tokens: bool = False`
			`ban_eos_token: bool = False`
			`add_bos_token: bool = True`
			`skip_special_tokens: bool = True`
			`grammar_string: str = ""`


Reorder the parameters in the FastAPI documentation 2023-11-06 12:55:36 -05:00			`class CompletionRequestParams(BaseModel):`
Add system_message parameter, document model (unused) parameter 2023-11-10 09:47:00 -05:00			`model: str \| None = Field(default=None, description="Unused parameter. To change the model, use the /v1/internal/model/load endpoint.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`prompt: str \| List[str]`
Document unused parameters 2023-11-07 11:56:09 -05:00			`best_of: int \| None = Field(default=1, description="Unused parameter.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`echo: bool \| None = False`
			`frequency_penalty: float \| None = 0`
			`logit_bias: dict \| None = None`
			`logprobs: int \| None = None`
			`max_tokens: int \| None = 16`
Document unused parameters 2023-11-07 11:56:09 -05:00			`n: int \| None = Field(default=1, description="Unused parameter.")`
openai extension: wrong frequency_penalty type (#4512) 2023-11-08 09:23:51 -05:00			`presence_penalty: float \| None = 0`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`stop: str \| List[str] \| None = None`
			`stream: bool \| None = False`
			`suffix: str \| None = None`
			`temperature: float \| None = 1`
			`top_p: float \| None = 1`
Implement echo/suffix parameters 2023-11-07 11:43:45 -05:00			`user: str \| None = Field(default=None, description="Unused parameter.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00

Reorder the parameters in the FastAPI documentation 2023-11-06 12:55:36 -05:00			`class CompletionRequest(GenerationOptions, CompletionRequestParams):`
			`pass`


Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`class CompletionResponse(BaseModel):`
			`id: str`
			`choices: List[dict]`
			`created: int = int(time.time())`
			`model: str`
			`object: str = "text_completion"`
			`usage: dict`


Reorder the parameters in the FastAPI documentation 2023-11-06 12:55:36 -05:00			`class ChatCompletionRequestParams(BaseModel):`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`messages: List[dict]`
Add system_message parameter, document model (unused) parameter 2023-11-10 09:47:00 -05:00			`model: str \| None = Field(default=None, description="Unused parameter. To change the model, use the /v1/internal/model/load endpoint.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`frequency_penalty: float \| None = 0`
Document unused parameters 2023-11-07 11:56:09 -05:00			`function_call: str \| dict \| None = Field(default=None, description="Unused parameter.")`
			`functions: List[dict] \| None = Field(default=None, description="Unused parameter.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`logit_bias: dict \| None = None`
			`max_tokens: int \| None = None`
Document unused parameters 2023-11-07 11:56:09 -05:00			`n: int \| None = Field(default=1, description="Unused parameter.")`
openai extension: wrong frequency_penalty type (#4512) 2023-11-08 09:23:51 -05:00			`presence_penalty: float \| None = 0`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`stop: str \| List[str] \| None = None`
			`stream: bool \| None = False`
			`temperature: float \| None = 1`
			`top_p: float \| None = 1`
Document unused parameters 2023-11-07 11:56:09 -05:00			`user: str \| None = Field(default=None, description="Unused parameter.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00
			`mode: str = Field(default='instruct', description="Valid options: instruct, chat, chat-instruct.")`

Jinja templates for Instruct and Chat (#4874) 2023-12-12 15:23:14 -05:00			`instruction_template: str \| None = Field(default=None, description="An instruction template defined under text-generation-webui/instruction-templates. If not set, the correct template will be automatically obtained from the model metadata.")`
			`instruction_template_str: str \| None = Field(default=None, description="A Jinja2 instruction template. If set, will take precedence over everything else.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00
			`character: str \| None = Field(default=None, description="A character defined under text-generation-webui/characters. If not set, the default \"Assistant\" character will be used.")`
Correct field alias types for OpenAI extension (#5257) 2024-01-14 11:30:36 -05:00			`bot_name: str \| None = Field(default=None, description="Overwrites the value set by character field.", alias="name2")`
API: Make user_name/bot_name the official and name1/name2 the alias 2024-01-09 22:06:11 -05:00			`context: str \| None = Field(default=None, description="Overwrites the value set by character field.")`
			`greeting: str \| None = Field(default=None, description="Overwrites the value set by character field.")`
UI: Add a new "User description" field for user personality/biography (#5691) 2024-03-11 22:41:57 -04:00			`user_name: str \| None = Field(default=None, description="Your name (the user). By default, it's \"You\".", alias="name1")`
Better way to handle user_bio default in the API (alternative to bdcf31035f06d666f01339c9af2447d6c2b83bcc) 2024-03-29 13:54:01 -04:00			`user_bio: str \| None = Field(default=None, description="The user description/personality.")`
Jinja templates for Instruct and Chat (#4874) 2023-12-12 15:23:14 -05:00			`chat_template_str: str \| None = Field(default=None, description="Jinja2 template for chat.")`
Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00
			`chat_instruct_command: str \| None = None`

			`continue_: bool = Field(default=False, description="Makes the last bot message in the history be continued instead of starting a new message.")`


Reorder the parameters in the FastAPI documentation 2023-11-06 12:55:36 -05:00			`class ChatCompletionRequest(GenerationOptions, ChatCompletionRequestParams):`
			`pass`


Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`class ChatCompletionResponse(BaseModel):`
			`id: str`
			`choices: List[dict]`
			`created: int = int(time.time())`
			`model: str`
			`object: str = "chat.completion"`
			`usage: dict`


Add a /v1/internal/chat-prompt endpoint (#5879) 2024-04-18 23:24:46 -04:00			`class ChatPromptResponse(BaseModel):`
			`prompt: str`


Add /v1/internal/lora endpoints (#4652) 2023-11-18 22:35:22 -05:00			`class EmbeddingsRequest(BaseModel):`
[OpenAI Extension] Add more types to Embeddings Endpoint (#4895) 2023-12-14 22:26:16 -05:00			`input: str \| List[str] \| List[int] \| List[List[int]]`
Add /v1/internal/lora endpoints (#4652) 2023-11-18 22:35:22 -05:00			`model: str \| None = Field(default=None, description="Unused parameter. To change the model, set the OPENEDAI_EMBEDDING_MODEL and OPENEDAI_EMBEDDING_DEVICE environment variables before starting the server.")`
			`encoding_format: str = Field(default="float", description="Can be float or base64.")`
			`user: str \| None = Field(default=None, description="Unused parameter.")`


			`class EmbeddingsResponse(BaseModel):`
			`index: int`
			`embedding: List[float]`
			`object: str = "embedding"`


Add types to the encode/decode/token-count endpoints 2023-11-07 22:05:36 -05:00			`class EncodeRequest(BaseModel):`
			`text: str`


Add /v1/internal/logits endpoint (#4650) 2023-11-18 21:19:31 -05:00			`class EncodeResponse(BaseModel):`
Add types to the encode/decode/token-count endpoints 2023-11-07 22:05:36 -05:00			`tokens: List[int]`
Add /v1/internal/logits endpoint (#4650) 2023-11-18 21:19:31 -05:00			`length: int`
Add types to the encode/decode/token-count endpoints 2023-11-07 22:05:36 -05:00

Add /v1/internal/logits endpoint (#4650) 2023-11-18 21:19:31 -05:00			`class DecodeRequest(BaseModel):`
Add types to the encode/decode/token-count endpoints 2023-11-07 22:05:36 -05:00			`tokens: List[int]`


			`class DecodeResponse(BaseModel):`
			`text: str`


			`class TokenCountResponse(BaseModel):`
			`length: int`


Add /v1/internal/logits endpoint (#4650) 2023-11-18 21:19:31 -05:00			`class LogitsRequestParams(BaseModel):`
			`prompt: str`
			`use_samplers: bool = False`
[OpenAI Extension] Add 'max_logits' parameter in logits endpoint (#4916) 2023-12-14 22:22:43 -05:00			`top_logits: int \| None = 50`
Add /v1/internal/logits endpoint (#4650) 2023-11-18 21:19:31 -05:00			`frequency_penalty: float \| None = 0`
			`max_tokens: int \| None = 16`
			`presence_penalty: float \| None = 0`
			`temperature: float \| None = 1`
			`top_p: float \| None = 1`


			`class LogitsRequest(GenerationOptions, LogitsRequestParams):`
			`pass`


			`class LogitsResponse(BaseModel):`
[OpenAI Extension] Add 'max_logits' parameter in logits endpoint (#4916) 2023-12-14 22:22:43 -05:00			`logits: Dict[str, float]`
Add /v1/internal/logits endpoint (#4650) 2023-11-18 21:19:31 -05:00

Add /v1/internal/model-info endpoint 2023-11-07 21:59:02 -05:00			`class ModelInfoResponse(BaseModel):`
			`model_name: str`
			`lora_names: List[str]`


Add /v1/internal/lora endpoints (#4652) 2023-11-18 22:35:22 -05:00			`class ModelListResponse(BaseModel):`
			`model_names: List[str]`


Add /v1/internal/model/load endpoint (tentative) 2023-11-07 23:58:06 -05:00			`class LoadModelRequest(BaseModel):`
			`model_name: str`
			`args: dict \| None = None`
			`settings: dict \| None = None`


Add /v1/internal/lora endpoints (#4652) 2023-11-18 22:35:22 -05:00			`class LoraListResponse(BaseModel):`
			`lora_names: List[str]`
Make /v1/embeddings functional, add request/response types 2023-11-10 10:34:27 -05:00

Add /v1/internal/lora endpoints (#4652) 2023-11-18 22:35:22 -05:00			`class LoadLorasRequest(BaseModel):`
			`lora_names: List[str]`
Make /v1/embeddings functional, add request/response types 2023-11-10 10:34:27 -05:00

Make OpenAI API the default API (#4430) 2023-11-06 00:38:29 -05:00			`def to_json(obj):`
			`return json.dumps(obj.__dict__, indent=4)`


			`def to_dict(obj):`
			`return obj.__dict__`