Skip to main content
POST
Chat with MemOS (Complete Response)

Body

application/json

Request model for chat operations.

user_id
string
required

User ID

query
string
required

Chat query message

readable_cube_ids
string[] | null

List of cube IDs user can read for multi-cube chat

writable_cube_ids
string[] | null

List of cube IDs user can write for multi-cube chat

history
(ChatCompletionSystemMessageParam · object | ChatCompletionUserMessageParam · object | ChatCompletionAssistantMessageParam · object | ChatCompletionToolMessageParam · object)[] | null

Chat history

mode
enum<string>
default:fast

search mode: fast, fine, or mixture

Available options:
fast,
fine,
mixture
system_prompt
string | null

Base system prompt to use for chat

top_k
integer
default:10

Number of results to return

session_id
string | null

Session ID for soft-filtering memories

include_preference
boolean
default:true

Whether to handle preference memory

pref_top_k
integer
default:6

Number of preference results to return

model_name_or_path
string | null

Model name to use for chat

max_tokens
integer | null

Max tokens to generate

temperature
number | null

Temperature for sampling

top_p
number | null

Top-p (nucleus) sampling parameter

add_message_on_answer
boolean
default:true

Add dialogs to memory after chat

filter
Filter · object | null

Whether to use internet search

threshold
number
default:0.5

Threshold for filtering references

mem_cube_id
string | null

Cube ID to use for chat

moscube
boolean
default:false

(Deprecated) Whether to use legacy MemOSCube pipeline

Response

Successful Response