{ "external_data": "model.onnx.data", "geometry": { "dynamic_batch": true, "dynamic_sequence": true, "max_batch": 32, "max_sequence": 1024, "passage_max_sequence": 1024, "query_max_sequence": 128 }, "graph": "model.onnx", "inputs": [ "input_ids", "attention_mask" ], "output": "embeddings", "precision": "float32", "provider_chain": [ "CUDAExecutionProvider", "CPUExecutionProvider" ], "role": "dense-retriever", "schema": "daecore.retrieval-onnx-serving.v1", "sha256": "caa534373eed1b15902478da09af100f75eccbf0e0538cfb34ca4f78db5824f4", "source_model_tree_sha256": "ae68b190bca3a5e9ac90e45ca4c1449c823899ca593d65526a96398c0e607703", "torch_required_at_runtime": false }