mirror of
https://git.datalinker.icu/vllm-project/vllm.git
synced 2026-09-09 03:07:01 +08:00
Fix openvino on GPU (#10793)
This commit is contained in:
parent
519cc6ca12
commit
9b14d978aa
@ -489,7 +489,7 @@ class OpenVINOWorker(LoraNotSupportedWorkerBase):
|
|||||||
block_size = cache_config.block_size
|
block_size = cache_config.block_size
|
||||||
seq_num_blocks = (seq_len + block_size - 1) // block_size
|
seq_num_blocks = (seq_len + block_size - 1) // block_size
|
||||||
|
|
||||||
seq_data, dummy_multi_modal_data = input_registry \
|
dummy_data = input_registry \
|
||||||
.dummy_data_for_profiling(model_config,
|
.dummy_data_for_profiling(model_config,
|
||||||
seq_len,
|
seq_len,
|
||||||
mm_registry)
|
mm_registry)
|
||||||
@ -498,11 +498,11 @@ class OpenVINOWorker(LoraNotSupportedWorkerBase):
|
|||||||
seq = SequenceGroupMetadata(
|
seq = SequenceGroupMetadata(
|
||||||
request_id=str(group_id),
|
request_id=str(group_id),
|
||||||
is_prompt=True,
|
is_prompt=True,
|
||||||
seq_data={group_id: seq_data},
|
seq_data={group_id: dummy_data.seq_data},
|
||||||
sampling_params=sampling_params,
|
sampling_params=sampling_params,
|
||||||
block_tables=block_tables,
|
block_tables=block_tables,
|
||||||
lora_request=None,
|
lora_request=None,
|
||||||
multi_modal_data=dummy_multi_modal_data)
|
multi_modal_data=dummy_data.multi_modal_data)
|
||||||
seqs.append(seq)
|
seqs.append(seq)
|
||||||
|
|
||||||
self.model_runner.block_size = tmp_cache_config.block_size
|
self.model_runner.block_size = tmp_cache_config.block_size
|
||||||
|
|||||||
Loading…
x
Reference in New Issue
Block a user