[PD] Fix large page size + chunk prefill (#5588)
This commit is contained in:
@@ -446,13 +446,16 @@ class MLATokenToKVPool(KVCache):
|
||||
]
|
||||
|
||||
self.layer_transfer_counter = None
|
||||
self.page_size = page_size
|
||||
|
||||
# for disagg
|
||||
def get_contiguous_buf_infos(self):
|
||||
# MLA has only one kv_buffer, so only the information of this buffer needs to be returned.
|
||||
kv_data_ptrs = [self.kv_buffer[i].data_ptr() for i in range(self.layer_num)]
|
||||
kv_data_lens = [self.kv_buffer[i].nbytes for i in range(self.layer_num)]
|
||||
kv_item_lens = [self.kv_buffer[i][0].nbytes for i in range(self.layer_num)]
|
||||
kv_item_lens = [
|
||||
self.kv_buffer[i][0].nbytes * self.page_size for i in range(self.layer_num)
|
||||
]
|
||||
return kv_data_ptrs, kv_data_lens, kv_item_lens
|
||||
|
||||
def get_key_buffer(self, layer_id: int):
|
||||
|
||||
Reference in New Issue
Block a user