mirror of
https://github.com/torvalds/linux.git
synced 2026-07-29 02:31:27 +02:00
drm/amdgpu: pass all the sdma scheds to amdgpu_mman
This will allow the use of all of them for clear/fill buffer operations. Since drm_sched_entity_init requires a scheduler array, we store schedulers rather than rings. For the few places that need access to a ring, we can get it from the sched using container_of. Since the code is the same for all sdma versions, add a new helper amdgpu_sdma_set_buffer_funcs_scheds to set buffer_funcs_scheds based on the number of sdma instances. Note: the new sched array is identical to the amdgpu_vm_manager one. These 2 could be merged. Signed-off-by: Pierre-Eric Pelloux-Prayer <pierre-eric.pelloux-prayer@amd.com> Acked-by: Felix Kuehling <felix.kuehling@amd.com> Reviewed-by: Christian König <christian.koenig@amd.com> Signed-off-by: Alex Deucher <alexander.deucher@amd.com>
This commit is contained in:
parent
dd88d42d9c
commit
01c836788b
|
|
@ -1462,6 +1462,8 @@ ssize_t amdgpu_get_soft_full_reset_mask(struct amdgpu_ring *ring);
|
||||||
ssize_t amdgpu_show_reset_mask(char *buf, uint32_t supported_reset);
|
ssize_t amdgpu_show_reset_mask(char *buf, uint32_t supported_reset);
|
||||||
void amdgpu_sdma_set_vm_pte_scheds(struct amdgpu_device *adev,
|
void amdgpu_sdma_set_vm_pte_scheds(struct amdgpu_device *adev,
|
||||||
const struct amdgpu_vm_pte_funcs *vm_pte_funcs);
|
const struct amdgpu_vm_pte_funcs *vm_pte_funcs);
|
||||||
|
void amdgpu_sdma_set_buffer_funcs_scheds(struct amdgpu_device *adev,
|
||||||
|
const struct amdgpu_buffer_funcs *buffer_funcs);
|
||||||
|
|
||||||
/* atpx handler */
|
/* atpx handler */
|
||||||
#if defined(CONFIG_VGA_SWITCHEROO)
|
#if defined(CONFIG_VGA_SWITCHEROO)
|
||||||
|
|
|
||||||
|
|
@ -3700,7 +3700,7 @@ int amdgpu_device_init(struct amdgpu_device *adev,
|
||||||
adev->num_rings = 0;
|
adev->num_rings = 0;
|
||||||
RCU_INIT_POINTER(adev->gang_submit, dma_fence_get_stub());
|
RCU_INIT_POINTER(adev->gang_submit, dma_fence_get_stub());
|
||||||
adev->mman.buffer_funcs = NULL;
|
adev->mman.buffer_funcs = NULL;
|
||||||
adev->mman.buffer_funcs_ring = NULL;
|
adev->mman.num_buffer_funcs_scheds = 0;
|
||||||
adev->vm_manager.vm_pte_funcs = NULL;
|
adev->vm_manager.vm_pte_funcs = NULL;
|
||||||
adev->vm_manager.vm_pte_num_scheds = 0;
|
adev->vm_manager.vm_pte_num_scheds = 0;
|
||||||
adev->gmc.gmc_funcs = NULL;
|
adev->gmc.gmc_funcs = NULL;
|
||||||
|
|
|
||||||
|
|
@ -708,12 +708,14 @@ int amdgpu_gmc_allocate_vm_inv_eng(struct amdgpu_device *adev)
|
||||||
void amdgpu_gmc_flush_gpu_tlb(struct amdgpu_device *adev, uint32_t vmid,
|
void amdgpu_gmc_flush_gpu_tlb(struct amdgpu_device *adev, uint32_t vmid,
|
||||||
uint32_t vmhub, uint32_t flush_type)
|
uint32_t vmhub, uint32_t flush_type)
|
||||||
{
|
{
|
||||||
struct amdgpu_ring *ring = adev->mman.buffer_funcs_ring;
|
struct amdgpu_ring *ring;
|
||||||
struct amdgpu_vmhub *hub = &adev->vmhub[vmhub];
|
struct amdgpu_vmhub *hub = &adev->vmhub[vmhub];
|
||||||
struct dma_fence *fence;
|
struct dma_fence *fence;
|
||||||
struct amdgpu_job *job;
|
struct amdgpu_job *job;
|
||||||
int r;
|
int r;
|
||||||
|
|
||||||
|
ring = to_amdgpu_ring(adev->mman.buffer_funcs_scheds[0]);
|
||||||
|
|
||||||
if (!hub->sdma_invalidation_workaround || vmid ||
|
if (!hub->sdma_invalidation_workaround || vmid ||
|
||||||
!adev->mman.buffer_funcs_enabled || !adev->ib_pool_ready ||
|
!adev->mman.buffer_funcs_enabled || !adev->ib_pool_ready ||
|
||||||
!ring->sched.ready) {
|
!ring->sched.ready) {
|
||||||
|
|
|
||||||
|
|
@ -168,7 +168,7 @@ amdgpu_ttm_job_submit(struct amdgpu_device *adev, struct amdgpu_ttm_buffer_entit
|
||||||
{
|
{
|
||||||
struct amdgpu_ring *ring;
|
struct amdgpu_ring *ring;
|
||||||
|
|
||||||
ring = adev->mman.buffer_funcs_ring;
|
ring = to_amdgpu_ring(adev->mman.buffer_funcs_scheds[0]);
|
||||||
amdgpu_ring_pad_ib(ring, &job->ibs[0]);
|
amdgpu_ring_pad_ib(ring, &job->ibs[0]);
|
||||||
WARN_ON(job->ibs[0].length_dw > num_dw);
|
WARN_ON(job->ibs[0].length_dw > num_dw);
|
||||||
|
|
||||||
|
|
@ -2298,18 +2298,17 @@ void amdgpu_ttm_set_buffer_funcs_status(struct amdgpu_device *adev, bool enable)
|
||||||
return;
|
return;
|
||||||
|
|
||||||
if (enable) {
|
if (enable) {
|
||||||
struct amdgpu_ring *ring;
|
|
||||||
struct drm_gpu_scheduler *sched;
|
struct drm_gpu_scheduler *sched;
|
||||||
|
|
||||||
if (!adev->mman.buffer_funcs_ring || !adev->mman.buffer_funcs_ring->sched.ready) {
|
if (!adev->mman.num_buffer_funcs_scheds ||
|
||||||
|
!adev->mman.buffer_funcs_scheds[0]->ready) {
|
||||||
dev_warn(adev->dev, "Not enabling DMA transfers for in kernel use");
|
dev_warn(adev->dev, "Not enabling DMA transfers for in kernel use");
|
||||||
return;
|
return;
|
||||||
}
|
}
|
||||||
|
|
||||||
num_clear_entities = 1;
|
num_clear_entities = 1;
|
||||||
num_move_entities = 1;
|
num_move_entities = 1;
|
||||||
ring = adev->mman.buffer_funcs_ring;
|
sched = adev->mman.buffer_funcs_scheds[0];
|
||||||
sched = &ring->sched;
|
|
||||||
r = amdgpu_ttm_buffer_entity_init(&adev->mman.gtt_mgr,
|
r = amdgpu_ttm_buffer_entity_init(&adev->mman.gtt_mgr,
|
||||||
&adev->mman.default_entity,
|
&adev->mman.default_entity,
|
||||||
DRM_SCHED_PRIORITY_KERNEL,
|
DRM_SCHED_PRIORITY_KERNEL,
|
||||||
|
|
@ -2446,7 +2445,7 @@ int amdgpu_copy_buffer(struct amdgpu_device *adev,
|
||||||
unsigned int i;
|
unsigned int i;
|
||||||
int r;
|
int r;
|
||||||
|
|
||||||
ring = adev->mman.buffer_funcs_ring;
|
ring = to_amdgpu_ring(adev->mman.buffer_funcs_scheds[0]);
|
||||||
|
|
||||||
if (!ring->sched.ready) {
|
if (!ring->sched.ready) {
|
||||||
dev_err(adev->dev,
|
dev_err(adev->dev,
|
||||||
|
|
@ -2679,6 +2678,31 @@ int amdgpu_ttm_evict_resources(struct amdgpu_device *adev, int mem_type)
|
||||||
return ttm_resource_manager_evict_all(&adev->mman.bdev, man);
|
return ttm_resource_manager_evict_all(&adev->mman.bdev, man);
|
||||||
}
|
}
|
||||||
|
|
||||||
|
void amdgpu_sdma_set_buffer_funcs_scheds(struct amdgpu_device *adev,
|
||||||
|
const struct amdgpu_buffer_funcs *buffer_funcs)
|
||||||
|
{
|
||||||
|
struct drm_gpu_scheduler *sched;
|
||||||
|
struct amdgpu_vmhub *hub;
|
||||||
|
int i;
|
||||||
|
|
||||||
|
adev->mman.buffer_funcs = buffer_funcs;
|
||||||
|
|
||||||
|
for (i = 0; i < adev->sdma.num_instances; i++) {
|
||||||
|
if (adev->sdma.has_page_queue)
|
||||||
|
sched = &adev->sdma.instance[i].page.sched;
|
||||||
|
else
|
||||||
|
sched = &adev->sdma.instance[i].ring.sched;
|
||||||
|
adev->mman.buffer_funcs_scheds[i] = sched;
|
||||||
|
}
|
||||||
|
|
||||||
|
/* Navi1x's workaround requires us to limit to a single SDMA sched
|
||||||
|
* for ttm.
|
||||||
|
*/
|
||||||
|
hub = &adev->vmhub[AMDGPU_GFXHUB(0)];
|
||||||
|
adev->mman.num_buffer_funcs_scheds = hub->sdma_invalidation_workaround ?
|
||||||
|
1 : adev->sdma.num_instances;
|
||||||
|
}
|
||||||
|
|
||||||
#if defined(CONFIG_DEBUG_FS)
|
#if defined(CONFIG_DEBUG_FS)
|
||||||
|
|
||||||
static int amdgpu_ttm_page_pool_show(struct seq_file *m, void *unused)
|
static int amdgpu_ttm_page_pool_show(struct seq_file *m, void *unused)
|
||||||
|
|
|
||||||
|
|
@ -87,7 +87,8 @@ struct amdgpu_mman {
|
||||||
|
|
||||||
/* buffer handling */
|
/* buffer handling */
|
||||||
const struct amdgpu_buffer_funcs *buffer_funcs;
|
const struct amdgpu_buffer_funcs *buffer_funcs;
|
||||||
struct amdgpu_ring *buffer_funcs_ring;
|
struct drm_gpu_scheduler *buffer_funcs_scheds[AMDGPU_MAX_RINGS];
|
||||||
|
u32 num_buffer_funcs_scheds;
|
||||||
bool buffer_funcs_enabled;
|
bool buffer_funcs_enabled;
|
||||||
|
|
||||||
/* @default_entity: for workarounds, has no gart windows */
|
/* @default_entity: for workarounds, has no gart windows */
|
||||||
|
|
|
||||||
|
|
@ -1340,8 +1340,7 @@ static const struct amdgpu_buffer_funcs cik_sdma_buffer_funcs = {
|
||||||
|
|
||||||
static void cik_sdma_set_buffer_funcs(struct amdgpu_device *adev)
|
static void cik_sdma_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &cik_sdma_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &cik_sdma_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version cik_sdma_ip_block =
|
const struct amdgpu_ip_block_version cik_sdma_ip_block =
|
||||||
|
|
|
||||||
|
|
@ -1235,8 +1235,7 @@ static const struct amdgpu_buffer_funcs sdma_v2_4_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v2_4_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v2_4_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &sdma_v2_4_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v2_4_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v2_4_ip_block = {
|
const struct amdgpu_ip_block_version sdma_v2_4_ip_block = {
|
||||||
|
|
|
||||||
|
|
@ -1677,8 +1677,7 @@ static const struct amdgpu_buffer_funcs sdma_v3_0_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v3_0_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v3_0_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &sdma_v3_0_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v3_0_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v3_0_ip_block =
|
const struct amdgpu_ip_block_version sdma_v3_0_ip_block =
|
||||||
|
|
|
||||||
|
|
@ -2626,13 +2626,9 @@ static const struct amdgpu_buffer_funcs sdma_v4_4_buffer_funcs = {
|
||||||
static void sdma_v4_0_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v4_0_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
if (amdgpu_ip_version(adev, SDMA0_HWIP, 0) >= IP_VERSION(4, 4, 0))
|
if (amdgpu_ip_version(adev, SDMA0_HWIP, 0) >= IP_VERSION(4, 4, 0))
|
||||||
adev->mman.buffer_funcs = &sdma_v4_4_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v4_4_buffer_funcs);
|
||||||
else
|
else
|
||||||
adev->mman.buffer_funcs = &sdma_v4_0_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v4_0_buffer_funcs);
|
||||||
if (adev->sdma.has_page_queue)
|
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].page;
|
|
||||||
else
|
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
static void sdma_v4_0_get_ras_error_count(uint32_t value,
|
static void sdma_v4_0_get_ras_error_count(uint32_t value,
|
||||||
|
|
|
||||||
|
|
@ -2316,11 +2316,7 @@ static const struct amdgpu_buffer_funcs sdma_v4_4_2_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v4_4_2_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v4_4_2_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &sdma_v4_4_2_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v4_4_2_buffer_funcs);
|
||||||
if (adev->sdma.has_page_queue)
|
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].page;
|
|
||||||
else
|
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
/**
|
/**
|
||||||
|
|
|
||||||
|
|
@ -2052,10 +2052,7 @@ static const struct amdgpu_buffer_funcs sdma_v5_0_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v5_0_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v5_0_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
if (adev->mman.buffer_funcs == NULL) {
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v5_0_buffer_funcs);
|
||||||
adev->mman.buffer_funcs = &sdma_v5_0_buffer_funcs;
|
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v5_0_ip_block = {
|
const struct amdgpu_ip_block_version sdma_v5_0_ip_block = {
|
||||||
|
|
|
||||||
|
|
@ -2056,10 +2056,7 @@ static const struct amdgpu_buffer_funcs sdma_v5_2_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v5_2_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v5_2_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
if (adev->mman.buffer_funcs == NULL) {
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v5_2_buffer_funcs);
|
||||||
adev->mman.buffer_funcs = &sdma_v5_2_buffer_funcs;
|
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v5_2_ip_block = {
|
const struct amdgpu_ip_block_version sdma_v5_2_ip_block = {
|
||||||
|
|
|
||||||
|
|
@ -1895,8 +1895,7 @@ static const struct amdgpu_buffer_funcs sdma_v6_0_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v6_0_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v6_0_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &sdma_v6_0_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v6_0_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v6_0_ip_block = {
|
const struct amdgpu_ip_block_version sdma_v6_0_ip_block = {
|
||||||
|
|
|
||||||
|
|
@ -1845,8 +1845,7 @@ static const struct amdgpu_buffer_funcs sdma_v7_0_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v7_0_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v7_0_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &sdma_v7_0_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v7_0_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v7_0_ip_block = {
|
const struct amdgpu_ip_block_version sdma_v7_0_ip_block = {
|
||||||
|
|
|
||||||
|
|
@ -1776,8 +1776,7 @@ static const struct amdgpu_buffer_funcs sdma_v7_1_buffer_funcs = {
|
||||||
|
|
||||||
static void sdma_v7_1_set_buffer_funcs(struct amdgpu_device *adev)
|
static void sdma_v7_1_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &sdma_v7_1_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &sdma_v7_1_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version sdma_v7_1_ip_block = {
|
const struct amdgpu_ip_block_version sdma_v7_1_ip_block = {
|
||||||
|
|
|
||||||
|
|
@ -833,8 +833,7 @@ static const struct amdgpu_buffer_funcs si_dma_buffer_funcs = {
|
||||||
|
|
||||||
static void si_dma_set_buffer_funcs(struct amdgpu_device *adev)
|
static void si_dma_set_buffer_funcs(struct amdgpu_device *adev)
|
||||||
{
|
{
|
||||||
adev->mman.buffer_funcs = &si_dma_buffer_funcs;
|
amdgpu_sdma_set_buffer_funcs_scheds(adev, &si_dma_buffer_funcs);
|
||||||
adev->mman.buffer_funcs_ring = &adev->sdma.instance[0].ring;
|
|
||||||
}
|
}
|
||||||
|
|
||||||
const struct amdgpu_ip_block_version si_dma_ip_block =
|
const struct amdgpu_ip_block_version si_dma_ip_block =
|
||||||
|
|
|
||||||
|
|
@ -129,13 +129,14 @@ svm_migrate_copy_memory_gart(struct amdgpu_device *adev, dma_addr_t *sys,
|
||||||
struct dma_fence **mfence)
|
struct dma_fence **mfence)
|
||||||
{
|
{
|
||||||
const u64 GTT_MAX_PAGES = AMDGPU_GTT_MAX_TRANSFER_SIZE;
|
const u64 GTT_MAX_PAGES = AMDGPU_GTT_MAX_TRANSFER_SIZE;
|
||||||
struct amdgpu_ring *ring = adev->mman.buffer_funcs_ring;
|
struct amdgpu_ring *ring;
|
||||||
struct amdgpu_ttm_buffer_entity *entity;
|
struct amdgpu_ttm_buffer_entity *entity;
|
||||||
u64 gart_s, gart_d;
|
u64 gart_s, gart_d;
|
||||||
struct dma_fence *next;
|
struct dma_fence *next;
|
||||||
u64 size;
|
u64 size;
|
||||||
int r;
|
int r;
|
||||||
|
|
||||||
|
ring = to_amdgpu_ring(adev->mman.buffer_funcs_scheds[0]);
|
||||||
entity = &adev->mman.move_entities[0];
|
entity = &adev->mman.move_entities[0];
|
||||||
|
|
||||||
mutex_lock(&entity->lock);
|
mutex_lock(&entity->lock);
|
||||||
|
|
|
||||||
Loading…
Reference in New Issue
Block a user