nvptx_target_teams_distribute_parallel_for_simd_codegen.cpp source code [clang_source_code/test/OpenMP/nvptx_target_teams_distribute_parallel_for_simd

1	// Test target codegen - host bc file has to be created first.
2	// RUN: %clang_cc1 -verify -fopenmp -fopenmp-version=45 -fopenmp-cuda-mode -x c++ -triple powerpc64le-unknown-unknown -fopenmp-targets=nvptx64-nvidia-cuda -emit-llvm-bc %s -o %t-ppc-host.bc
3	// RUN: %clang_cc1 -verify -fopenmp -fopenmp-version=45 -fopenmp-cuda-mode -x c++ -triple nvptx64-unknown-unknown -fopenmp-targets=nvptx64-nvidia-cuda -emit-llvm %s -fopenmp-is-device -fopenmp-host-ir-file-path %t-ppc-host.bc -o - \| FileCheck %s --check-prefix CHECK --check-prefix CHECK-64
4	// RUN: %clang_cc1 -verify -fopenmp -fopenmp-version=45 -fopenmp-cuda-mode -x c++ -triple i386-unknown-unknown -fopenmp-targets=nvptx-nvidia-cuda -emit-llvm-bc %s -o %t-x86-host.bc
5	// RUN: %clang_cc1 -verify -fopenmp -fopenmp-version=45 -fopenmp-cuda-mode -x c++ -triple nvptx-unknown-unknown -fopenmp-targets=nvptx-nvidia-cuda -emit-llvm %s -fopenmp-is-device -fopenmp-host-ir-file-path %t-x86-host.bc -o - \| FileCheck %s --check-prefix CHECK --check-prefix CHECK-32
6	// RUN: %clang_cc1 -verify -fopenmp -fopenmp-version=45 -fopenmp-cuda-mode -fexceptions -fcxx-exceptions -x c++ -triple nvptx-unknown-unknown -fopenmp-targets=nvptx-nvidia-cuda -emit-llvm %s -fopenmp-is-device -fopenmp-host-ir-file-path %t-x86-host.bc -o - \| FileCheck %s --check-prefix CHECK --check-prefix CHECK-32
7	// expected-no-diagnostics
8	#ifndef HEADER
9	#define HEADER
10
11	// Check that the execution mode of all 4 target regions on the gpu is set to SPMD Mode.
12	// CHECK-DAG: {{@__omp_offloading_.+l30}}_exec_mode = weak constant i8 0
13	// CHECK-DAG: {{@__omp_offloading_.+l36}}_exec_mode = weak constant i8 0
14	// CHECK-DAG: {{@__omp_offloading_.+l41}}_exec_mode = weak constant i8 0
15	// CHECK-DAG: {{@__omp_offloading_.+l46}}_exec_mode = weak constant i8 0
16
17	#define N 1000
18	#define M 10
19
20	template<typename tx>
21	tx ftemplate(int n) {
22	tx a[N];
23	short aa[N];
24	tx b[10];
25	tx c[M][M];
26	tx f = n;
27	tx l;
28	int k;
29
30	#pragma omp target teams distribute parallel for simd lastprivate(l) dist_schedule(static,128) schedule(static,32)
31	for(int i = 0; i < n; i++) {
32	a[i] = 1;
33	l = i;
34	}
35
36	#pragma omp target teams distribute parallel for simd map(tofrom: aa) num_teams(M) thread_limit(64)
37	for(int i = 0; i < n; i++) {
38	aa[i] += 1;
39	}
40
41	#pragma omp target teams distribute parallel for simd map(tofrom:a, aa, b) if(target: n>40) proc_bind(spread)
42	for(int i = 0; i < 10; i++) {
43	b[i] += 1;
44	}
45
46	#pragma omp target teams distribute parallel for simd collapse(2) firstprivate(f) private(k)
47	for(int i = 0; i < M; i++) {
48	for(int j = 0; j < M; j++) {
49	k = M;
50	c[i][j] = i+j*f+k;
51	}
52	}
53
54	return a[0];
55	}
56
57	int bar(int n){
58	int a = 0;
59
60	a += ftemplate<int>(n);
61
62	return a;
63	}
64
65	// CHECK-DAG: [[MEM_TY:%.+]] = type { [128 x i8] }
66	// CHECK-DAG: [[SHARED_GLOBAL_RD:@.+]] = common addrspace(3) global [[MEM_TY]] zeroinitializer
67	// CHECK-DAG: [[KERNEL_PTR:@.+]] = internal addrspace(3) global i8* null
68	// CHECK-DAG: [[KERNEL_SIZE:@.+]] = internal unnamed_addr constant i{{64\|32}} 4
69	// CHECK-DAG: [[KERNEL_SHARED:@.+]] = internal unnamed_addr constant i16 1
70
71	// CHECK-LABEL: define {{.*}}void {{@__omp_offloading_.+}}_l30(
72	// CHECK-DAG: [[THREAD_LIMIT:%.+]] = call i32 @llvm.nvvm.read.ptx.sreg.ntid.x()
73	// CHECK: call void @__kmpc_spmd_kernel_init(i32 [[THREAD_LIMIT]], i16 0, i16 0)
74	// CHECK: call void @__kmpc_get_team_static_memory(i16 1, i8* addrspacecast (i8 addrspace(3)* getelementptr inbounds ([[MEM_TY]], [[MEM_TY]] addrspace(3)* [[SHARED_GLOBAL_RD]], i32 0, i32 0, i32 0) to i8), i{{64\|32}} 4, i16 1, i8* addrspacecast (i8* addrspace(3)* [[KERNEL_PTR]] to i8**))
75	// CHECK: [[TEAM_ALLOC:%.+]] = load i8, i8 addrspace(3)* [[KERNEL_PTR]],
76	// CHECK: [[BC:%.+]] = bitcast i8* [[TEAM_ALLOC]] to [[REC:%.+]]*
77	// CHECK: getelementptr inbounds [[REC]], [[REC]]* [[BC]], i{{[0-9]+}} 0, i{{[0-9]+}} 0
78	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 91,
79	// CHECK: {{call\|invoke}} void [[OUTL1:@.+]](
80	// CHECK: call void @__kmpc_for_static_fini(
81	// CHECK: call void @__kmpc_restore_team_static_memory(i16 1, i16 1)
82	// CHECK: call void @__kmpc_spmd_kernel_deinit_v2(i16 0)
83	// CHECK: ret void
84
85	// CHECK: define internal void [[OUTL1]](
86	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 33,
87	// CHECK: call void @__kmpc_for_static_fini(
88	// CHECK: ret void
89
90	// CHECK-LABEL: define {{.*}}void {{@__omp_offloading_.+}}(
91	// CHECK-DAG: [[THREAD_LIMIT:%.+]] = call i32 @llvm.nvvm.read.ptx.sreg.ntid.x()
92	// CHECK: call void @__kmpc_spmd_kernel_init(i32 [[THREAD_LIMIT]], i16 0, i16 0)
93	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 91,
94	// CHECK: {{call\|invoke}} void [[OUTL2:@.+]](
95	// CHECK: call void @__kmpc_for_static_fini(
96	// CHECK: call void @__kmpc_spmd_kernel_deinit_v2(i16 0)
97	// CHECK: ret void
98
99	// CHECK: define internal void [[OUTL2]](
100	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 33,
101	// CHECK: call void @__kmpc_for_static_fini(
102	// CHECK: ret void
103
104	// CHECK-LABEL: define {{.*}}void {{@__omp_offloading_.+}}(
105	// CHECK-DAG: [[THREAD_LIMIT:%.+]] = call i32 @llvm.nvvm.read.ptx.sreg.ntid.x()
106	// CHECK: call void @__kmpc_spmd_kernel_init(i32 [[THREAD_LIMIT]], i16 0, i16 0)
107	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 91,
108	// CHECK: {{call\|invoke}} void [[OUTL3:@.+]](
109	// CHECK: call void @__kmpc_for_static_fini(
110	// CHECK: call void @__kmpc_spmd_kernel_deinit_v2(i16 0)
111	// CHECK: ret void
112
113	// CHECK: define internal void [[OUTL3]](
114	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 33,
115	// CHECK: call void @__kmpc_for_static_fini(
116	// CHECK: ret void
117
118	// CHECK: define {{.*}}void {{@__omp_offloading_.+}}({{.+}}, i{{32\|64}} [[F_IN:%.+]])
119	// CHECK: store {{.+}} [[F_IN]], {{.+}}* {{.+}},
120	// CHECK-DAG: [[THREAD_LIMIT:%.+]] = call i32 @llvm.nvvm.read.ptx.sreg.ntid.x()
121	// CHECK: call void @__kmpc_spmd_kernel_init(i32 [[THREAD_LIMIT]], i16 0, i16 0)
122	// CHECK: store {{.+}} 99, {{.+}}* [[COMB_UB:%.+]], align
123	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 91, {{.+}}, {{.+}}, {{.+}}* [[COMB_UB]],
124	// CHECK: {{call\|invoke}} void [[OUTL4:@.+]](
125	// CHECK: call void @__kmpc_for_static_fini(
126	// CHECK: call void @__kmpc_spmd_kernel_deinit_v2(i16 0)
127	// CHECK: ret void
128
129	// CHECK: define internal void [[OUTL4]](
130	// CHECK: call void @__kmpc_for_static_init_4({{.+}}, {{.+}}, {{.+}} 33,
131	// CHECK: call void @__kmpc_for_static_fini(
132	// CHECK: ret void
133
134	#endif
135

Clang Project