c++枚举类型&&StarPU实现矩阵乘

1) 枚举类型

cpp 复制代码
#pragma once
#include<stdio.h>
#include<stdlib.h>
#include<string.h>
#include<windows.h>
#include<iostream>
#include <time.h>

enum Color {
	RED,				//RED=0
	GREEN,		//GREEN=1
	BLUE			//BLUE=2
};
int main()
{
	//定义数据类型为枚举类型Color的数组
	enum Color sky[3] = { RED,RED,RED};
	for (int i = 0; i < 3; i++) {
		printf("%d\n",sky[i]);
	}
}

2) StarPU实现矩阵乘

cpp 复制代码
#include <starpu.h>

#define N 100

// 定义在CPU上执行的任务
static void cpu_task(void *buffers[], void *cl_arg) {
    // 获取输入和输出矩阵
    float *A = (float *)STARPU_VECTOR_GET_PTR(buffers[0]);
    float *B = (float *)STARPU_VECTOR_GET_PTR(buffers[1]);
    float *C = (float *)STARPU_VECTOR_GET_PTR(buffers[2]);

    // 执行矩阵乘法
    for (int i = 0; i < N; i++) {
        for (int j = 0; j < N; j++) {
            C[i * N + j] = 0;
            for (int k = 0; k < N; k++) {
                C[i * N + j] += A[i * N + k] * B[k * N + j];
            }
        }
    }
}                        
// 定义在GPU上执行的任务
static void gpu_task(void *buffers[], void *cl_arg) {
    // 获取输入和输出矩阵
    float *A = (float *)STARPU_VECTOR_GET_PTR(buffers[0]);
    float *B = (float *)STARPU_VECTOR_GET_PTR(buffers[1]);
    float *C = (float *)STARPU_VECTOR_GET_PTR(buffers[2]);

    // 使用CUDA进行矩阵乘法
    // 这里省略具体的CUDA代码
}

int main(int argc, char **argv) {
    // 初始化StarPU
    starpu_init(NULL);

    // 分配数据
    float *A = (float *)malloc(N * sizeof(float));
    float *B = (float *)malloc(N * sizeof(float));
    float *C = (float *)malloc(N * sizeof(float));

    // 创建句柄
    starpu_data_handle_t handle_A, handle_B, handle_C;
    starpu_vector_data_register(&handle_A, STARPU_MAIN_RAM, (uintptr_t)A, N, sizeof(float));
    starpu_vector_data_register(&handle_B, STARPU_MAIN_RAM, (uintptr_t)B, N, sizeof(float));
    starpu_vector_data_register(&handle_C, STARPU_MAIN_RAM, (uintptr_t)C, N, sizeof(float));

    // 定义任务代码
    struct starpu_codelet cl;
    starpu_codelet_init(&cl);
    cl.where = STARPU_CPU | STARPU_CUDA;
    cl.cpu_funcs[0] = cpu_task;
    cl.cuda_funcs[0] = gpu_task;
    cl.nbuffers = 3;
    cl.modes[0] = STARPU_R;
    cl.modes[1] = STARPU_R;
    cl.modes[2] = STARPU_W;

    // 创建任务
    struct starpu_task *task = starpu_task_create();
    task->cl = &cl;
    //向缓冲区中填充数据
    task->handles[0] = handle_A;
    task->handles[1] = handle_B;
    task->handles[2] = handle_C;

    // 提交任务
    starpu_task_submit(task);

    // 等待任务完成
    starpu_task_wait_for_all();

    // 释放句柄
    starpu_data_unregister(handle_A);
    starpu_data_unregister(handle_B);
    starpu_data_unregister(handle_C);

    // 清理
    free(A);
    free(B);
    free(C);
    starpu_shutdown();
    return 0;
}
相关推荐
李妍.13 分钟前
02Numpy基础(上)
开发语言·python
TheBestRucy15 分钟前
Python 九阳神功之贰:面向对象(下)
开发语言·python
吃着火锅x唱着歌1 小时前
Effective C++ 学习笔记 条款43 学习处理模板化基类内的名称
c++·笔记·学习
AI_小站1 小时前
刚面完百度的 Agent 开发岗,我才发现:世界就是个巨大的草台班子
java·开发语言·人工智能·spring·百度·langchain
felixking2 小时前
C++20 协程
开发语言·c++·协程
Zane1994123 小时前
CAS 与原子类:Java 如何实现无锁编程
java·开发语言
码农颜4 小时前
6.3 主函数流程剖析
开发语言·php
TheBestRucy4 小时前
Python 九阳神功:从零筑基到线程飞升
服务器·开发语言·网络·人工智能·python
研☆香4 小时前
聊一聊前端的常见字 关键字
开发语言·前端·javascript
小小龙学IT4 小时前
FlatBuffers 深度解析:Google 开源零拷贝序列化库完全指南
c++·开源