两种常见的C语言实现64位无符号整数乘以64位无符号整数的实现方法

以下是两种常见的C语言实现64位无符号整数乘以64位无符号整数的实现方法,分别给出可移植版本和现代编译器优化版本:

方法1:可移植版本(通用标准C)

c 复制代码
#include <stdint.h>

typedef struct {
    uint64_t lo; // 低64位
    uint64_t hi; // 高64位
} uint128_t;

uint128_t mul64x64(uint64_t a, uint64_t b)
{
    // 将64位数拆分为高低各32位
    const uint64_t a_lo = (uint64_t)(uint32_t)a;
    const uint64_t a_hi = a >> 32;
    const uint64_t b_lo = (uint64_t)(uint32_t)b;
    const uint64_t b_hi = b >> 32;

    // 计算部分积
    const uint64_t p0 = a_lo * b_lo;
    const uint64_t p1 = a_lo * b_hi;
    const uint64_t p2 = a_hi * b_lo;
    const uint64_t p3 = a_hi * b_hi;

    // 计算中间结果
    const uint64_t mid = p1 + (p0 >> 32);
    const uint64_t carry = (mid < p1) ? 1 : 0; // 处理溢出进位

    const uint64_t mid2 = p2 + (mid & 0xFFFFFFFFULL);
    const uint64_t carry2 = (mid2 < p2) ? 1 : 0; // 处理溢出进位

    // 组装最终结果
    return (uint128_t){
        .lo = (mid2 << 32) | (p0 & 0xFFFFFFFFULL),
        .hi = p3 + (mid >> 32) + (mid2 >> 32) + carry + carry2
    };
}在这里插入代码片

方法2:编译器优化版本(GCC/Clang)

c 复制代码
#include <stdint.h>

typedef unsigned __int128 uint128_t; // GCC/Clang扩展类型

uint128_t mul64x64(uint64_t a, uint64_t b)
{
    return (uint128_t)a * (uint128_t)b; // 直接使用内置128位类型
}

两种方案的对比:

特性 通用标准C版本 编译器优化版本

可移植性 符合C99标准,任何编译器可用 仅限GCC/Clang等支持编译器

性能 需要手动处理进位,效率较低 编译器生成最优汇编

代码复杂度 需要显式处理所有进位逻辑 单行代码实现

最大输入 0xFFFFFFFFFFFFFFFF * 0xFFFFFFFFFFFFFFFF 同上

输出精度 完整128位结果 同上

使用示例:

c 复制代码
#include <stdio.h>

int main()
{
    // 测试用例:0xFFFFFFFFFFFFFFFF * 0xFFFFFFFFFFFFFFFF
    const uint64_t a = 0xFFFFFFFFFFFFFFFF;
    const uint64_t b = 0xFFFFFFFFFFFFFFFF;

    // 方法1使用
    uint128_t result1 = mul64x64(a, b);
    printf("通用版结果: 0x%016lX%016lX\n", result1.hi, result1.lo);
    printf("通用版结果: 0x%016llX%016llX\n", result1.hi, result1.lo);

    // 方法2使用
    uint128_t result2 = (uint128_t)a * b;
    printf("优化版结果: 0x%016lX%016lX\n", 
           (uint64_t)(result2 >> 64), 
           (uint64_t)result2);

    return 0;
}

输出结果:

c 复制代码
通用版结果: 0xFFFFFFFFFFFFFFFE0000000000000001
优化版结果: 0xFFFFFFFFFFFFFFFE0000000000000001

建议根据实际需求选择:

如果需要最佳性能且使用支持__int128的编译器,选择方法2

如果需要最大可移植性,选择方法1

如果要处理有符号数,需要额外处理符号位(可用类似方法扩展)

相关推荐
Shell运维手记7 小时前
Linux 常用基础命令学习笔记
linux·运维·笔记·学习·算法·github
qq_448011168 小时前
C语言中的动态内存分配
c语言·开发语言·php
船厂电气自动化ai大模型8 小时前
AI大模型与数学 第32课 函数凹凸性与二阶导数:拐点求解、凹凸区间计算(10道二阶导数计算题)
数据结构·人工智能·python·深度学习·算法
动词ing8 小时前
【学习笔记】C语言(数组指针与指针数组+字符数组+函数+参数传递+字符串作为形参+递归函数+指针函数+回调函数+结构体嵌套+内存动态分配函数)
c语言·笔记·学习
旖旎夜光8 小时前
LeetCode 3:无重复字符的最长子串(滑动窗口) —— 题解
数据结构·c++·算法·leetcode·滑动窗口
叠层归一研究院10 小时前
AGI 系统(十一):二阶网络 — 二阶递归 × 多主体 (元符号网络)
开发语言·人工智能·算法·php·agi
小雨笙笙10 小时前
C语言:变量三属性——存储类型
c语言·开发语言
zlinear数据采集卡10 小时前
D223的PWM电机控制:6路独立脉冲+加减速算法深度解析
arm开发·stm32·嵌入式硬件·算法·fpga开发·架构
杨石兴11 小时前
31、玩具MoM:用2x2矩阵串起全套流程
人工智能·算法·矩阵·电磁学
江畔柳前堤11 小时前
Function Calling 与 Tool Calling:从认知到工程的全景深度解析
开发语言·网络·人工智能·深度学习·算法·机器学习·php