复旦肖仰华:大模型的数据科学!

2025年4月19日,第75期DataFunSummit:大模型时代数据科学的变与不变将在DataFun线上社区举办,数据科学主题峰会已经连续举办5届,是国内少数关注数据科学主题和数据科学从业者的专业会议之一。

本次会议继续由DataFun社区主办,计划邀请30+位重量级数据科学家同台分享交流,深入辩证的探讨大模型时代数据科学在技术与应用的"变与不变",立足不变夯实基础,顺应变化逐浪新潮流。

在4月19日上午的大模型时代数据科学的变与不变主论坛上,复旦大学教授、上海市数据科学重点实验室主任肖仰华将带来报告,主题为《大模型的数据科学》。

专家介绍:

肖仰华博士,复旦大学教授、博导,上海市数据科学重点实验室主任。长期从事大数据、认知智能研究。 荣获ICDE2024十年最有影响力论文奖、ACL2023杰出论文奖。发表 CCF-A 、B 类等论文 200 余篇。出版学术专著与教材三部。完成五十多项政府及人工智能头部企业研发项目。荣获包括华为、阿里、美团等机构授予的科研奖项二十多项。担任 Applied Intelligence 等多个国际期刊副主编或编委。

演讲提纲:

1.引言:大模型发展过程中数据所扮演的重要角色,以及大模型数据科学和大模型数据工程的定义,演讲结构概览

2.大模型的语料工程:大模型训练语料的选择标准、组织方式、分类体系、核心问题等,以及大模型课程学习优化策略

3.大模型的指令工程:大模型微调指令的分级体系、评价标准、优化方法等,以及大模型指令学习过程中的优化策略

4.多模态语料与指令:多模态大模型的训练数据特征,以及多模态数据集的评估方法、合成方式、分类体系等

5.大模型思维能力提升:大模型与人类思维过程的差异及大模型反思能力的实现、优化与评估

6.总结:数据是大模型发展过程中长期性、根本性、战略性问题,是引领大模型从"只知其然"的前"牛顿"时代走向"知其所以然"的"牛顿"时代的关键。

报名方式

大会议程

相关推荐
章豪Mrrey nical3 小时前
前后端分离工作详解Detailed Explanation of Frontend-Backend Separation Work
后端·前端框架·状态模式
hh随便起个名4 小时前
力扣二叉树的三种遍历
javascript·数据结构·算法·leetcode
派大鑫wink4 小时前
【JAVA学习日志】SpringBoot 参数配置:从基础到实战,解锁灵活配置新姿势
java·spring boot·后端
程序员爱钓鱼4 小时前
Node.js 编程实战:文件读写操作
前端·后端·node.js
xUxIAOrUIII5 小时前
【Spring Boot】控制器Controller方法
java·spring boot·后端
PineappleCoder5 小时前
工程化必备!SVG 雪碧图的最佳实践:ID 引用 + 缓存友好,无需手动算坐标
前端·性能优化
Dolphin_Home5 小时前
从理论到实战:图结构在仓库关联业务中的落地(小白→中级,附完整代码)
java·spring boot·后端·spring cloud·database·广度优先·图搜索算法
zfj3215 小时前
go为什么设计成源码依赖,而不是二进制依赖
开发语言·后端·golang
weixin_462446235 小时前
使用 Go 实现 SSE 流式推送 + 打字机效果(模拟 Coze Chat)
开发语言·后端·golang
Dingdangcat865 小时前
城市交通多目标检测系统:YOLO11-MAN-FasterCGLU算法优化与实战应用_3
算法·目标检测·目标跟踪