DeepSeek核心成员曝光!

原创 集成电路IC 2025-01-29 11:26

新技术、新公司层出不穷,大家都在拼命往前冲。但有一家公司,直接在这场激烈的竞争里脱颖而出,势头猛得吓人,它就是DeepSeek。

聊起DeepSeek这么牛的原因,就不得不提它背后那一群堪称“王炸”的核心成员。他们的履历和成就,简直能颠覆你对“厉害”的认知。

先讲讲创始人梁文峰,这哥们儿的经历就像开了挂。17岁的时候,就以逆天的成绩考进了浙江大学,在信息与电子工程领域一顿深造,顺利拿下硕士学位。别人还在为找工作焦头烂额的时候,30岁的他已经创立了幻方,到36岁,更是掌管着千亿私募,在金融圈那是响当当的存在。可他志不在此,心里一直装着对AI技术的热爱和野心,凭借在金融和AI领域摸爬滚打积攒的深厚经验,果断创立DeepSeek,铁了心要在人工智能这片新战场打出一片天下。

再看看高华佐,北大物理系毕业,妥妥的学霸一枚。他在DeepSeek-V2的MLA架构上搞出了关键创新。物理学科培养的思维方式,让他看问题的角度独特又刁钻,面对复杂的AI架构难题,别人还在一脸懵圈,他已经找到突破口,想出了超级厉害的解决方案,一下子就让DeepSeek-V2的性能实现了质的飞跃,在行业里站稳了脚跟。

跟高华佐一起在DeepSeek-V2的MLA架构创新上发力的,是来自北邮的曾旺丁。北邮在通信和信息技术方面的实力,给了他扎实的专业技能。他和高华佐默契配合,一路过关斩将,攻克了一个又一个技术难题,把DeepSeek-V2的架构打磨得无比强悍,让DeepSeek在技术上直接把对手甩在身后,遥遥领先。

清华交互式人工智能(CoAI)课题组的博士生邵智宏,也是个狠角色。他参与了DeepSeek好多重要项目,像DeepSeek-Math、DeepSeek-Prover、DeepSeek-Coder-v2、DeepSeek-R1等等。在这些项目里,他充分发挥自己在人工智能领域的专业优势,带着团队一路冲锋陷阵。遇到技术难题,他眼睛都不眨一下,直接迎难而上,靠着自己的智慧和努力,让这些项目一个接一个地取得成功,为DeepSeek的技术版图添上了浓墨重彩的一笔。

北大计算机学院软件研究所的朱琪豪,主导开发了DeepSeek-Coder-V1。在代码生成模型的研发过程中,他就像一个超级英雄,带着团队一路狂飙。凭借自己深厚的专业知识和创新精神,不断优化算法,让DeepSeek-Coder-V1的代码生成能力和质量都达到了行业顶尖水平,为开发者们解决了好多头疼的问题,也让DeepSeek在代码生成领域有了绝对的话语权。

2024年从北京大学计算机学院计算语言所博士毕业的代达劢,一加入DeepSeek,就参与了从DeepSeek LLM v1到DeepSeek-v3的工作。在语言模型的优化升级上,他可是出了大力气。凭借在计算语言学领域的深厚积累,不断改进模型算法和训练方法,让DeepSeek的语言模型越来越智能,理解能力和生成能力都大幅提升,在自然语言处理任务中表现得相当出色。

北大元培学院硕士王炳宣,加入DeepSeek后,就全身心投入到从DeepSeek LLM v1开始的一系列重要工作中。元培学院培养的跨学科能力,让他在项目里就像一个万能胶,能把不同的技术和思路融合在一起。不管是协调团队,还是解决技术难题,他都做得得心应手,为项目的顺利推进提供了有力保障。

清华的赵成钢,三次获得世界大学生超算竞赛冠军,这战绩简直无敌。现在他在DeepSeek担任训练、推理基础架构工程师,就像给DeepSeek打造了一个超级坚固的地基。他凭借在超算领域积累的丰富经验,搭建的训练和推理基础架构,让DeepSeek的模型训练和推理又快又准,在大规模数据处理和模型训练方面有着超强的竞争力。

2019年从北航博士毕业的吴俣,领导着DeepSeek的后训练团队。他就像一个经验丰富的指挥官,带领团队把模型的后训练工作做得相当出色。在他的带领下,团队不断优化后训练环节,让模型的性能得到了进一步提升,让DeepSeek的模型在实际应用中更加稳定和高效。

中山大学与MSRA联合培养的2023年博士郭达雅,2024年7月加入DeepSeek,专注于数学和代码大模型工作。他的加入,就像给DeepSeek注入了一股新鲜血液,带来了新的研究思路和方法。在数学和代码大模型的研发中,他积极探索,努力创新,为DeepSeek在这两个关键领域的发展做出了重要贡献。

还有罗福莉,本科毕业于北京师范大学计算机专业,又在北京大学攻读计算语言学专业硕士,还在阿里达摩院工作过。丰富的学习和工作经历,让她积累了超多的经验和知识。2022年加入DeepSeek后,参与了DeepSeek-V2的研发工作。她就像一个灵感源泉,给项目带来了好多新的思路和方法,推动了DeepSeek-V2的研发顺利进行。

DeepSeek的这些核心成员,来自不同的高校,有着不同的专业背景,但他们都为了一个共同的目标——在人工智能领域称霸,聚在了一起。他们在各自擅长的领域发光发热,共同推动着DeepSeek不断向前发展。我相信,在这群大神的努力下,DeepSeek未来肯定会创造更多的奇迹,成为人工智能领域的绝对霸主,让我们一起拭目以待吧!

集成电路IC 想陪你一起,目睹这个充满变化的时代
评论
  • 书接上回:【2022年终总结】阳光总在风雨后,启航2023-面包板社区  https://mbb.eet-china.com/blog/468701-438244.html 总结2019,松山湖有个欧洲小镇-面包板社区  https://mbb.eet-china.com/blog/468701-413397.html        2025年该是总结下2024年的喜怒哀乐,有个好的开始,才能更好的面对2025年即将
    liweicheng 2025-01-24 23:18 260浏览
  • 不让汽车专美于前,近年来哈雷(Harley-Davidson)和本田(Honda)等大型重型机车大厂的旗下车款皆已陆续配备车载娱乐系统与语音助理,在路上也有越来越多的普通机车车主开始使用安全帽麦克风,在骑车时透过蓝牙连线执行语音搜寻地点导航、音乐播放控制或免持拨打接听电话等各种「机车语音助理」功能。客户背景与面临的挑战以本次分享的客户个案为例,该客户是一个跨国车用语音软件供货商,过往是与车厂合作开发前装车机为主,且有着多年的「汽车语音助理」产品经验。由于客户这次是首度跨足「机车语音助理」产品,因
    百佳泰测试实验室 2025-01-24 17:00 159浏览
  • 前篇文章中『服务器散热效能不佳有解吗?』提到气冷式的服务器其散热效能对于系统稳定度是非常重要的关键因素,同时也说明了百佳泰对于散热效能能提供的协助与服务。本篇将为您延伸说明我们如何进行评估,同时也会举例在测试过程中发现的问题及改善后的数据。AI服务器的散热架构三大重点:GPU导风罩:尝试不同的GPU导风罩架构,用以集中服务器进风量,加强对GPU的降温效果。GPU托盘:改动GPU托盘架构,验证出风面积大小对GPU散热的影想程度。CPU导风罩:尝试封闭CPU导风罩间隙,集中风流,验证CPU降温效果。
    百佳泰测试实验室 2025-01-24 16:58 139浏览
  • 项目展示①正面、反面②左侧、右侧项目源码:https://mbb.eet-china.com/download/316656.html前言为什么想到要做这个小玩意呢,作为一个死宅,懒得看手机,但又想要抬头就能看见时间和天气信息,于是就做个这么个小东西,放在示波器上面正好(示波器外壳有个小槽,刚好可以卡住)功能主要有,获取国家气象局的天气信息,还有实时的温湿度,主控采用ESP32,所以后续还可以开放更多奇奇怪怪的功能,比如油价信息、股票信息之类的,反正能联网可操作性就大多了原理图、PCB、面板设计
    小恶魔owo 2025-01-25 22:09 381浏览
  • 随着AI大模型训练和推理对计算能力的需求呈指数级增长,AI数据中心的网络带宽需求大幅提升,推动了高速光模块的发展。光模块作为数据中心和高性能计算系统中的关键器件,主要用于提供高速和大容量的数据传输服务。 光模块提升带宽的方法有两种:1)提高每个通道的比特速率,如直接提升波特率,或者保持波特率不变,使用复杂的调制解调方式(如PAM4);2)增加通道数,如提升并行光纤数量,或采用波分复用(CWDM、LWDM)。按照传输模式,光模块可分为并行和波分两种类型,其中并行方案主要应用在中短距传输场景中成本
    hycsystembella 2025-01-25 17:24 290浏览
  •     IPC-2581是基于ODB++标准、结合PCB行业特点而指定的PCB加工文件规范。    IPC-2581旨在替代CAM350格式,成为PCB加工行业的新的工业规范。    有一些免费软件,可以查看(不可修改)IPC-2581数据文件。这些软件典型用途是工艺校核。    1. Vu2581        出品:Downstream     
    电子知识打边炉 2025-01-22 11:12 344浏览
  • 高速先生成员--黄刚这不马上就要过年了嘛,高速先生就不打算给大家上难度了,整一篇简单但很实用的文章给大伙瞧瞧好了。相信这个标题一出来,尤其对于PCB设计工程师来说,心就立马凉了半截。他们辛辛苦苦进行PCB的过孔设计,高速先生居然说设计多大的过孔他们不关心!另外估计这时候就跳出很多“挑刺”的粉丝了哈,因为翻看很多以往的文章,高速先生都表达了过孔孔径对高速性能的影响是很大的哦!咋滴,今天居然说孔径不关心了?别,别急哈,听高速先生在这篇文章中娓娓道来。首先还是要对各位设计工程师的设计表示肯定,毕竟像我
    一博科技 2025-01-21 16:17 224浏览
  • 嘿,咱来聊聊RISC-V MCU技术哈。 这RISC-V MCU技术呢,简单来说就是基于一个叫RISC-V的指令集架构做出的微控制器技术。RISC-V这个啊,2010年的时候,是加州大学伯克利分校的研究团队弄出来的,目的就是想搞个新的、开放的指令集架构,能跟上现代计算的需要。到了2015年,专门成立了个RISC-V基金会,让这个架构更标准,也更好地推广开了。这几年啊,这个RISC-V的生态系统发展得可快了,好多公司和机构都加入了RISC-V International,还推出了不少RISC-V
    丙丁先生 2025-01-21 12:10 1148浏览
  • 临近春节,各方社交及应酬也变得多起来了,甚至一月份就排满了各式约见。有的是关系好的专业朋友的周末“恳谈会”,基本是关于2025年经济预判的话题,以及如何稳定工作等话题;但更多的预约是来自几个客户老板及副总裁们的见面,他们为今年的经济预判与企业发展焦虑而来。在聊天过程中,我发现今年的聊天有个很有意思的“点”,挺多人尤其关心我到底是怎么成长成现在的多领域风格的,还能掌握一些经济趋势的分析能力,到底学过哪些专业、在企业管过哪些具体事情?单单就这个一个月内,我就重复了数次“为什么”,再辅以我上次写的:《
    牛言喵语 2025-01-22 17:10 411浏览
  • 故障现象 一辆2007款日产天籁车,搭载VQ23发动机(气缸编号如图1所示,点火顺序为1-2-3-4-5-6),累计行驶里程约为21万km。车主反映,该车起步加速时偶尔抖动,且行驶中加速无力。 图1 VQ23发动机的气缸编号 故障诊断接车后试车,发动机怠速运转平稳,但只要换挡起步,稍微踩下一点加速踏板,就能感觉到车身明显抖动。用故障检测仪检测,发动机控制模块(ECM)无故障代码存储,且无失火数据流。用虹科Pico汽车示波器测量气缸1点火信号(COP点火信号)和曲轴位置传感器信
    虹科Pico汽车示波器 2025-01-23 10:46 264浏览
  • 飞凌嵌入式基于瑞芯微RK3562系列处理器打造的FET3562J-C全国产核心板,是一款专为工业自动化及消费类电子设备设计的产品,凭借其强大的功能和灵活性,自上市以来得到了各行业客户的广泛关注。本文将详细介绍如何启动并测试RK3562J处理器的MCU,通过实际操作步骤,帮助各位工程师朋友更好地了解这款芯片。1、RK3562J处理器概述RK3562J处理器采用了4*Cortex-A53@1.8GHz+Cortex-M0@200MHz架构。其中,4个Cortex-A53核心作为主要核心,负责处理复杂
    飞凌嵌入式 2025-01-24 11:21 235浏览
我要评论
0
点击右上角,分享到朋友圈 我知道啦
请使用浏览器分享功能 我知道啦