巨人天成
产经 科技 企业 数据 峰会 快讯 商业

95后AI天才少女助力,小米抢滩AI大模型市场,DeepSeek性价比引全球瞩目

2024-12-29来源:证券时报e公司编辑:瑞雪

近期,AI领域迎来了一位备受瞩目的新星——95后“天才少女”罗福莉,她因在DeepSeek公司参与研发DeepSeek-V2大模型而崭露头角。随着DeepSeek-V3的发布,罗福莉更是凭借其在AI领域的卓越贡献,被小米创始人雷军以千万年薪招至麾下,即将在小米AI实验室领导大模型团队。

DeepSeek-V3的发布,不仅在技术层面引发了广泛关注,更因其高性价比而备受赞誉。据最新技术报告显示,该模型参数量高达671B,激活参数为37B,使用的预训练token量更是达到了14.8万亿。在多项评测中,DeepSeek-V3超越了阿里的Qwen2.5-72B和metadeLlama-3.1-405B等其他开源模型,与顶尖闭源模型GPT-4o和Claude-3.5-Sonnet在性能上不相上下。

这一高性价比的模型,让DeepSeek在全球AI领域声名鹊起。meta的AI研究科学家田渊栋称赞道:“在非常有限的预算下实现强劲表现,这是一项了不起的工作。”知名AI数据公司ScaleAI的创始人兼CEO Alexandr Wang也表示:“DeepSeek-V3训练所需计算量减少了10倍,他们正以更低的成本、更快的速度和更强的实力迎头赶上。”

DeepSeek并非首次引发关注。早在半年前,其发布的DeepSeek-V2就因性能达GPT-4级别,且开源、可免费商用、API价格极低而备受瞩目。DeepSeek-V2之所以能实现如此高的性价比,得益于其创新的架构,如MLA(多头潜在注意力)和前馈网络方面的DeepSeekMoE架构等,这些创新使得模型在训练效果和推理效率上均表现出色。

DeepSeek的创始人梁文锋,是一位毕业于浙江大学电子工程系的80后技术专家。他始终保持低调的作风,潜心研究技术,带领DeepSeek团队在AI领域不断取得突破。DeepSeek也是国内最早开启大模型降价的厂商之一,其发布的DeepSeek-V2之后,字节、阿里、百度等厂商纷纷跟进降价,推动了整个行业的发展。

罗福莉的加入,无疑为小米AI大模型团队注入了新的活力。她本科就读于北京师范大学计算机专业,硕士毕业于北京大学计算语言学专业。在学术领域,她曾在人工智能领域顶级国际会议ACL上发表多篇论文,展现了卓越的学术实力。在职业生涯中,她曾在阿里达摩院从事预训练语言模型相关工作,后加入幻方量化从事深度学习相关策略建模和算法研究,最终跳槽到DeepSeek担任深度学习研究员,参与研发了MoE大模型DeepSeek-V2。

小米在AI领域的布局也日益清晰。自2023年4月正式组建AI实验室大模型团队以来,小米不断挖掘AI相关的用户场景,发挥自身技术优势,以开放的态度与合作伙伴开拓更多机会。今年11月,小米成立了专门的AI平台部,由元老级技术大牛张铎担任负责人。张铎本硕毕业于清华计算机系,被誉为“小米的大神”,其丰富的技术背景和深厚的行业经验将为小米AI业务的发展提供有力支持。

为了在大模型业务中平衡成本,小米正着手搭建自己的GPU万卡集群,并在过去几个月里持续提升算力储备。雷军在公开演讲中表示,小米做大模型的思路与众不同,选择主力突破的是轻量化和本地部署。拥有DeepSeek-V2研发背景的罗福莉的加入,无疑将为小米在这一领域的发展注入新的动力。

光联携手利元亨,共话新能源制造AI时代网络新路径与新机遇
聚焦企业在全球范围内的多分支互联与云IDC接入问题,方案基于光联自建全球光纤骨干网络及华为SD-WAN设备,支持MPLS、Internet与4G/5G等多种链路融合,并可弹性部署多种拓扑模型,实现总部、分支…

2025-11-15

恒为科技:从可视化到智算,让复杂算力“看得见、管得住”
这家公司从 2003 年起步,长期在“网络可视化”和“智能系统平台”两条看似技术化的赛道上耕耘,逐步在运营商、科研院所、大型行业客户中建立信任与交付能力。它不像爆款公司那样靠一款产品跑路,而是靠一条条项目、…

2025-11-15

“祖冲之三号”同款芯片赋能!我国超导量子计算机“天衍-287”搭建完成并开放服务
据了解,该量子计算系统具备“量子计算优越性”能Q力,处理特定问题的速度比目前最快的超级计算机快4.5亿倍,未来将接入“天衍”量子计算云平台并首次面向全球开放应用服务,这也将是我国首个具备“量子计算优越性”的量…

2025-11-14

6寸LCD显示屏:小身材大能量,技术优势与多元应用前景深度剖析
采用IPS等先进技术的6寸LCD屏,能够实现更广色域覆盖,色彩显示真实自然,更适用于图像监控、医疗设备显示、智能终端等对色彩还原要求较高的场合。 随着技术的不断发展,6寸LCD显示屏将在未来呈现更高清、更智…

2025-11-14

小天互连IM系统:打破政企信息孤岛 驱动一体化协作新变革
某省级政务大厅在信创升级中,通过小天互连IM系统实现了与政务服务平台、电子证照系统的无缝对接,群众办事进度可直接通过即时通讯推送,办理效率提升50%,印证了其国产化集成的稳定性。 从国产化生态适配到开放 A…

2025-11-14

水库增殖放流站物联网升级:实时监测,远程管控,开启智慧渔业新模式
通过接入溶解氧传感器、水温传感器、水质监测仪、自动投料机、自动增氧机、循环水设备PLC、摄像头等多种设备,物通博联智能数采网关能够实时采集各个鱼池的水质、溶解氧、水温以及投料、增氧、循环水等设备状态,通过5…

2025-11-14

水浸传感器RS-SJ:4G蓝牙双助力,高效守护防积水安全
当检测到水浸情况时,相关信息会通过4G网络快速传输至指定的管理平台或用户终端,无需人工现场查看,让用户在第一时间知晓积水隐患,为及时采取排水、设备转移等应对措施争取时间,避免积水造成更大损失。 水浸传感器凭借…

2025-11-14

中国电信2025年云网路由交换设备集采结果揭晓
中国电信近日宣布,其云网路由交换设备(2025年)集中采购项目已顺利完成评审工作。此次采购项目规模庞大,涉及多个关键网络设备领域,旨在进一步优化和提升云网基础设施能力。

2025-11-13

中国电信AI赋能6G发展:创新技术引领通信变革,拓展产业融合新路径
中电信数智科技有限公司“一种基于6G的天地一体化传输优化及拓扑测绘的方法”获国家发明专利授权,这项专利涵盖卫星与地面网络协同通信、频谱资源共享、高效信号传输等多个核心技术领域,为6G的落地应用铺设了一条“高…

2025-11-12

量子卫星引领通信变革:搭建全球高速安全互联的量子通信新桥梁
卫星可将纠缠光子发送到地面,实现长距离量子通信。 地面量子网络通过卫星互联全球量子密钥分发网络形成实现真正安全、分布式通信3. 军事与国防应用 随着技术成熟和全球布局加速,未来的互联网将不再依赖传统线路,而…

2025-11-12