我在内娱挥金如土 第105节
林天安静站在台上,任由台下议论持续一小会儿,等嘈杂声稍稍回落,抬手轻压示意全场安静,正式开启今晚核心宣讲内容。
他先从当下全球 AI行业现状切入,条理清晰拆解了现有的技术局限:
“目前全球人工智能行业,整体依旧停留在语音识别、图像分类这类浅层落地应用,国内千度、科大讯飞深耕语音赛道,商汤、旷世主攻机器视觉,细分赛道各有优势,但是通用模型领域长期被海外企业压制。”
话音一转,林天点出行业客观门槛。
“想要自主研发通用大模型,企业必须手握上万张V100组成的算力集群,中小型企业完全没有资金、硬件条件入局,赛道直接形成天然壁垒。”
随后他直指海外竞品短板:
“谷歌、OpenAI现阶段对外商用的,仅仅是小规模实验室衍生模型,行业通用的研发方式,无外乎暴力堆砌算力、海量投喂原始数据,训练成本动辄上亿,后期实际落地推理成本居高不下,长文本处理、复杂逻辑分析存在明显短板。”
讲到此处,林天身后大屏同步弹出文字,清晰列出当前行业三大无法回避的痛点,全场观众凝神细看:
第一,传统稠密模型参数全部激活运行,大量算力无效消耗,中小企业启动大模型训练,起步成本千万级别;
第二,模型上下文窗口普遍仅有1K至2K字符,无法完整解析长篇金融研报、完整工程代码、几十万字合同文档;
第三,硬件适配能力极差,普通商用GPU集群运行模型极易出现显存溢出,想要稳定落地,必须采购定制天价AI专用服务器。
完整梳理完行业现存三大核心痛点,林天话锋一转,说起深空智能团队的创业初心。
“我们团队深耕量化交易、算力硬件优化领域,在金融量化市场实操过程中,提前察觉到AI算力体系存在巨大缺陷。”
“所以,我们没有照搬海外暴力堆卡的研发路线,而是走出了一条算法架构深度优化+国产硬件协同适配的自研道路。”
林天淡淡带过之前在币圈、量化市场积累算力技术的经历(吹牛逼),无需细说细节,只抛出核心成果:
“我们仅依靠数百张V100搭建分布式完整训练框架,整套研发流程完全不依赖海外闭源工具链,全程自主可控。”
吊足全场所有人的好奇心后,林天抛出本场发布会第一个重磅核心悬念,语气沉稳有力:
“今天,深空智能正式发布国内首款自主架构7B通用大模型����DeepSeek基础版,用更低算力消耗、更低落地成本,一次性解决全行业 AI商用落地所有难题!”
151 强大的DeepSeek,免费开源?(二合一)
话音落下,身后巨型屏幕瞬间铺满模型完整基础参数,林天配合画面逐条讲解,全场技术人员,也纷纷拿出笔记本跟平板,快速记录关键数据。
模型规模:70亿参数通用稠密基座模型,同时覆盖通用文本、代码开发、金融量化分析三大核心商业场景。
训练硬件:自研分布式算力集群,采用V100 16G显卡分布式协同训练,对比同期海外主流模型,整体算力消耗降低35%。
训练数据:纯中英文合规开源数据集,额外补充海量金融、代码专项专业语料,针对性解决国产大模型中文语义理解薄弱的通病。
基准测试指标MMLU综合测评、长文本生成、代码编译三大公开标准测试中,对比谷歌、Meta同期小参数模型,中文理解能力领先 22%。
完整参数讲解完毕,林天继续宣讲DeepSeek区别于市面所有竞品的四大独家核心创新技术,每一项都直击行业痛点。
第一项,优化型多投隐注意力 MLA架构,彻底攻克长文本显存爆炸难题,模型上下文窗口直接突破 8K字符,远超行业普遍 1K-2K的上限。
第二项,自研FP8混合精度训练框架,显存占用直接降低40%,普通中小企业小型机房即可完成模型微调,无需高价采购专用AI服务器。
第三项,分层专家推理调度技术,虽然是70亿稠密参数底座,但推理运行时,会自动闲置无效参数,模型推理速度整体提升50%。
第四项,全链路国产硬件适配,完美兼容通用X86服务器,深度适配深城本地整机产业链硬件设备,大幅削减企业后期落地部署成本。
林天将四大创新技术介绍完毕,台下已经响起压抑不住的惊叹声,海外谷歌、英伟达技术团队面色凝重,不停记录屏幕上的技术架构说明。
林天微微抬手,示意所有人安静,开启全场最受期待的环节����现场实时实测演示。
“理论参数终究只是纸面数据,接下来我们进入三大场景,实时Demo演示,全程直连深城核心算力集群在线推演,无预录视频、无后期剪辑,所有内容实时生成。”
身后屏幕切换至实时算力监控界面,画面同步划分三个演示分区,依次开展实测。
第一个演示板块为金融场景,工作人员现场导入一份数万字完整BTC行情深度研报,模型很快就完成全文通读,自动梳理涨跌底层逻辑,快速生成完整量化交易分析报告,风险点、投资逻辑、行情预判条理清晰。
仅仅这一场实测,全场观众集体倒吸一口凉气。
金融机构、券商代表身体前倾,死死盯着屏幕,眼中满是震撼。
数万字长篇文档快速解析,是他们当下使用的海外模型完全无法做到的效果。
第二个板块切换至代码场景,工作人员输入一套完整量化交易系统开发需求,模型十几秒内,就开始输出代码,短不短两分钟不到,就生成了全套可直接运行的Python代码,附带运维脚本、报错修复注释,完整工程文件无逻辑漏洞。
现场的各大互联网企业技术负责人浑身一震,心底升起强烈危机感。
原本需要程序员耗费数天完成的开发工作,DeepSeek短短几分钟就能落地,直接改变行业开发模式。
直播间大量程序员弹幕刷屏,有惊叹、有焦虑,还有人迫不及待想要获取模型源码测试。
第三板块为通用文本场景,现场导入商业计划书撰写需求、数万字法律合同,模型快速完成文书撰写、条款风险摘要、逻辑梳理,超长文本处理能力展现得淋漓尽致。
三组实时演示全部结束,场馆内安静两秒后,直接爆发出雷鸣般的掌声。
台下媒体、投资机构、企业高管清晰意识到,DeepSeek7B不是实验室仅供观赏的半成品,而是能够直接商用落地的底层基座。
中小企业、金融、互联网、制造企业,仅需十几万硬件投入,就能完成本地私有化部署,彻底绕开亿级算力投入的门槛。
贵宾席一众大厂高管神色复杂,创投机构负责人眼中满是狂热。
资本嗅觉早已捕捉到巨大商机,心里暗暗盘算,发布会结束立刻对接深空智能洽谈合作、争取入股名额。
只要拿下早期投资份额,未来必定收获巨额回报,深空智能必然成长为千亿级科技独角兽。
全场激动的情绪还未平复,林天站在台上,再次抛出一个引爆全场的重磅消息,声音清晰传遍场馆每一个角落:
“在此,深空智能正式宣布,DeepSeek7B基础模型,非商用场景完全开源,完整权重、自研训练框架全部免费对外开放,面向全球所有开发者开放使用权限。”
“免费开源?!”
前排阿里马老师下意识站起身,全场几千名嘉宾瞬间沸腾,交谈声、惊叹声、拍照快门声混杂在一起,场馆彻底陷入狂欢。
所有人都不敢相信,如此划时代的顶尖大模型,居然直接免费开放给所有人使用。
台下所有人只看到开源带来的巨大行业红利,唯有林天心中门清。
开源看似让利,实则是分摊算力迭代压力。
海量全球开发者共同使用、微调模型,源源不断反馈使用数据,深空智能便能依靠全民数据,持续迭代优化模型,仅凭自家现有算力,很难快速研发更高规格的大模型,开源是当下最优解。
当然,开源的也只是基础版而已,定制的话还是要收费的。
不过那是赚企业的钱,跟普通用户没关系。
DeepSeek7B开源的消息落下,体育馆内的沸腾持续了足足五分钟,主持人几次抬手示意安静,都难以压下台下此起彼伏的议论声。
贵宾区彻底乱作一团,BAT三家掌门人神色各有变化,原本还算从容的心态尽数被打破。
阿里马老师侧头看向身旁的企鹅老马,语气带着几分难以置信:
“我做互联网这么多年,从没见过哪家自研底层大模型直接开源的。”
小马眉头紧锁,指尖不停敲打桌面:
“这下我们云业务压力陡增了啊!”
千度李帅哥苦笑一声,接过两人的对话:“我还以为我们千度是最先研究AI的呢,没想到竟然有人走在了我们前面。”
“现在人家国产自研模型免费开源,性能还全面领先,我们之前的研发规划全部要推翻重来。”
如果没有林天的出现,千度是国内最早研究AI、大模型底层技术的公司,从13年就已经开始成立深度学习研究院了。
可现在DeepSeek一出,他们所有研究直接付诸东流。
三人对视一眼,心里不约而同定下主意。
等发布会结束后,第一时间找到林天洽谈深度战略合作,哪怕无法拿到独家授权,也要优先拿下行业定制合作权限。
一旦错过这次机会,未来国内的AI赛道,将彻底失去竞争优势。
海外嘉宾区域震动更甚,谷歌亚太区总裁立刻拿出手机,拨通硅谷总部视频电话,将现场开源公告、实时演示画面同步传回海外研究院,语气急促翻译讲解现场情况。
英伟达随行首席工程师快速记录开源协议细则,反复对比自家Llama系列开源限制,连连摇头感叹差距。
三星、微软高管互相交流,已经开始规划后续合作方案,想要引入 DeepSeek底层模型适配自家手机、智能终端产品,抢占东亚智能硬件市场。
场馆两侧媒体记者疯狂拍摄舞台画面,同步将“70亿参数国产大模型免费开源”快讯推送全网,微博第二条爆火词条#DeepSeek完全开源#瞬间冲上热搜第一,直播间在线人数直接突破五百万,弹幕多到平台短暂卡顿,运营紧急扩容服务器带宽。
线上网友彻底炸开锅,各类评论铺满屏幕:
【直接免费开源?林天的格局直接碾压所有海外大厂!】
【程序员狂喜,不用再花高价买大厂API了,本地就能跑顶尖大模型!】
【蹲开源包下载地址,今晚连夜搭环境测试代码生成功能!】
......
场外体验区早已排起长龙,各家企业技术负责人,守在演示终端前反复测试模型,金融机构高管导入各类行业研报,一遍又一遍核对量化分析精准度。
互联网程序员,现场测试完整项目代码生成,每一次无报错运行,都会引来一圈围观人群的掌声。
深城高新区招商局领导坐在前排,身旁计算机院士连连拍腿赞叹:
“国产AI终于扬眉吐气,不靠堆天价算力,自研优化架构还主动开源培育行业生态,这才是国家重点扶持的科创企业该有的担当!”
林天站在台上,安静等待场内热度稍稍回落,抬手示意全场安静,继续宣讲配套扶持政策。
“除模型开源之外,深空智能与深城科创园区共建开源AI实验室,全国高校、初创研发团队可免费申请专属算力资源。”
“所有注册深城的科创中小企业,最高可申领五十万模型微调算力补贴,大幅降低企业AI落地成本。”
想让深城站在自己身后,他们深空智能自然也要拿出相应的筹码。
一个是共建AI实验室,另一个就是对本地中小企业的扶持。
上一篇:半岛:从绑定咸恩静开始成为财阀
下一篇:返回列表
