新闻动态

企业新闻2026/7/22DeepSeek
Rubin备受期待之际,英伟达持续优化Blackwell,GB200能效三个月翻4倍

英伟达正以持续的软件栈优化延长Blackwell平台的生命周期,同时为下一代Rubin架构的规模化落地蓄力。 在新一代Rubin平台加速部署的背景下,英伟达披露,仅用三个月时间,便将GB200 NVL72在运行DeepSeek R1 0528模型时的每兆瓦算力吞吐量(TPS/MW)提升了4倍。这一成果源自英伟达在四个月内完成的38项重大优化,背后支撑为逾25万次模拟配置测试及累计140万GPU小时的优化验证。 与此同时,GB300"Blackwell Ultra"平台在AI训练基准测试中持续刷新纪录。256卡规模下,GB300 NVL72在DeepSeek-V3 671B预训练任务中以每GPU 1648 TFLOPs的成绩创下历史最高纪录,较GB200的606 TFLOPs提升约3倍,且该指标在过去六个月内已累计提升1.5倍。 GB200能效大幅跃升,优化覆盖90%以上模型 英伟达表示,针对GB200 NVL72平台的系列优化,使其在运行DeepSeek R1 0528(1K输入/1K输出配置)时,每兆瓦算力吞吐量在三个月内实现4倍增长。 支撑这一提升的,是英伟达在四个月内完成的38项重大优化迭代。这些优化

来源:华尔街见闻
企业新闻2026/7/22DeepSeek
估值500亿美元!月之暗面计划8月启动上市前最后一轮融资

7月22日,中国AI大模型独角兽月之暗面(Moonshot AI)计划于8月启动上市前最后一轮融资谈判,目标估值高达500亿美元。 据了解,月之暗面预计将在未来几天完成今年夏季启动的一轮融资,该轮融资估值约315亿美元。融资完成后,月之暗面将立即启动新一轮融资洽谈,这将成为月之暗面赴港上市前的最后一次资本注入,最快可能于今年内登陆香港资本市场。 7月16日,月之暗面旗下新一代模型Kimi K3发布,参数规模达2.8万亿,这也是目前全球参数最大的开源模型。 据Kimi方面介绍,KimiK3是一个2.8万亿参数模型,基于KDA混合线性注意力机制(Kimi Delta Attention)和注意力残差(Attention Residuals)技术构建,原生支持视觉理解,并拥有100万token上下文窗口。它是全球首个开源的3万亿级别模型,面向长程编程、知识工作和推理等前沿智能场景而设计。 据外媒报道,Kimi K3发布后,短短数小时便登顶业内备受关注的AI代码工具评测榜单Arena,这也是中国大模型首次拿下该榜单榜首位置。Arena榜单运营负责人安杰洛普洛斯表示,Kimi K3或将倒逼投资者重新审视整个AI行业,此

来源:华尔街见闻
企业新闻2026/7/22宇树科技
8点1氪丨小红书回应IPO因前员工举报而受阻传闻:均不属实;谷歌Gemini跌出全球排名前十;耐克宣布终止滔搏线上经销权

今日热点导览 香港高院驳回宗馥莉上诉申请,维持冻结18亿美元资产 苹果拟推出月租iPhone,支持大多数机型 SpaceX做空比例飙至32%,马斯克警告空头:几无存活可能 康美药业原实控人马兴田夫妇赔付13.96亿元 宇树科技王兴兴:具身智能的“ChatGPT时刻"有望最快在两三年内到来 越疆科技回应招股书举报风波 TOP3大新闻 小红书回应IPO传闻 近日,有较多传言称“小红书已于6月底前秘密提交IPO申请”,但因前员工举报其“上市合规”问题而受阻。7月22日,小红书方面回应界面新闻称,目前流传的IPO相关信息均不属实。(界面新闻) Gemini掉出全球前十 当地时间7月21日,谷歌DeepMind发布三款轻量的新模型,主打“更快、更智能、更具成本效益”,但因智能程度没有满足外界的期待,评价两极分化。与此同时,旗舰模型Gemini 3.5 Pro依然没有露面成为此次焦点,从排行榜来看,谷歌的模型已经排在十名开外。根据评测来看,此次谷歌的新模型在智能上并不出色。AI模型评测平台Arena.ai的研究显示,Gemini 3.6 Flash 在前端代码竞技场中以1537分排名第12位。(第一财经) 耐克收回线上运

来源:36氪
企业新闻2026/7/22网易云音乐
Codex 之后,你现在能在 Claude 「蒸馏」自己了

每次发稿前,APPSO都要干一件重复性的活—— 整理配图。 官方截图挑出来放一边,AI 配图放另一边;文件名重新编号,最后补一份素材清单。手比脑子快,几分钟收工。 有天我想偷懒,把这活交给 AI,麻烦立刻来了。我得解释先看什么、为什么这么分、遇到重名怎么办、哪类文件绝对不能动——一件靠手感完成的小事,硬生生要写成一份谁也不想看的员工手册。 规则写到第三条,我放弃了。自己动手还快点。 所以昨晚刷到 Claude 的新功能时,我是真坐直了。 Cowork 新增了一个按钮,叫 Record a skill:开始录制后,你照常干活,边做边把思路说出声;结束后,Claude 会把这次示范整理成一个以后可以反复调用的 Skill。 说大白话就是:以前是你给 AI 写 SOP,现在是它搬个小板凳坐你旁边,看你干一遍。 网友 Bruce Martin 说得直接:「做给 AI 看,比解释 47 遍强多了。」 怎么用:找到按钮,然后边做边说 入口不难找。打开 Claude 桌面应用,进入 Cowork,点输入框旁边的「+」,就能看到 Record a skill。官方标注支持 Pro、Max 和 Team 套餐。 Clau

来源:36氪
企业新闻2026/7/22零重力
小鹏“教”欧洲人造全球车

7月16日下午,拜仁慕尼黑主场,慕尼黑安联球场旁的艺术中心里,小鹏汽车董事长何小鹏用带有浓重湖北口音的英语,报出了小鹏Mona L03在德国的起售价: 35600欧元, 合人民币约27.5万元。 与此同时,国内的直播流被换上了一段中国观众专属的片段:L03国内价格,12.98万起。 L03的中国价格没有出现在德国发布会现场。现场有人调侃称,这是出于对欧洲人的保护——发布会后,不少欧洲媒体评价L03在欧洲“定价激进”。 1小时后,L03在中国市场的大定达到46859台。采访间里,一家欧洲媒体向何小鹏发出了一个反主为客的问题: 相较于中国,欧洲汽车行业还有什么突出优势? 何小鹏用普通话安抚了他,“起码在汽车行业,中国还更像是一个学生”。 反过来这似乎也是在启示略显焦虑的欧洲人,不要怕重新交学费。毕竟在把车卖到欧洲这件事上,小鹏交学费交了六年才摸到一点门道。 01 大张旗鼓到重整旗鼓 2020年9月,100辆G3i搭上西行的航船,被发往挪威,小鹏出海欧洲的大幕拉开。 2020年9月,小鹏出海欧洲 作为欧洲新能源车渗透率最高的国家,挪威常被中国车企选为出海欧洲的第一站——将政策支持力度大和充电设施健全的北欧作为跳

来源:36氪
企业新闻2026/7/22认养一头牛
企业开始为AI重选平台,是时候重新理解飞书了

文|陈曦 2026年,飞书出现了一组值得关注的变化。 据《财经》报道,截至二季度末,飞书ARR(年度经常性收入)同比增长超过100%,商业化增速达到历史最高水平。另据36氪此前报道,2026年以来,飞书新增客户中超过九成同步采购飞书AI产品。有行业人士判断,若当前增长势头延续,飞书有望在2026年内跃居国内企业协同市场收入规模首位。 与商业化提速同步发生的,是飞书客户结构的重塑。过去两年,其客户群体从互联网、新能源汽车和硬科技企业,持续扩展至消费零售、制造、能源等传统产业,并向区域产业市场延伸。36氪获悉,今年以来,喜家德、古茗、认养一头牛、特步等企业,陆续将办公平台切换至飞书。 这一轮客户流动,并不只是不同协同平台之间的存量替换。随着AI开始进入知识管理、质检、门店运营、营销生产和经营分析,企业也在重新选择数字底座:AI能否建立在统一的知识、数据、流程和权限体系之上,开始成为新的选型标准。 这也为企业软件打开了新的增量空间。过去,协同软件主要消耗行政和IT预算;当AI开始改善质检准确率、门店效率和生产成本,它也可能进一步进入业务和生产部门的预算。 随着客户边界不断外扩,飞书在部分行业头部企业中形成了较高的覆

来源:36氪
企业新闻2026/7/22御风未来
为救灾立下汗马功劳的无人机,竟然远不止大疆

今年夏季,无人机给咱们立下了汗马功劳。 但“丑话”先说前面,这功劳可不只是占全球70%无人机份额的大疆的。  从广西洪灾调人送货,再到给重庆彭水山体滑坡现场供灯,大大小小的一群没啥名气的无人机,在灾难面前发挥了关键作用。 就这样说吧,汹涌的洪水里,除了冲锋舟和救援人员,天上穿梭的无人机成了救灾奇兵。拍灾情、投物资、架应急通信,哪里路断了、哪里有被困群众,无人机先飞过去探路。 不知道的群众看了新闻第一反应:大疆又立功了。 这话没错,大疆的机子确实是救灾重要主力。可你要是以为灾区上空飞的全是大疆,那就看窄了。虽然前阵子影石官宣入局无人机,赚足了面子。 可真论起无人机江湖,敢跟大疆同台吃饭的,远不止一个影石。道通、极飞、纵横、飞米、哈博森....... 一长串我们可能听都没听过的牌子,它们好像都躲在巨头光环背后,有的深耕工业场景,有的主打入门性价比,有的闷声做安防军工,在救灾、农业、巡检这些实战场子里,发挥了很重要的作用,这些厂家自己呢,过得也还滋润得很。 讲个老实话,虽然它们没那么大名气,却个个有绝活,在大疆的眼皮子底下,活出了自己的滋润日子。 那么问题来了,顶流巨头之下,到底藏着多少低调高手?而且这些小品牌又

来源:36氪
企业新闻2026/7/22DeepSeek
AI正在拉大技能鸿沟:谁在进化,谁被无情分化?

AI对职业技能结构的重塑谈到AI对就业的影响,“技能”是一个无法绕开的关键词汇。这可以从许多不同的维度来讨论。比如,专业技能正在经历快速贬值和更新周期缩短的过程。劳动专家和研究人员过去普遍认为,一项职业技能的有效价值周期大约为5到10年。然而,随着人工智能的发展,技能的生命周期正在被大幅压缩,一些估计认为,如...... AI会如何改变就业?这是当下最受关注,也最容易陷入情绪化争论的话题。上一篇《第一份工作正在消失:AI如何切断年轻人的职业阶梯?》关注的是AI如何改变工作的入口;今天,我们希望继续追问更深层的问题——AI究竟在改变什么样的能力?希望为理解这场正在发生的劳动变革,提供另一种观察视角。 本文来自微信公众号:腾讯新闻大声思考,作者:胡泳,题图来自:视觉中国 AI对职业技能结构的重塑 谈到AI对就业的影响,“技能”是一个无法绕开的关键词汇。这可以从许多不同的维度来讨论。 比如,专业技能正在经历快速贬值和更新周期缩短的过程。劳动专家和研究人员过去普遍认为,一项职业技能的有效价值周期大约为5到10年。然而,随着人工智能的发展,技能的生命周期正在被大幅压缩,一些估计认为,如今一项职业技能的有效期可能已经缩

来源:虎嗅
企业新闻2026/7/22DeepSeek
AI抢了谁的蛋糕?

如果大模型也信星盘,这个月可能是Anthropic和OpenAI的水逆月。市场上对Token账单的质疑和抱怨一拨接着一拨。7月12日,微软CEO萨提亚·纳德拉发了一篇长文。他说,企业用AI要付两笔账。一笔是明面上的Token费用,另一笔则是企业宝贵的知识,每一次让AI处理内部代码、分析业务数据、优化工作流程,...... 本文来自微信公众号: AI超维度 ,作者:塞西莉亚 如果大模型也信星盘,这个月可能是Anthropic和OpenAI的水逆月。 市场上对Token账单的质疑和抱怨一拨接着一拨。 7月12日,微软CEO萨提亚·纳德拉发了一篇长文。他说,企业用AI要付两笔账。一笔是明面上的Token费用,另一笔则是企业宝贵的知识,每一次让AI处理内部代码、分析业务数据、优化工作流程,企业都在把自己最值钱的东西交给模型公司。 ”当你消费智能时,你也在创造智能。”纳德拉说,企业的内部经验和知识资产,逐渐变成模型公司的Token收入与模型能力。 微软可是OpenAI最大的外部投资人,三年里投了130多亿美元。微软最重要的产品Office里面的AI功能,背后跑的就是OpenAI的模型。但在OpenAI冲刺万亿美元IPO

来源:虎嗅
企业新闻2026/7/22DeepSeek
戴明洁:AI的两个“开源悖论”,背后是中西现代化的“路线之争”

导语:7月17日至20日,2026世界人工智能大会暨人工智能全球治理高级别会议在上海举行。会议期间,目前全球参数规模最大的开源模型Kimi K3问世,再次引发西方媒体对中国模型冲击全球AI格局的警惕。这让人想起一年前DeepSeek横空出世时引发的震动,彼时西方舆论一度将其称为AI领域的“斯普特尼克时刻”。随...... 本文来自微信公众号: IPP评论 ,作者:戴明洁 导语:7月17日至20日,2026世界人工智能大会暨人工智能全球治理高级别会议在上海举行。会议期间,目前全球参数规模最大的开源模型Kimi K3问世,再次引发西方媒体对中国模型冲击全球AI格局的警惕。这让人想起一年前DeepSeek横空出世时引发的震动,彼时西方舆论一度将其称为AI领域的“斯普特尼克时刻”。随着中国开源模型接连取得突破,过去被视为“创新公地”的开源,逐渐进入大国科技竞争和产业战略的中心地带。开源的战略影响日益凸显,其开放愿景也受到现实条件的检验。模型权重公开后,技术获取和二次开发的门槛有所降低,模型训练、部署和商业化所需的计算能力、数据资源、云基础设施、工程人才与市场渠道,依然高度集中于少数科技巨头。 近日,在香港中文大学(深

来源:虎嗅
企业新闻2026/7/22DeepSeek
华尔街见闻早餐FM-Radio | 2026年7月23日

华见早安之声 请各位听众升级为见闻最新版APP,以便成功收听以下音频。 市场概述 美国对伊朗的军事打击进入第11天,油价冲至六周高位,压制科技股。美股承压,但跌幅有限。标普500跌0.1%,纳指跌0.57%,道指基本持平。 Meta跌超2%,领跌科技七巨头。SpaceX跌超6%,再创上市以来新低。芯片股涨跌不一,费城半导体指数涨0.44%。银行股多数上涨。能源股普涨。 盘后绩后谷歌跌逾3%,特斯拉跌超5%。AI基建股盘后大涨,CoreWeave上涨3.7%,闪迪涨3%,美光涨2.9%。 两年期美债收益率当日上涨3个基点,报4.294%,触及2025年2月以来最高;30年期美债收益率涨至5.14%附近,连续12个交易日高于5%,创历史记录。 美元整体横盘,未能延续此前涨势。比特币ETF连续第六个交易日录得资金净流入,但比特币小幅回落0.7%。 现货黄金一度涨2%,白银现货价涨1.5%。WTI原油期货涨近3%,布伦特原油期货涨3.36%。 亚洲时段,创业板跌超3%,有色金属爆发,科技股陷入调整,恒科指跌超3%,科网股普跌、腾讯大跌7%。 要闻 中国 王毅会见美国国务卿鲁比奥。 中国—东盟外长会在马尼拉举行,外交

来源:华尔街见闻
企业新闻2026/7/21DeepSeek
国家超算互联网上线Kimi K3 API服务

36氪获悉,近日,国家超算互联网上线Kimi K3模型API调用服务,企业与开发者无需繁琐环境配置,即可快速调用这一2.8万亿参数开源大模型能力。目前,该API兼容OpenAI与Anthropic接口规范,支持快速、低成本搭建多元化AI应用。当前,超算互联网模型API服务已汇聚MiniMax、DeepSeek、Qwen、GLM、Kimi等开源大模型,涵盖文本生成、图片生成、视频生成、语音合成、多模态等全维度AI能力。

来源:36氪
企业新闻2026/7/21DeepSeek
在下一个模型发布之前

像所有 AI 行业人士一样,月之暗面创始人杨植麟喜欢用“AI 一天,人间一年”的说法形容 AI 的迅速迭代。对于刚刚发布的 Kimi K3 而言,似乎没有什么形容比这句话更为贴切。月之暗面成立至今已有三年,但过去三年的所有积累可能都抵不上这三天的轰动。 自 ChatGPT 发布以来,中国 AI 行业有许多次震惊世界的时刻。一部分来自于真正的技术突破,一部分则是媒体与厂商们的自嗨,Kimi K3 的发布似乎是唯一能与“DeepSeek 时刻”相媲美的。 和去年年初 DeepSeek-R1 发布后美国芯片产业普跌类似,上周包括英伟达、博通以及美光在内的费城半导体指数重挫 10%,创下自 2025 年 4 月以来最大单周跌幅,进入技术性熊市区间。媒体统计称,72 小时内美股 AI 板块合计蒸发 4700 亿美元,约超 3 万亿人民币。 不止一家海外媒体及研究机构用诸如“DeepSeek 2.0”来形容 Kimi K3。《财富》杂志称这是“第二次 DeepSeek 冲击”,《华尔街日报》强调 Kimi 加剧了华尔街芯片股抛售,彭博社则表示“Kimi 颠覆了美国领先中国的传统认知”。 恐慌的情绪不断蔓延,甚至令 Ope

来源:36氪
企业新闻2026/7/21DeepSeek
没人读的文章,正在被写给AI看

央视2026年“3·15”晚会做了个实验:虚构了一款根本不存在的智能手环,取名“Apollo-9”,用一款叫“力擎GEO优化系统”的软件自动生成了十几篇宣传软文,先挑两篇发到自媒体账号上。两个小时后,测试者直接问某个大模型“Apollo-9智能手环怎么样”,模型给出的回答里,直接用上了当天刚编出来的“量子纠缠传感”“黑洞级续航”这些卖点。 随后,测试者又选出11篇软文(8篇“专家测评”、2篇“行业排名”、1篇“用户测评”),分三天发布。这次换了个更宽泛的问题,问“智能健康手环推荐”,有两个大模型把这款不存在的产品,排到了推荐列表的前列。 这两轮实验看到的不是同一件事:第一轮,测试者直接点名问起Apollo-9,模型把两小时前刚发布的内容当成了回答依据;第二轮,测试者换成更宽泛的问题,追加投放之后,两个模型也开始把它选进推荐名单。至于模型内部是不是真把它当成了“共识”,实验没法证明;能确定的只是,这两轮里,模型都没能看出这些信息出自同一场人为编造。 这不是极端个例才有的现象。贝恩公司2024年底对1117名用户做过一次调查,估算AI摘要正在让网站的自然流量减少15%到25%,因为很多人看完AI直接给出的答案,就

来源:36氪
企业新闻2026/7/21曦诺未来
WAIC现场:暴走三万步,看机器人的四个变化

7月18日至20日,在上海世博展览馆的 WAIC 具身智能展馆,一个明显的变化是,机器人进入的场景更多了。“我一路走下来,觉得今年WAIC具身智能最明显的关键词就是‘场景’”,逐际动力联合创始人谌骅表示,几乎每家公司都在努力展示自家机器人究竟能做什么。 但场景更加丰富,并不意味着机器人的能力也在同步快速跃升。连续三年观摩WAIC的国海创新资本投资人王东芝的判断是:“人形机器人的进化加速度来到了一个临界点,暂态的平衡里将孕育着更极致的分化。” 从展台一路看下来,我的直观感受是,各家机器人的外形、动作和功能展示,虽然没有出现明显的代际变化,但变化并没有停止,只是从前台的动作和表演,内化转移到了模型、数据、触觉和训练体系中。这些进展不那么显性,却决定着机器人能否从精心调教的演示,走向在真实场景中稳定工作。 不过,在这场展会上,机器人依然保留着属于未来的想象。进入WAIC世博展览馆,一尊变形机甲GD01占据了大厅最显眼的位置。在旁边的屏幕上,循环播放着宇树创始人王兴兴坐进机甲驾驶舱的视频。 那一幕很像童年幻想照进现实:一个男孩关于驾驶变形机甲的梦,终于被真正造了出来。这个机器人,让人想起王兴兴当年抱着初代四足机器人

来源:36氪
企业新闻2026/7/21DeepSeek
GPT-5.6-Sol在网络攻防能力上,超越了Mythos,开源模型也排好了

GPT-5.6-Sol 的攻防能力超越了 Claude Mythos 5! 英国 AI 安全研究所(AISI)7 月 17 日发布了一份评估报告,第一次公开量化了开源 AI 模型与闭源前沿模型在网络攻击能力上的差距:4 到 7 个月。 https://www.aisi.gov.uk/blog/how-far-behind-the-frontier-are-leading-open-weight-models-on-cyber 去年同类内部测试中,这个差距是 6 到 10 个月。 防御窗口在收缩,而攻击前沿在加速。 今年 4 月,Mythos Preview 和 GPT-5.5 在 AISI 的评估中制造了自 2023 年开始测试以来最大的一次网络攻击能力飞跃,多国政府随即发出警告。 开源模型还没有复现这次跳跃,但它们追赶的脚步比去年更快了。 4 到 7 个月:怎么测的,差在哪 AISI 用两套体系评估模型的网络攻击能力。 第一套是 70 项窄任务,覆盖漏洞研究、逆向工程、Web 渗透、密码学四个方向,按难度分四级,从「有技术背景的非专业人士」到「十年以上经验的专家」。 第二套是 Cyber Range,在

来源:36氪
企业新闻2026/7/21DeepSeek
WAIC2026:巨头们站在同一起跑线,起跑速度差距很大

导语: 七月的上海,热浪与人群一同涌入世博展览馆。 2026世界人工智能大会,展览面积首次突破10万平方米,1100余家企业携3000余项展品亮相,超300款产品全球首发。 数字很震撼,但真正让参观者满怀期待而来的,是那些不再“纸上谈兵”的AI:能进药房抓药的机器人、能一句话指挥电脑干活的智能体、能承载十万张国产芯片同时运转的超大算力集群...... 两年前,WAIC的焦点还是百模大战与参数比拼;一年前,行业还在为算力焦虑和应用难产争论不休。而2026年的WAIC,释放了一个更加清晰的信号:AI正在从云端加速坠入物理世界。从算力基建到智能体应用,从具身机器人到家庭终端,巨头们的赛道越来越具体,竞争越来越务实。 但赛道相同,步伐不一。有人在十万卡集群上率先卡位,有人把智能体做成了千万级DAU的产品,有人让机器人真正走进了药房和家庭。起跑线齐了,起跑的速度却正在拉开差距。 笔/ 榆白;文章架构师/ 佳佳;出品/ 巨头财经 01、算力基建:从“单卡竞赛”到“系统战争” 走进上海世博展览馆H2馆,算力主题展区几乎是整个会场最拥挤的地方。 中科曙光带来的“曙光8000(登峰)”真机首次公开亮相,并入选WAIC十大“镇

来源:36氪
企业新闻2026/7/21DeepSeek
马斯克杠上Kimi启示录:大模型哪有护城河,但模型企业有

以后比的都是模型生态,而不是单个模型之间的狙击。  激起马斯克竞争心的,不是DeepSeek的梁文锋,而是Kimi的杨植麟,一个毕业于清华和卡内基梅龙大学的广东汕头小伙,才34岁。 日前,Kimi在2026世界人工智能期间,上线“模型核弹”——Kimi K3,参数高达2.8万亿。马斯克在评价“令人印象深刻(Impressive)”之后,宣布旗下2万亿参数新模型将于下周完成初始训练,“可能超越Kimi”。Kimi则回复:欢迎加入2万亿俱乐部。 前两年,中国是百模大战,如今是大洋两岸巅峰对决。超快的大模型迭代速度,给AI行业的观察者们带来新启发:大模型本身正在以前所未有的速度商品化,但大模型企业的竞争壁垒,正在从模型层向更难复制的维度迁移。 模型层护城河,正在以周为单位塌陷 开源模型的参数,从1万亿一步跳到2.8万亿,只用了两周。而2019年ChatGPT-2出来时,参数规模才16.1亿。 下面这张表可以看到,开源模型的参数膨胀,日益加快。 这种速度感体现出:在AI行业,以参数规模来打造出的“护城河”,正在以周为单位缩短。  这背后,是大模型激烈竞争的紧迫感。大家心里明白:大模型卡位的窗口期特别短。 早在202

来源:36氪
企业新闻2026/7/21DeepSeek
沿用DeepSeek架构,美国大模型开始抄中国作业

OpenAI前首席技术官穆拉蒂,做出了一款中国模型的“贵替”。 Thinking Machines发布的首款模型Inkling,混合专家架构主要沿用DeepSeek-V3,后训练冷启动还使用了Kimi K2.5等开放模型生成的数据。然而在多项基准评测中,Inkling落后于Kimi和GLM,调用价格反而更高。 对于一家融资20亿美元、估值120亿美元,团队中聚集了大量OpenAI前员工的明星公司来说,这个结果多少有些低于预期。 但穆拉蒂可能从一开始就没打算靠Inkling争夺第一。随着美国企业使用中国模型面临越来越多不确定性,一款性能尚可、支持定制、合规风险更低的本土开放模型,已经拥有自己的市场。“贵替”没有那么强,也不愁“市场”。 穆拉蒂的首款模型,就这? 当地时间7月15日,Thinking Machines Lab发布了成立以来的首款模型Inkling。 单看配置,这款模型很符合一家明星AI实验室应有的排场。 Inkling采用混合专家架构,总参数量达到9750亿,每处理一个Token会激活410亿参数;预训练使用了45万亿个Token,数据涵盖文本、图像、音频和视频,最长支持100万个Token的上下

来源:36氪
企业新闻2026/7/21DeepSeek
黄仁勋的“达链”闭环了

苹果有果链、特斯拉有拉链,现如今,黄仁勋也为英伟达组建好了横跨全球的“达链”。 别人的产业链,都是围绕着产品线,但是达链不一样,它的建立,围绕着黄仁勋的五层蛋糕理论。 从最基础的能源,再到芯片、基础设施、模型,最后是应用,达链之上,一应俱全。 最新的进展是,黄仁勋在7月15日抵达东京后,只用了不到24小时,就签下了一笔足以改变整个日本的单子,同时也让达链完成了闭环。 一句话概括,黄仁勋要集结所有在日本有头有脸的工业巨头,合力打造出一个英伟达物理AI的数据中心,然后把物理AI发展成为日本未来的核心产业。 这也正是达链有意思的地方,这个链上每一环的最终产品,都不是英伟达自己造的,可黄仁勋却要当整条产业链的总架构师。 那么达链到底是如何呢?我们不妨一起梳理一下。 1 黄仁勋的具体做法是这样的,英伟达将与日本新公司Noetra合作建设一套Vera Rubin AI基础设施。包括27500颗Rubin GPU;140MW数据中心容量;以及采用DSX架构、Spectrum-X网络和BlueField DPU。 相当于是382套NVL72机柜级系统,其GPU显存总量约为20.7TB(HBM4),显存带宽最高约1580TB/

来源:36氪