ARTICLE DETAIL

资讯详情

深耕网站视觉设计与运营推广的一线实战洞察。

字节憋5万亿参数,腾讯现金流首负,xAI发布Grok 4.6

字节憋5万亿参数,腾讯现金流首负,xAI发布Grok 4.6 AI 情报局 · DAILY BRIEF今天的 AI 世界发生了什么你相信吗字节跳动正在内部讨论训练超5万亿参数的大模型而腾讯的自由现金流刚刚转负。一个在狂飙一个在踩刹车今天的AI世界撕裂得有点厉害。这篇文章帮你把13条关键信号一次看明白。今日情报深度分析多源核验全文约3798字 · 阅读9分钟10条今日重点3个趋势信号24H内新鲜事件⚡ 60秒速览 · 三个关键信号1模型参数军备竞赛进入新阶段字节5万亿参数讨论和英伟达Nemotron 4传闻同时出现开源闭源都在加码。2算力投入正在掏空现金流腾讯自由现金流历史首负但马斯克仍计划十倍扩张算力供给和成本成为行业瓶颈。3AI应用进入密集落地期Gemini连接更多服务、手语AI、物流机器人同日亮相商业验证开始取代纯技术叙事。 今日头条榜 · 10 条重点按重要性排序TOP 1AI字节被曝讨论训练超5万亿参数大模型或成国内最大据《晚点 LatePost》报道字节跳动内部正讨论训练参数超5万亿的大语言模型若落地将成为国内已知参数规模最大的模型。项目由Seed Foundation负责人项亮主导仍处早期讨论。CEO梁汝波和张一鸣均表态坚持自研、反对蒸馏。这一规模远超当前主流模型反映大模型参数军备竞赛仍在继续。TOP 2AIxAI发布Grok 4.6称结合Opus级智能与低成本高速xAI的Michael Truell宣布发布Grok 4.6官方称其显著提升困难任务和知识工作能力并首次结合Opus级智能与低成本高速度。新版本在推理、编码和复杂任务处理上均有改进价格策略未完全公布。这是xAI短期内又一次模型迭代进一步加剧闭源模型竞争。TOP 3AI英伟达被曝研发万亿参数Nemotron 4同发轻量模型英伟达被曝正秘密研发新一代开源大模型系列Nemotron 4最大版本预计至少1万亿参数约为Nemotron 3 Ultra的两倍最快秋末就绪。同日先行发布300亿参数的Nemotron 3.5 Lightning和模型路由工具NeMo Switchyard。芯片巨头持续推进模型与硬件协同开源路线愈发清晰。NO.04投融资腾讯自由现金流历史首负AI算力资本开支528亿腾讯控股二季度财报显示单季资本开支528亿元主要用于AI算力自由现金流录得-138亿元为公司历史首次。剔除算力采购预付款项后自由现金流为376亿元主业造血能力未受影响。第二季度总营收2048亿元同比增长11%净利润560亿元微增0.7%。AI投入已开始影响巨头现金流结构。NO.05科技马斯克称SpaceX AI收入9月超其他业务算力扩十倍马斯克在最新讲话中宣称AI收入将在9月超过SpaceX所有其他业务收入5年内AI将占估值99%。SpaceX已搭建所谓全球算力最强的AI训练集群计划到明年年底将算力规模扩大约十倍目标10吉瓦对应潜在年收入3000亿至5000亿美元。该表态延续其一贯的激进风格实际落地仍需观察。NO.06AIGoogle宣布更多应用和服务接入GeminiGoogle在Made by Google活动上宣布新一批应用和服务将接入Gemini用户可开启常用服务让Gemini帮助完成更多任务。这意味着Gemini的交互入口进一步扩展从手机助手向跨应用操作平台演进。具体接入名单将在后续更新中逐步释放对开发者生态和用户习惯均有影响。NO.07AIDeepMind发布手语AI工具实时识别交付听障用户DeepMind宣布推出一款手语AI产品旨在让用户获得实时手语识别与交互支持将先进AI能力直接交付给听障用户。这是AI无障碍领域的重要落地展示多模态模型在垂直场景的实用价值。目前工具的具体部署范围和准确率未完全披露但其社会价值与技术验证意义明确。NO.08产品Google发布Pixel 11系列摄像头与AI功能大更新Google在Made by Google活动发布Pixel 11系列新机涵盖Pixel 11、11 Pro、11 XL等型号带来新款摄像头、AI功能和硬件升级同时更新Pixel Buds。新机搭载新一代Tensor芯片强化Gemini端侧集成。硬件AI化进一步提速手机厂商正把AI作为核心卖点。NO.09芯片AMD为Qwen 3.8提供Instinct GPU Day 0支持AMD发布技术文章为Qwen 3.8提供Instinct GPU的Day 0支持覆盖数据、模型与推理等环节开发者可在AMD芯片上直接运行该模型。此举显示AMD正积极适配主流开源模型扩大自身在AI推理市场的竞争力。对使用AMD算力的企业来说部署门槛进一步降低。NO.10AI星动纪元物流机器人获外交部点赞已批量部署5省市外交部发言人对星动纪元研发的物流分拣具身机器人公开点赞。该机器人已与中国邮政、顺丰等头部物流企业合作批量部署于全国5省市10多个物流中心并常态化运营完成从技术研发到批量交付的商业化闭环。这是具身智能在物流场景落地的标志性案例验证了AI Native自研路线的可行性。01模型参数竞赛进入新一轮从万亿到五万亿今天最重磅的信号来自字节跳动。据《晚点 LatePost》报道字节内部正在讨论训练参数超5万亿的大语言模型如果落地这将是国内已知参数规模最大的模型。项目由Seed Foundation负责人项亮主导目前仍处早期讨论。梁汝波和张一鸣表态坚持自研、反对蒸馏。这个动作说明大厂的参数竞赛没有停止反而在向更极端的方向推进。同一天英伟达被曝正在研发万亿参数的Nemotron 4最大版本预计至少1万亿参数是Nemotron 3 Ultra的两倍。xAI则发布了Grok 4.6声称结合Opus级智能与低成本高速度。模型层同时出现两个趋势参数继续膨胀性价比成为并行主线。你可能会想参数越来越大普通企业跟得起吗答案是跟不起但用得起。这正是今天的关键判断模型厂商在替企业把训练成本和复杂度吃掉企业真正要花心思的是选对模型、算清单位成本。英伟达同日发布的300亿参数Nemotron 3.5 Lightning和路由工具NeMo Switchyard本质上就是在降低推理侧的门槛。“参数军备竞赛是巨头的游戏但性价比竞赛才是普通企业的机会。02算力投入出现现金流裂缝巨头一边烧钱一边补血腾讯二季度财报给出了一个罕见的信号自由现金流-138亿元历史首次转负。原因很直接单季资本开支528亿元主要用于AI算力比市场预期高了近六成。剔除算力采购预付款项后自由现金流为376亿元说明主业造血能力还在但AI投入已经开始改变巨头的现金流结构。这解释了腾讯高管的另一个表态预计今年底至明年初GPU资源将更加充足。资本开支前置换来的是未来的算力供给。但短期看算力仍然偏紧。马斯克则在今天喊出了更激进的目标SpaceX AI收入将在9月超过其他业务算力规模到明年底扩大十倍目标10吉瓦。说实话这个数字现在只能当信号看落地风险极大。AMD的动作也在呼应算力供给的变化为Qwen 3.8提供Instinct GPU的Day 0支持。开源模型和芯片厂商的适配加速正在为算力分层和成本优化提供新的可能。对中小企业来说这意味着未来几个月可能迎来算力荒的缓解但供应链安全依然要盯紧。“巨头烧钱烧到现金流转负说明AI算力还在抢跑阶段但供给改善的窗口已经打开。03AI硬件与应用密集落地从手表到机器人Google今天一口气发了多款AI硬件Pixel 11系列、Pixel Watch 5同时宣布更多应用和服务接入Gemini。Pixel Watch 5主打Gemini主动协助和健康追踪手机则强化端侧AI。这不是简单的硬件更新而是把AI从云端助手变成随身常驻的入口。同一时间DeepMind发布了手语AI工具把实时识别能力直接交给听障用户星动纪元的物流分拣机器人已经批量部署到全国5省市10多个物流中心还获得了外交部点赞。一个走社会价值一个走商业闭环都证明AI正在从模型层进入真实场景。你可能会问这些和我有什么关系关系在于硬件和应用密集落地意味着Agent和自动化工作流的载体正在变多。以前你觉得AI离生产环境很远现在它出现在手腕上、仓库里、客服后面。先看懂别人怎么落地你自己的部署才不会踩空。“AI从发布会走进仓库、手腕和手语课堂这才是真正开始改变工作流的时候。04投资逻辑转向算账取代口号国产算力受关注上半年中国AI创业公司融资总额突破3000亿元已经超过去年全年。但投资人的问题变了国产算力能不能撑起规模化落地技术理想和商业现实怎么自洽算力适配能力和国产HBM缺口成为尽调重点。这意味着融资热还在但钱不再只追概念。这个转变对创业者和管理者都是提醒纯模型故事已经讲不动了能交付、能算账的项目才拿得到钱。星动纪元获外交部点赞不是因为它参数多而是因为它完成了从研发到批量交付的商业化闭环。今天可以给自己留一个观察指标未来三个月腾讯、英伟达、xAI的资本开支和模型发布节奏是否同步。如果巨头还在加码算力但模型性价比在提升那说明行业正在进入健康的分化期而不是泡沫破裂的前夜。“融资总额创新高但投资人开始查账本、看供应链这比任何口号都真实。 THE BOTTOM LINE · 今日结论今天给你三个可执行的动作第一重新评估你的模型采购清单把单位成本放在参数之前优先看Grok 4.6和Nemotron 3.5 Lightning这类高性价比选项。第二检查你的算力供应链是否过度单一尤其关注国产HBM缺口对硬件交付的影响。第三在垂直场景里找一个已验证的AI应用比物流机器人和手语工具验证它能不能嵌入你的工作流。别因为巨头烧钱而恐慌跟进先算清自己的单位经济模型。ABOUT PARSENOVA把今天的信号变成你的先手ParseNova帮助中小企业和海外团队优化AI工作流把方案做成可运行、可评测、可持续优化的业务系统。我们的脱敏成功实践覆盖知识与客服流程整合、海外团队多语言运营和线索分流以及通过模型路由、提示词压缩、缓存复用、批处理与调用可观测性减少无效Token消耗和AI支出。了解更多请访问www.parsenova.com。企业级AI应用开发Agent与自动化工作流企业AI化改造咨询数据与RAG知识库脱敏成功实践中小企业 · 知识与客服整合分散文档、常见问题与人工复核减少重复检索和跨系统录入。海外团队 · 多语言运营串联内容本地化、线索分流和跟进提醒改善跨时区协作与响应。成本治理 · Token 与 AI 支出用模型路由、提示词压缩、缓存复用、批处理和可观测性减少无效调用。你的业务里哪条流程最该先用 AI评论区聊聊你的场景或私信「行业 业务环节」我们免费帮你梳理一份改造优先级清单。继续阅读3.7万AI代理设计新药谷歌取消未发布旗舰模型emini 3.5 Pro中国AI板块不存在泡沫Palantir等应用层业绩爆发Seedance 2.5 API正式上线OpenAI放缓Astra模型发布Google重组Gemini团队宇树科技8月10日IPO申购OpenAI发布GPT-5.6 Luna/SolAI模型价格战可能终结字节拒绝走蒸馏捷径SpaceX和特斯拉将投168亿建TerafabDeepSeek再降价Kimi开源2.88万亿模型字节跳动整合飞书与豆包OpenAI月活破10亿政治局再提人工智能亚马逊豪掷2200亿隔夜AI12个信号从0到1搭建可落地的AI Agent与工作流15第15期Agent上线后疯狂出bug这套n8n调试工作流20分钟定位从0到1搭建可落地的AI Agent与工作流14第14期Agent总瞎编答案用n8n搭一条RAG流水线让每个回答都带从0到1搭建可落地的AI Agent与工作流13第13期Agent上线后Token费炸了给工作流加个「路由大脑」成本从0到1搭建可落地的AI Agent与工作流12第12期Agent上线总崩用n8n搭一套零宕机部署与自动回滚流水线从0到1搭建可落地的AI Agent与工作流11第11期Agent上线后成本暴涨用n8n搭一个模型路由器成本直降50从0到1搭建可落地的AI Agent与工作流10第10期Agent一上线就被注入三步给AI工作流装上防盗门从0到1搭建可落地的AI Agent与工作流9第9期Agent上线后总出诡异bug用OpenAI Agents SDK从0到1搭建可落地的AI Agent与工作流8Agent又崩了3步给它装上“黑匣子”n8nOpenAI Agents从0到1搭建可落地的AI Agent与工作流7第7期Agent总抽风用n8n搭一套自动评测流水线3类用例跑完就知好坏从0到1搭建可落地的AI Agent与工作流6第6期Agent评测对比实战用n8n搭一条自动化流水线跑出你的Agen从0到1搭建可落地的AI Agent与工作流5第5期状态管理与记忆让Agent不再“失忆”从短期上下文到长期知识库的从0到1搭建可落地的AI Agent与工作流4第4期Agent做不了主三招给工作流加上人类审批从0到1搭建可落地的AI Agent与工作流3第3期多Agent协作实战用n8n把3个AI Agent串成一个自动化客从0到1搭建可落地的AI Agent与工作流2第2期Agent记不住上下文3步搞定状态管理跑通连贯任务从0到1搭建可落地的AI Agent与工作流1AI Agent落地的第一步如何精准识别高价值自动化需求附评估模板
返回列表