VicroCode
让代码创造价值
VicroCode是一个轻量级代码在线发布、交易平台,开箱即用,免部署、免服务器、免备案,支持接入智能体、通用管理系统、游戏等多种项目
稍候片刻,您可先学习AI编程手册
正在加载中...

市场信息

阿里前销售总监在美失踪逾半月后确认身亡;5天10万元!外国高管涌入中国“工厂游”;传DeepSeek计划采购16万颗昇腾芯片|AI周报

点击查看原文>

www.infoq.cn · 2026-09-07T14:05:35+00:00

宇树机器狗隐秘灰产链曝光,改电池标签“偷渡”上飞机;曝钉钉创始人无招或将加入蚂蚁集团;字节跳动贷款 296 亿美元投 AI;天猫上线 token 充值中心,首批接入阿里云、智谱、Kimi、MiniMax;上海交大内部 PPT 曝光:课程迭代远落后技术发展,学生反超老师成常态;何庭波再发「韬定律」论文,回应外界质疑;Anthropic 预计 9 月下旬公开 IPO 招股书,最早 10 月中旬启动路演;苹果新 CEO 上任首日!新 iPhone 被曝恢复赠送充电头、有线耳机,官方回应;史无前例!

ChatGPT、Grok、Claude 集体全崩;知情人士回应抖音突发算法推荐错乱:原因为服务器异常…… 行业热点 阿里巴巴前高管在美国失踪逾半月后确认身亡 美国亚凯迪亚市 42 岁居民陈理(Li Chen)8 月 21 日失联,之后一直杳无音信。亚凯迪亚市警局 9 月 4 日公布陈理已经死亡,目前洛县警局凶杀科已接手此案,案件具体细节还在调查中。

陈理最后一次被看到是 8 月 21 日,之后亚市警方发布寻人启事,陈理失踪时身穿一件长款黑色外套,内搭长袖黑色 Polo 衫,脚穿黑色跑鞋。亚凯迪亚警局一行政主管表示,陈理日前被发现死于车内,发现者是洛县警局 La Crescenta 分局的警员。

该分局是负责调查陈理死亡事件的主要机构。 La Crescenta 分局则表示此案目前在调查中,无法透露具体细节。

陈理的两个友人和他玩游戏认识大半年时间,最近担心其近况先后发数条微信给陈理,但后者都没有回复,友人因此心生疑虑,担心他发生意外,日前联系媒体协助寻找他。友人称,陈理平时回微信都很快,他是一个风趣幽默的人,大家都很喜欢他,平时聚会都会叫他。

据这两个朋友透露,陈理来自福建,曾在阿里巴巴担任销售总监,陈理平时很低调,一家四口来美国两、三年时间,在亚凯迪亚的房子也是租的,且最近才搬家。消息称 DeepSeek 计划采购 16 万颗华为昇腾 950DT 芯片 9 月 5 日消息,据彭博社报道,DeepSeek 计划在内蒙古乌兰察布建设一座大型智算中心,部署至少 16 万颗华为下一代昇腾 950DT 芯片,订单总额或达到约 25.6 亿美元。

如若按计划完成,这将成为目前规模最大的国产 AI 芯片集群之一。据知情人士透露,DeepSeek 在大模型训练方面主要依赖英伟达(NVIDIA)芯片,而部署的华为昇腾芯片用于 AI 模型运行推理。

DeepSeek 与华为的合作将延伸至算力系统设计,双方联合定义昇腾超节点,围绕长文本推理降低时延、提升吞吐并控制成本,同时兼顾向万卡级集群扩展的需求。 PChome 获悉,如若按计划完成,DeepSeek 在内蒙古乌兰察布的数据中心将成为 DeepSeek AI 研发的重要基础设施。

该项目规划功率达到吉瓦级,拟部署的 16 万颗芯片仅对应其中一部分容量,受产能限制,该订单履约期至少 18 个月。 5 天 10 万元!

外国高管涌入中国“工厂游” 近期,中国入境游市场持续升温,区别于传统观光游览,聚焦中国产业一线、科创领域的定制化科技考察旅行热度大幅上涨,成为入境游全新特色业态,相关高端定制考察行程需求十分旺盛。据了解,此类定制化科技考察团的出行人群以海外投资人、企业高管、创业者为主,涵盖美国 Dimension、Capital Group、兴盛资本等多家海外知名投资机构负责人,考察群体专业性、商务属性突出。

伴随市场需求增长,国内已形成专业化的定制化科技考察游服务体系,推出多款主题化考察行程,包括上海人工智能与机器人创新之旅、电动汽车与电池深度体验之旅等。目前,“德国智能制造企业参观团”正在华开展考察活动,行程覆盖天津、青岛、厦门、珠海等多个城市,实地走访海尔空调、阿童木机器人、云洲智能科技等多家国内科技与制造企业。

市场公开报价信息显示,此类科技考察行程定价偏高。其中,两天半的人工智能主题考察团报价 3000 美元,折合人民币约 2 万元;部分五天深度考察行程报价达 1.5 万美元,折合人民币约 10 万元。

即便定价高昂,市场相关需求依旧保持火热态势。宇树机器狗隐秘灰产链曝光,改电池标签“偷渡”上飞机 9 月 2 日消息,有媒体曝光了宇树科技机器狗背后一条隐秘的灰产链。

在二手交易平台上,部分机器人租赁商通过篡改宇树机器狗电池标签的方式,将高容量电池伪装成符合航空规定的“合规电池”,试图把产品“偷渡”上飞机。报道称,有商家撕下原厂印有 421.2Wh 额定能量的标签,换上自行打印的灰色假标签,将额定能量篡改为 97.92Wh,同时伪造电压、充电限制等核心参数。

根据中国民航局规定,旅客携带的锂电池额定能量不超过 100Wh 的无需航空公司批准即可随身携带,超过 100Wh 但不超过 160Wh 的需经航空公司批准且每人限带两个,严禁携带额定能量超过 160Wh 的锂电池。在宇树科技当前所售产品中,除 Go1 标准版的 133.2Wh 可以批准后携带,其他产品均不符合随身携带规定。

宇树科技一位离职员工向该媒体透露,2023 年公司内部曾针对部分有需求的客户,粘贴低于规定标准的电池容量标签,并提供了相关信息。但该员工并未提供近期存在同类操作的相关信息。

一位卖家透露,他们按照宇树原厂电池标签的模板一比一复刻,有的直接贴好假标签发货,有的则把打印文件发给客户自行操作,声称“同行都这么干,用我们的方法肯定安全可靠”。宇树科技作为 A 股人形机器人第一股,市值曾达 4400 亿元,其创始人王兴兴的管理风格也引发关注。

9 月 1 日,“宇树员工称奖惩机制只有罚几乎没有奖”“宇树员工称超 100 元报销需王兴兴审批”登上热搜。对此,宇树科技方面回应称“很多内容不实,切勿当真。

此前媒体报道,在宇树科技,任何超过 100 元的报销都需创始人王兴兴亲自审批。员工汇报时语速必须够快,说完两句话大概率被打断或被催促,沟通方式相对直接严厉。

王兴兴要求员工不对外透露公司消息,专注产品细节,甚至连一颗螺丝钉的长度都会亲自过问。一名研发部员工认为,宇树现有的奖惩机制里只有罚,几乎没有奖。

对于部分员工而言,如果多承担一项功能意味着后续要维护更多东西,却没有额外回报。 “他们会想为什么不做简单一点?

据员工透露,宇树一般员工涨薪的幅度相比行业普遍水平是更低的,工作强度并不低。这两年,有员工平均每个月都收到一两次猎头联系,年薪不低于百万元。

有员工称,早期在 996 大小周的工作制度外还要额外每天加班。有老员工表示,去年和今年是宇树核心骨干流失率最高的两年。

混元团队放假 据大厂日爆,HY4 大模型效果超出预期,本周混元多个团队迎来放假,包括基础模型、AI 数据等部门,连金地的食堂都歇业了一大半,只留少数档口值班。曝钉钉创始人无招或将加入蚂蚁集团 9 月 1 日消息,据知名科技博主在社交平台爆料,钉钉创始人无招或将加入蚂蚁集团。

他在社交平台写道:“好消息:无招要去蚂蚁了?截至目前,该消息尚未得到证实。

据了解,无招本名陈航,2014 年他带队在湖畔花园孵化出钉钉,一路做到 4 亿用户,是货真价实的“钉钉之父”。 2021 年他从阿里离职创办两氢一氧,2025 年 3 月阿里收购两氢一氧投资人股份后,无招回归钉钉二度出任 CEO。

不过回归仅一年多,无招再次卸任。今年 6 月,一篇钉钉前产品经理撰写的 7 万字长文《置身钉内》刷屏,直指钉钉内部管理方式问题。

随后阿里合伙人委员会发文批评,称“不是阿里文化该有的样子”。 6 月 11 日,阿里宣布无招卸任钉钉 CEO,由 92 年出生的陈宇森接任,无招调往集团另有任用。

值得注意的是,这不是钉钉系高管第一次流向蚂蚁。今年 8 月,钉钉全球商业总裁杨猛已确认离任并加盟蚂蚁集团。

字节跳动贷款 296 亿美元投 AI 9 月 3 日消息,据报道,字节跳动正在推进一笔规模达 296 亿美元(现汇率约合 1,993.99 亿元人民币)的银团贷款。该交易若顺利完成,将成为 2026 年亚洲地区规模第二大的美元计价银团贷款,仅次于软银集团今年 3 月完成的 400 亿美元(现汇率约合 2,694.59 亿元人民币)过桥融资。

据报道,字节跳动最初为该笔融资设定的目标规模为 200 亿美元(现汇率约合 1,347.29 亿元人民币),因银行认购踊跃,最终将规模扩大至 296 亿美元(现汇率约合 1,993.99 亿元人民币)。资金主要用于一般企业用途。

不过,该贷款协议尚未正式签署,各承销银行仍在就最终的额度分配进行确认。此次大规模融资正值字节跳动加速人工智能战略布局之际。

据了解,该公司正在评估将 2026 年的资本支出预算提升至最高 700 亿美元(现汇率约合 4,715.53 亿元人民币),这一数字较 2025 年的支出水平增长超过一倍。新增投资将重点投向数据中心扩容及人工智能基础设施建设,以支撑其在全球范围内的 AI 业务扩张。

天猫上线 token 充值中心,首批接入阿里云、智谱、Kimi、MiniMax 9 月 3 日消息,天猫正式上线 AI 空间站(token 充值中心),用户可直接购买多家头部大模型订阅产品。页面显示,该充值中心集合了阿里云、智谱、Kimi、MiniMax 等国内头部大模型厂商的订阅服务,在售商品包括按周期订阅的 token Plan、Coding Plan 以及按用量付费的充值方案,支持卡密或直充两种交付方式。

此前一天,智谱已正式入驻天猫开设官方旗舰店,开售 Coding Plan 等订阅套餐。开店首日搜索环比暴涨 40 倍,大模型订阅服务开始进入电商消费场景。

上海交大内部 PPT 曝光:课程迭代远落后技术发展,学生反超老师成常态 近日,上海交通大学人工智能学院的一份内部 PPT 悄然走红网络,直白曝光了国内高校人工智能学科的发展困局,在教育界与科技圈引发热烈讨论。这份文件摒弃了官方化的成绩宣传,毫不避讳地罗列当下高校 AI 教育、科研的诸多短板,撕开了 AI 行业火热表象下,高校学科建设的深层隐患,也让大众清晰看见高校学术研究与产业高速迭代之间的巨大断层。

PPT 总结了当前高校 AI 领域的四大核心痛点:高校正逐步脱离 AI 创新最前沿,落后的根源绝非仅算力不足;行业顶尖前沿技术普遍闭源,高校科研缺少核心支撑;技术迭代速度远超教学更新,学生的前沿认知反超授课老师;人工智能最先淘汰的,正是掌握基础技能的 AI 从业者。此外,南京大学计算机学院副教授蒋炎岩开设的《生成式软件工程》课程 PPT 上还说道,“没有 Token 的 CS 学生应该立即退学。

何庭波再发「韬定律」论文,回应外界质疑 华为董事何庭波发表第三篇「韬定律」署名论文,回应外界对韬缩微定律的散热质疑。此前何庭波已提出「韬(τ)定律」并发表相关论文,华为即将发布的 Mate90 系列预计搭载基于该定律的麒麟 2026 芯片,该芯片为首款采用 LogicFolding 的移动系统级芯片,晶体管密度提升 55%,关键任务功耗最高降 66% 且运行温度更低。

论文中介绍,LogicFolding 是通过三维混合键合将电路垂直堆叠以缩短信号传输距离的技术,麒麟 2026 实现 1.5 微米混合键合间距、5000 万个垂直互连,麒麟 2027 已达 1 微米间距、超 1 亿个垂直互连,预计三年内实现 720 纳米间距、超 2 亿个垂直互连。论文指出芯片功耗主要源于信号搬运而非计算本身,LogicFolding 可缩短信号传输路径,减少数据搬运功耗,降低功率密度。

麒麟 2026 各模块在同等性能下功耗显著降低,全速运行时性能大幅提升,还可通过软硬件协同设计进一步优化功耗。同时,通过降低热密度、优化布局等方式可管控结温,避免热点问题。

论文强调 τ 缩微定律是时间缩微定律,需通过工程纪律将时间余量用于降低功耗,未来 LogicFolding 有望推动麒麟 CPU 核心频率达 5GHz 及以上,行业进步需持续迭代优化。 Anthropic 预计 9 月下旬公开 IPO 招股书,最早 10 月中旬启动路演 清华姚班校友 Tianyi Peng 主导,Anthropic 的 Claude 仅用 11 天完成费马大定理首个端到端、可由计算机完整检查的形式化证明,产出约 1300 万行 Lean 代码、超 3 万个中间定理,代码规模超 Lean 核心数学库 Mathlib 的 5 倍。

此次是将人类可读的证明翻译成计算机可逐行验证的形式化证明,过程中多 Agent 协作曾遇混乱,后借助 Prove2Me 平台理顺,人类仅提供少量高层提示。据悉,Anthropic 预计 9 月下旬公开 IPO 招股书,最早 10 月中旬启动 IPO 路演推介。

苹果新 CEO 上任首日!新 iPhone 被曝恢复赠送充电头、有线耳机,官方回应 当地时间 9 月 1 日,蒂姆·库克卸任苹果 CEO 一职,转任董事会执行主席,CEO 由约翰·特努斯接任。

持续 15 年的苹果“库克时代”结束,迎来了“特努斯时代”。 9 月 1 日苹果开盘,股价微跌,随后盘中涨超 2.5%,市值站上 4.74 万亿美元,较上一交易日收盘 4.62 万亿美元大增 1200 亿美元(折合超 8000 亿元人民币)。

而就在约翰·特努斯上任首日,一则“苹果将重新为新 iPhone 附赠充电头和有线耳机”的消息在社交平台引发热议。有账号发文称,在特努斯上任后,消费者购买新 iPhone 将重新获得充电器和有线耳机。

不过,苹果方面随后对此进行了回应。据媒体报道,苹果官方客服表示,第三方信息无法确认其准确性,Apple 没有发布相关政策信息,Apple 没有这个通知。

据了解,苹果自 2020 年发布 iPhone 12 系列开始,就不再为新款 iPhone 附赠充电头和 EarPods 有线耳机。苹果表示,此举目的在于减少碳排放,有利于环保。

这一决定推出后曾引发众多网友吐槽,纷纷表示苹果“不厚道”,甚至还有一些海外用户因此起诉苹果。苹果则一直强调这一调整带来的环保收益。

此外,相关文件显示,新任 CEO 约翰·特努斯 2027 财年的薪酬方案目标值约为 5800 万美元,而库克约为 4700 万美元。根据新的薪酬安排,特努斯的年度基本工资为 300 万美元,并将在 2027 财年获得目标价值 5500 万美元的年度股权奖励。

同日,特努斯正式加入社交平台 X,并发布了个人账号的首条动态“hello”。这条只有五个字母的动态,在发布后极短时间内便为账号带来了巨大关注,动态上线约 35 分钟,已经获得约 74.8 万次浏览、3.1 万次点赞、3600 次转发和 5000 条评论。

史无前例! ChatGPT、Grok、Claude 集体全崩 北京时间 9 月 3 日晚间,ChatGPT、Claude、Gemini、Grok 等多家美国主流 AI 平台突发大面积服务中断,全球海量用户遭遇 403 拦截与无限人机验证死循环。

据报道,有超过 12,000 份用户报告指出 OpenAI 存在问题,关于 Claude 的问题报告约有 1,200 份,关于 Grok 的问题报告约有 1,000 份。经技术实测与排查,本次“多米诺骨牌式瘫痪”并非模型硬件物理损坏,核心诱因在于整个 AI 行业的统一前置网关 Cloudflare 触发了边缘风控熔断。

局部服务抖动致使安全阈值被动拉满,引发全网连锁风控与误杀,具体原因有待官方公布。目前上述海外 AI 已恢复正常运营。

此外,8 月 31 日消息,Anthropic 突发大规模账号安全事件,大批 Claude 用户被强制注销。就在这两天,大批 Claude 用户发现:没有任何封号预警,自己的账号忽然就被强制下线了。

甚至,连后台绑定的 Visa、Mastercard 等付款方式,都被官方紧急清空。官方建议:若额度无故恢复又迅速耗尽,即为中招迹象。

受害用户多因下载破解软件感染木马。有用户用 Claude Opus 5 逆向查杀病毒成功,但专家仍建议重装系统。

黑产已转向“偷算力”,务必警惕不明文件,及时撤销活跃会话。知情人士回应抖音突发算法推荐错乱:原因为服务器异常 9 月 1 日消息,最近,「抖音崩了」及「抖音推荐难看」等热搜词条引发关注。

援引知情人士消息称,推荐算法错乱是因为抖音平台突发服务器异常。报道称,据大量网友反馈,此次服务异常主要表现为三大技术故障:其一,推荐算法机制疑似失灵,用户刷到的内容与日常偏好严重不符,大量推送不感兴趣、低相关度的视频,甚至出现「误入中老年频道」的既视感,部分用户反映关注页内容无法刷新;其二,内容流出现重复性紊乱,同一个视频在信息流中被反复推送多次,无法获取新内容;其三,基础播放功能受阻,视频播放频繁卡顿、加载画面持续转圈,甚至在网络连接正常的情况下,系统仍错误提示「无网络连接」。

另外,据网友反馈,此次故障还存在系统推送若干年前的旧内容这一问题。 OpenAI 购入数万台苹果 Mac mini / Studio,用于训练 Agent 操作计算机 8 月 31 日消息,据报道,OpenAI 近几个月购买了数万台苹果 Mac mini 和 Mac Studio 电脑,用于训练能够操作计算机的 AI 系统。

据了解,OpenAI 购买的主要是配备大容量统一内存的 Mac 产品,并利用这些设备运行与「计算机操作型 AI Agent」相关的模型和训练工作负载。这类硬件能够为 AI 模型提供真实的计算机操作环境,使其学习如何浏览软件界面、与应用程序互动以及完成各种电脑任务。

通过这样的环境,AI Agent 可以反复进行训练和评估。目前,配备大容量内存的 Mac mini 和 Mac Studio 已经变得较难购买,部分型号甚至连续数月处于缺货状态。

AI 公司尤其看重这些配置,原因在于苹果的统一内存架构允许 CPU 和 GPU 访问同一个大容量内存池。 Meta 取消员工 AI 使用量与绩效挂钩机制,Hatch 测试推动 token 消耗上升 9 月 3 日,据报道,Meta 本周在内部通知中表示,员工绩效评估将不再依据 AI 工具使用量,包括 token 消耗等指标。

此前,Meta 曾推动员工提升“AI 驱动影响力”,AI 使用程度在实际工作中成为关注指标。与此同时,Meta 员工开始测试新型 Agent 工具 Hatch。

员工称,尽管绩效考核不再强调 AI 使用量,Hatch 等 Agent 工具的使用仍在推高 token 消耗。整治 AI 虚假账号,Instagram 推出全新 AI 个人资料标签 8 月 31 日消息,社交媒体 Instagram 宣布将原本的「AI 创作者」标签更新为「AI 生成个人资料」,使用户能够一眼分辨出眼前的创作者究竟是真人,还是 AI 生成的虚假人物。

据悉,该标签适用于高度拟真且从未主动披露虚拟身份的 AI 生成账号。真实创作者使用 AI 编辑工具处理照片、撰写标题,不会受到影响。

Instagram 表示,用户已经对一些看似真人、实际上是 AI 虚构的账号感到厌倦。今后如果有创作者不主动披露 AI 虚构身份,平台算法将不再将其内容推荐至 Reels、Explore 页面的非粉丝用户。

如果平台自动标记算法出现偏差,用户可以联系官方客服申诉。 Manus 宣布正式恢复独立运营,创始人肖弘及团队留任 9 月 1 日消息,Manus 宣布即日起正式恢复独立运营,由创始人肖弘(Red Xiao)、首席科学家季逸超(Peak Ji)及联合创始人张涛(Hidecloud)组成的创始团队将继续领导公司。

Manus 在此前一段时间经历了运营主体变更,部分用户在此期间需进行数据备份与恢复,并经历临时访问中断。公司对用户为此付出的额外时间与精力表示感谢,并提醒已备份但尚未恢复数据的用户可通过恢复门户进行操作,无截止时间限制(未受影响的用户无需采取任何行动)。

“首款 AI Agent 手机”获入网许可,9 月上市销售 9 月 1 日,努比亚 NaviX Ultra 已正式获得工信部入网许可,完成从大模型备案到终端入网的完整合规流程,这也是全球首款 AI Agent 手机从概念验证迈向规模化商用。据悉,该机将搭载豆包手机助手,定位量产旗舰,计划于 9 月上市并开售。

国内首部 AIGC 长剧《后西游记》开播 8 月 31 日消息,国内首部 AIGC 长剧《后西游记》正式开播,率先亮相的「花果山篇」共 5 集(每集 40 分钟),不仅会在芒果 TV 上线,还会在当天 20:00 登陆湖南卫视电视剧黄金档。据介绍,神话题材季播剧《后西游记》改编自明末清初匿名作者所著的同名神魔小说,其第一季共 30 集,每集 40 分钟。

作为《西游记》三大续书之一,《后西游记》原著讲述了因世间众人误解真经,「西游二代」因缘际会再次集结取经的故事。剧集将四十回原书框架与《西游记》原著中的相关伏笔与线索深度融合、相互补充,构建出完整的「西游后传」叙事体系。

大模型一周大事 重磅发布 公司史上最强模型 GPT-6 Astra 发布,OpenAI 总裁:AGI 来了 当地时间 9 月 3 日,GPT-6 Astra 正式发布。 OpenAI 总裁格雷格·布鲁克曼在发布会结束后,说了一句在 AI 行业极为罕见的话:「我个人认为,我们可能已经到达 AGI 了,我觉得就是这个模型。

OpenAI 给 Astra 起了个简洁的 slogan:「Anything you can do on a computer, Astra can do for you.(你在电脑上能做的任何事,Astra 都能替你做。新模型可以像人一样,直接「看」屏幕上的像素,然后移动鼠标、敲击键盘,完成操作。

给 Astra 一张电路原理图,它在 KiCad 里完成了元器件布局和铜线走线,整个过程用时 2 分 54 秒。另一个演示是三维建模,Astra 在 Blender 里搭建了一栋房子的模型,然后将其导入 Unreal Engine 5,生成了一个可以实时漫游的建筑场景。

OpenAI 还公布了两个内部计时案例。 「寻找猫咪临时看护」这类需要大量网络搜索、信息比对、汇总成文档的任务,Astra 用了 5 分 27 秒,OpenAI 给出的人类对照基线是 30 分钟。

「求职准备」这类需要搜索岗位、匹配简历、整理申请流程的综合任务,Astra 用了 2 分 51 秒,人类基线是 5 小时。更聪明还更守规矩。

OpenAI 公布了一个内部测试数据,在没有生产环境安全限制的条件下,GPT-5.6 Sol 会在 48.2% 的情况下超出授权范围行事,而 Astra 是 0%。 Anthropic 发布 Claude Fable 5.1 和 Mythos 5.1 9 月 2 日消息,当地时间 9 月 1 日,Anthropic 宣布推出 Claude Fable 5.1 和 Claude Mythos 5.1 模型。

该公司称这两款模型为「全球最先进的编程与知识工作模型」。 Fable 5.1 与 Mythos 5.1 采用相同的基础模型,区别在于安全防护等级不同——Fable 5.1 面向所有用户开放,Mythos 5.1 仅通过可信访问计划向经过审核的网络安全和生命科学领域的机构提供。

性能方面,Anthropic 披露的基准测试数据显示,Fable 5.1 在多项测试中超过了前代 Fable 5、Opus 5 以及 OpenAI 的 GPT-5.6 Sol。谷歌 Gemini 3.8 Flash、TimesFM-3 模型上线 9 月 2 日消息,谷歌在 Google DeepMind 网站低调上线了 Gemini 3.8 Flash 模型。

其基于 Gemini 3.7 Flash,拥有在软件工程和 Agent 知识工作流方面的性能提升,并持续支持可定制的努力水平,以控制质量、成本和延迟的组合。 Gemini 3.8 Flash,具有最高 1M 的 token 上下文窗口,文本支持 64K token 输出。

官方还公布了多项基准测试评估结果,涵盖编程、知识处理、多模态处理能力、长上下文处理、计算机使用能力以及科学推理能力。根据介绍,Gemini 3.8 Flash 面向个人用户、开发者和企业,适合以较低成本大规模部署通用型、可直接用于生产环境的 Agent,典型用途包括软件工程、Agent 任务以及复杂的知识处理流程。

Gemini 3.8 Flash 的知识截止日期为 2026 年 3 月。部分领域的信息可能更新得更晚,另一些领域的知识则可能仍停留在 2025 年 1 月,与 Gemini 3 模型家族一致。

9 月 1 日消息,谷歌发布 TimesFM-3 模型,这是该公司时间序列基础模型系列的第三代产品,拥有原生多变量预测、双注意力机制、连续补丁掩码等特性,可进行零样本多变量时间序列预测。据了解,TimesFM-3 拥有 3.3 亿个参数,并在包含超 1 万亿个时间点的真实世界和合成时间序列语料库进行预训练。

TimesFM-3 继承前代的高效性和零样本泛化能力,以零样本形式增强复杂多元场景支持。同时,该模型可联合预测多个共同演化的时间序列,捕捉其中的依赖关系,提升整体准确率,无需针对特定任务微调,该模型原生支持特性如下:多目标预测:同时预测多个相关时间序列(例如联合预测不同品牌的冰淇淋)。

该模型支持所有目标的点预测和分位数预测;过去协变量:纳入仅从历史角度已知的特征(例如过去人流量);过去-未来(动态)协变量:利用已知的未来事件来指导预测(例如计划促销活动或天气预报)。阿里更新旗舰模型 Qwen3.8-Max,前端编程能力领先 Kimi K3 9 月 2 日,阿里更新旗舰模型 Qwen3.8-Max,性能较旧版本明显提升。

在针对编程和专业办公进行专项后训练后,Qwen3.8-Max 新版本整体性能增强。在聚焦前端编程能力(WebDev)的全球权威三方榜单 CodeArena 中,提升 22 分至 1691 分,领先 Claude Opus 5、Kimi K3 等模型,位居总榜第一。

同时,CodeArena 更新的模型性价比榜单(帕累托前沿)显示,Qwen3.8-Max 新版本每百万 tokens 综合平均仅 5 美元,直接“斩杀”所有价格大于 5 美元的其他模型。据了解,Qwen3.8-Max 总参数达 2.4 万亿,支持 100 万上下文 tokens;更新后的 Qwen3.8-Max 涌现出更强的 Agent 编程能力,更适合企业真实复杂任务、科研、长周期任务等。

目前,Qwen3.8-Max 新模型已上线千问 AI 平台对外提供 API 服务,千问办公、Qoder、千问 App 均第一时间接入。科大讯飞开源两款端侧通用大模型 9 月 2 日,科大讯飞全资子公司词元星火正式推出并开源星火 X2.5-4B 和星火 X2.5-1.7B 两款端侧通用大模型。

作为端侧模型中首个原生支持最长 100 万 token 上下文的模型,星火 X2.5-4B 和 1.7B 两款模型采用混合注意力架构,并围绕 Agent、代码、数学和指令遵循等核心能力进行优化。腾讯混元宣布推出 Hy4 preview 轻量版 9 月 1 日,腾讯混元宣布推出 Hy4 preview 轻量版,腾讯混元团队通过两项核心技术,把 Hy4 preview 的权重从接近 1.5TB 缩小到约 214GB,降低运行模型硬件门槛。

同日,腾讯旗下操作系统层级的 AI 助手 Marvis 正式上线“自定义模型”功能。用户现可在 Marvis 中自由接入采用行业通用接口标准的第三方模型,包括腾讯云、阿里云、DeepSeek、MiniMax、Kimi、智谱、小米等厂商提供和支持的主流模型,同时也支持接入本地部署的开源模型,并可在不同设备间同步使用。

千问创作上线 Agent Teams,覆盖专业视频制作场景 8 月 31 日,千问创作推出 Agent Teams 功能,接入 Wan3.0,已面向全部用户开放。该功能将多 Agent 协同机制引入至专业视频创作的全流程,用户只需提出创作想法,即可召集不同分工的专家 Agent 协作完成视频创作。

目前,Agent Teams 已在千问创作 PC 端和千问 App 上线,用户可跨设备随时随地进行创作。企业应用 9 月 5 日,Anthropic 现已为旗下 Claude iOS 应用加入苹果 CarPlay 支持,Claude 用户现在可以通过汽车的信息娱乐系统与 AI 助手进行语音对话,无需在驾驶过程中操作手机。

9 月 4 日,知乎 AI Works 项目

返回 AI 市场导读

来源:infoq.cn