行业竞争与模型能力 - 韩国AI初创公司Motif Technologies利用价值2500万美元的政府支持英伟达B200 GPU开发出大语言模型Motif 3,在Artificial Analysis Intelligence Index中获得47分,与阿里巴巴的Qwen 3.7 Max持平[2] - 智谱GLM-5.3 API正式上线,在AA综合智能指数中取得60分,进入全球前沿模型能力区间,与Claude Fable 5、GPT-5.6 Sol等闭源旗舰模型处于同一水平,并与Kimi K3并列开源模型第一[2] - GLM-5.3已接入ZCode等编码平台,并纳入GLM Coding Plan,API定价与GLM-5.2保持不变,模型权重将于下周五开源[2] 硬件与算力创新 - Cerebras发布新一代AI加速器CS-4,推理速度最高可达基于GPU方案的30倍,采用三颗新型WSE-3 Turbo晶圆级引擎,AI算力达750 PFLOPS,内存带宽达129.6 PB/s[3] - 在GPT-OSS-120B测试中,CS-4每用户每秒生成超过4400个Token,最高达到GPU方案的30倍,每瓦吞吐量最高为CS-3的10倍,可支持超过50万亿参数的模型[3] - CS-4预计将于今年第三季度开始出货[3] 行业安全与监管动态 - OpenAI暂缓大规模前沿强化学习训练,暂停规模最大的计划中前沿强化学习训练以加强安全和监控,已暂停最新部署模型的强化学习训练两周,同时强化研究环境并扩大监控覆盖范围[3] - OpenAI将先通过较小规模的训练和评估验证相关安全措施,并进一步获取模型与预期保持一致的证据[3] - 美国宾夕法尼亚州州长发布行政命令,对数据中心建设实施严格限制,要求项目先获得地方政府批准才能申请州级许可,并需遵守节水标准、承担新增用电成本及解决自身电力供应问题[5] - 纽约州已推动大型数据中心环境许可最长暂停一年,得州州长也暂停部分新项目审批并展开审查[5] 商业模式与自动化趋势 - Motif正探索新型代币即服务商业模式,允许基础设施提供商管理GPU集群,终端用户只需根据产生的输入和输出量付费[2] - 谷歌宣称其AI可承担前沿部署工程师的工作,正在用AI自动化专业顾问面向大型企业的部分工作,主要负责企业数据治理[6] - 谷歌云数据库产品副总裁表示,公司已经意识到高度依赖人力模式的局限性,靠招人不足以实现激活企业全部数据的目标[6]
OpenAI暂缓大规模前沿强化学习训练,以加强安全监控;韩国AI初创公司称其新模型可媲美阿里巴巴的Qwen 3.7 Max丨AIGC日报
创业邦·2026-08-20 08:09