共 375 条快讯 - AI自动更新

AI 快讯:行业最新动态

实时更新人工智能与科技领域的产品发布、融资、开源与行业热点,持续更新,帮你快速跟上最新趋势。

开源、智能体、产品 雷峰网 吴恩达开源桌面Agent OpenWorker实测:从极客玩具到数字员工仍有鸿沟 吴恩达与Rohit Prasad联合发布开源桌面Agent OpenWorker,将过去需代码配置的Agent工作流压缩为可直接操作的桌面应用,支持自由切换模型。上线一周后社区反馈显示,其生成新闻简报等基础任务表现尚可,但距离成为普通人的数字员工仍存在显著产品化鸿沟,暴露了多模型协同与任务稳定性等短板。
芯片、算力、推理 雷峰网 OpenAI自研推理芯片Jalapeño跑分公开,与英伟达Rubin效率之争引发热议 OpenAI自研推理芯片Jalapeño公布Token吞吐、生成延迟及单位功耗推理性能等实测数据。随着大模型应用转向持续推理与Agent长链路任务,芯片效率成为数据中心关键指标。Reddit用户将Jalapeño与英伟达Rubin对比,有观点认为其已进入Rubin效率区间,也有声音指出测试条件与软件优化尚未对齐,胜负难分。
智谱GLM-5.3-Flash底层架构引热议,混合注意力机制成降本关键 智谱AI正式发布GLM-5.3-Flash,上线首日登顶OpenRouter调用量榜单。该模型采用混合架构,融合DeepSeek稀疏注意力机制与Kimi线性注意力机制,叠加流形约束超连接技术,大幅降低推理成本。月之暗面研究员对比发现,两者底层代码排布高度重合,均采用KDA线性注意力,核心参数也相近,引发业界对线性注意力技术路线的广泛关注。
模型发布、开源、算力 雷峰网 商汤大装置支撑智谱GLM-5.3-Flash上线,国产算力推动前沿模型普惠 智谱正式上线并开源GLM-5.3-Flash,这是GLM-5系列首个原生多模态模型,总参数320B,能力超越前代,在AA综合智能指数中获57分,与Claude Opus 4.8持平。该模型采用极低成本架构,结合30T Token多模态预训练语料,以更少计算资源实现更强性能。商汤大装置通过国产异构混推技术提供大规模算力支持,打造国产算力规模化商用标杆。
商汤2026上半年首度盈利6.2亿元,经常性收入与毛利率持续提升 商汤公布2026年上半年业绩,首次实现盈利6.2亿元,经常性收入与毛利率持续提升。公司构建的「一套模型、一座Token工厂、一套智能体管控系统」核心能力体系,通过统一多模态架构持续提升智能上限,以基础设施和优化能力降低Token成本。年内密集发布NEO-Unify架构、SenseNova U1等多款模型,覆盖原生多模态、视觉感知、可控生成、长程智能体等方向。