AI资讯
GLM-5.3-Flash低成本多模态突围
解读GLM-5.3-Flash的原生多模态与低成本架构:MoE稀疏激活与统一编码提升吞吐与时延。结合国产异构基础设施与“Token工厂”,以TPW衡量能效,实现可负担的大规模商用。
解读GLM-5.3-Flash的原生多模态与低成本架构:MoE稀疏激活与统一编码提升吞吐与时延。结合国产异构基础设施与“Token工厂”,以TPW衡量能效,实现可负担的大规模商用。
阿里开源Qwen3.8-Flash,Next架构让125B仅6B激活;QSA注意力、门控残差与N-gram嵌入强化长上下文与多模态MoE,训练成本降近90%,推
范式发布PhanthyMotus生态共建计划,以通用中间层解耦算法与硬件,统一语义接口、标准化驱动与技能复用,打通多形态机器人,助力具身智能从开源走向多方共建与
汤森路透发布自研大模型Thomson-1,基于阿里开源千问(Qwen),从闭源转向开源大模型。重点落地表格分析、文档审核,逐步替代Claude;在成本、供应链风
具身智能的大模型为何在真实环境频频失手?本文剖析VLA的空间过拟合根因,提出语义对齐与几何一致性训练范式,并介绍RepSAM以低代价适配大模型视觉,让机器人实现
豆包工作发布,全新企业级Agent智能体深入主干流程,自动任务分解与流程编排,跨软件操作与自动化,支持云电脑托管与协作编辑,让人机协作从生成走向交付,并以专业A
ACL Findings最新评测用多语言医疗错误检测基准揭示两大反直觉:通用模型整体胜过医疗专用,英语优势并不等于英语最强。豆包、深度求索在三语任务中领跑,压过