长程Agent实战:Qwen压过GPT但代价高

admin7天前47
长程Agent实战:Qwen压过GPT但代价高
从零实战搭建“3D大模型演进宇宙”网站,对比Qwen 3.8-Max与GPT-5.6:前者交付细节与鲁棒性更强,代价是更长迭代与更高成本。聚焦长程Agent与真实环境RL,剖析工具调用与百万级上下文对...

交通AI为何上不了路?PDE三角给出答案

admin1周前 (09-01)62
交通AI为何上不了路?PDE三角给出答案
大模型热潮下,强化学习交通信号控制屡胜论文却难部署。本文基于 IJCAI 2026,提出可部署交通AI的PDE三角:感知、决策、可解释性,聚焦真实世界数据脏乱与分布漂移、异常检测与不确定性评估,强调数...

强化学习加速GLM-5:训推一致与智算云协同

admin3周前 (08-19)55
强化学习加速GLM-5:训推一致与智算云协同
大模型从堆参数转向强化学习驱动的能力Scaling。文章解读GLM-5后训练RL如何实现训推一致,与九章智算云协同打造低成本、可扩展AI基础设施,并在SWE-bench Pro等基准上验证长时序、多步...

AI工程智能:从炫技到担当的转折点

admin4个月前 (05-22)137
AI正从文本生成走向真实工程系统,同济大学华先胜院长指出工程是AI成熟的试金石,需体系化落地赋能楼宇桥梁交通制造等复杂场景。...

AI用代码决策:打破强化学习传统

admin4个月前 (05-10)171
OpenAI研究员提出启发式学习(HL),让AI通过编写Python代码实现智能决策,无需训练神经网络,提升可解释性与效率。...

MemoraX AI突破内生记忆技术瓶颈

admin4个月前 (04-29)193
MemoraX AI完成千万美元融资,专注内生记忆技术研发,通过Agentic RL框架实现AI从存储到记忆的质变,推动智能体向真正自主学习迈进。...

轻舟智航500TOPS方案突破自动驾驶瓶颈

admin5个月前 (04-26)210
轻舟智航推出世界模型+强化学习架构,仅用500TOPS算力实现全场景智能辅助驾驶,让AI真正理解物理世界,突破数据驱动局限。...

轻舟智航迈向物理AI新纪元

admin5个月前 (04-25)262
轻舟智航从无人驾驶转向物理AI,提出世界模型+强化学习双引擎架构,推动自动驾驶技术范式跃迁。...

AI自主玩手机!ClawGUI打通训练评测部署全流程

admin5个月前 (04-19)339
浙江大学团队开源ClawGUI框架,首次实现GUI智能体从训练、评测到真机部署的完整闭环。支持AI自主操作手机界面,打破仿真与现实的鸿沟,推动智能体走向真实应用。...