Agent别住毛坯房:ADE三件套落地

admin6小时前8
Agent别住毛坯房:ADE三件套落地
生成式模型加速生码却卡在联调墙。QCon上海HarnessAI分享:以ADE重构AI研发环境,借助沙箱、Artifact文件系统与Agent友好终端,解决环境与验证瓶颈,让Agent自主闭环、稳定联调...

Gemini4硬刚Astra:性能逆袭、价格腰斩

admin6小时前5
Gemini4硬刚Astra:性能逆袭、价格腰斩
谷歌Gemini 4(代号Argon)发布,RSI与长程推理大幅跃升,在工程与网络安全等复杂工作流中更稳。对比Astra,定价几近腰斩并优化配额;DeepSWE、CWE等评测领先,幻觉更少,智能体执行...

城市不爱大电池?分布式储能的隐形崛起

admin12小时前9
城市不爱大电池?分布式储能的隐形崛起
在高密度城市,大型储能受审批与安全掣肘,小而散的分布式储能正“隐身”进社区:PopWheels换电网络服务电动自行车与餐车,家电内置电池平峰填谷,聚合后为电网提供灵活性。...

免费AI代理跑赢付费:算子优化跨芯片超车

admin1天前18
免费AI代理跑赢付费:算子优化跨芯片超车
在同一评测闭环下,免费AI Coding Agent AgnesCode 面向大模型推理的算子优化与跨芯片优化,在 SGLang 任务中取得更高加速比,优于付费闭源方案,证明免费 Agent 已具备进...

全球开源前二,阶跃终于回来了

admin1天前11
全球开源前二,阶跃终于回来了
## 引言 Step 5 Preview 把“阶跃”重新拉回了聚光灯下。它在 AAI 指数中拿到 44 分、位列全球开源前二,证明旗舰基座模型的能力上限并未因押注端侧与 Agent 而掉队。更关键的是...

OpenAI解密多智能体:并行思考重塑推理

admin2天前13
OpenAI解密多智能体:并行思考重塑推理
OpenAI访谈与1300亿token实验揭示:多智能体不是更大模型替代,而是将思考时间并行化的推理时计算第三轴。通过分解、分工、辩论与验证提升答案,但成本、通信瓶颈与可验证性成关键约束。...

深度拆解 Sonnet 5.5 :半价 Opus 只是表象,Agent Runtime 才是变化核心

admin2天前31
深度拆解 Sonnet 5.5 :半价 Opus 只是表象,Agent Runtime 才是变化核心
## 引言 新一代 Claude Sonnet 5.5 看上去只是更快、更稳的常规升级,但几组运行数据把变化指向了更深的层:Lovable 的测试中 Tool Call 数量减少约三分之一、Shell...

DeepSeek知乎独家发文,首次公开V4.1 Agent训练“大本营”DSec

admin2天前17
DeepSeek知乎独家发文,首次公开V4.1 Agent训练“大本营”DSec
## 引言 要把大模型打造成可靠的智能体(Agent),离不开在“真实世界”中反复试错:读写代码、安装依赖、跑测试、启动服务,并且在多轮交互中保留环境状态。这类任务既不像传统训练那样高度批处理,也不同...

四箭齐发直指算力网,英伟达引保险兜底

admin3天前19
四箭齐发直指算力网,英伟达引保险兜底
宏观政策四箭齐发直指六张网,PSL降至1.5%撬动算力网与东数西算;科技再贷款增至1.4万亿,缓解中小企业训练与适配成本;英伟达牵手保险为AI芯片风险定价兜底,DeepSeek v0.2与AI智能体手...

Claude多智能体:真发现还是线索?

admin3天前37
Claude多智能体:真发现还是线索?
Anthropic在分子生物学实验中引入人工智能多智能体,快速筛读生物数据并生成假说;然而要称为科学发现,还需机制解释、可被预测验证与可控应用。本文评析AI在实验闭环中的作用,及其与CRISPR线索的...