港股AGI第一股:智能体与Token计费双轮增长

admin14小时前22
港股AGI第一股:智能体与Token计费双轮增长
消费级热度回落,企业级智能体加速落地。港股AGI第一股上半年营收5.62亿元,智能体占比超八成;Token计费的模型调用收入二季度环比暴增5倍,毛利率超60%,形成“进流程+按调用计费”的双轮驱动。...

Sora为何输给Codex:关键在GPU时间复用

admin14小时前17
Sora为何输给Codex:关键在GPU时间复用
同为烧GPU的大户,为什么视频生成Sora在资源倾斜上不敌代码智能体Codex?本文从工作负载形态、扩散采样、KV cache与调度角度解析算力复用与吞吐瓶颈。...

深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?

admin20小时前19
深度拆解 Muse Glimmer,24GB 显存跑 30B Agent,Meta 到底做了什么?
## 引言 Meta 推出的 Muse Glimmer,并不是再造一个“大模型聊得更好”的故事,而是直指本地长时运行的 Agent:在一张 24GB 显存的显卡上,处理屏幕、图片、工具与代码执行,且维...

有道AI耳机OpenPods:iPhone同传助手

admin2天前25
有道AI耳机OpenPods:iPhone同传助手
OpenPods有道AI耳机,专为iPhone打造的Agent耳机,基于苹果MFi与系统级接入,一键录音转写翻译与双向同传,三端协同构建采集-理解-整理-调用工作流,让语音变知识资产。...

GLM-5.3-Flash低成本多模态突围

admin2天前19
GLM-5.3-Flash低成本多模态突围
解读GLM-5.3-Flash的原生多模态与低成本架构:MoE稀疏激活与统一编码提升吞吐与时延。结合国产异构基础设施与“Token工厂”,以TPW衡量能效,实现可负担的大规模商用。...

阿里发布Qoder:任务优先的智能体工作台

admin2天前20
阿里发布Qoder:任务优先的智能体工作台
阿里推出 Qoder 智能体工作台,采用任务为先设计,提供编程模式与通用模式。以 Coding 为核心,内置 Qwen3.8-Max 等模型与 Auto 调度,强弱模型协作控成本提质量。支持多种连接器...

商汤首次盈利:从价格战到结果交付

admin3天前29
商汤首次盈利:从价格战到结果交付
商汤2026年上半年首次盈利6.2亿元,靠统一模型体系、可扩展Token工厂与智能体管控,将算力模型调用升级为智能产能任务编排结果交付,摆脱价格战,增强定价权与现金流,并向空间智能世界模型物理智能延伸...

Qwen3.8-Flash加速千问办公:快省更智

admin3天前18
Qwen3.8-Flash加速千问办公:快省更智
千问办公首发接入Qwen3.8-Flash,推出全新标准模式:单任务生成速度约翻倍,平均Token消耗降至四分之一。结合Agent与推理链优化,95%日常办公需求在默认模式即可快、稳、够用,复杂长链路...

阿里Qwen3.8-Flash:6B激活,越级性能

admin3天前23
阿里Qwen3.8-Flash:6B激活,越级性能
阿里开源Qwen3.8-Flash,Next架构让125B仅6B激活;QSA注意力、门控残差与N-gram嵌入强化长上下文与多模态MoE,训练成本降近90%,推理输入1元/百万tokens、输出3元,...

通用中间层突围,重塑具身智能

admin4天前32
通用中间层突围,重塑具身智能
范式发布PhanthyMotus生态共建计划,以通用中间层解耦算法与硬件,统一语义接口、标准化驱动与技能复用,打通多形态机器人,助力具身智能从开源走向多方共建与规模落地。...