谷歌 Gemini 3.8加速:长上下文与专业推理

admin5天前33
谷歌 Gemini 3.8加速:长上下文与专业推理
谷歌发布 Gemini 3.8,长上下文与专业多步推理强化工程与智能体;World Labs 推出多模态世界模型 Atlas,阿里更新 Qwen3.8-Max-0902。Gemini 促销定价与 Fl...

Qwen3.8-27B实测:本地Agent斩杀线?

admin6天前70
Qwen3.8-27B实测:本地Agent斩杀线?
实测阿里开源大模型 Qwen3.8-27B:27B 架构、原生 262K 长上下文与多模态,量化部署可落地桌面。对比 vLLM、SGLang、Llama.cpp 的吞吐与延迟,解析本地 Agent 编...

DeepSeek V4:视觉Token全程参与

admin6天前39
DeepSeek V4:视觉Token全程参与
深入解析DeepSeek V4视觉链路:32层ViT与二维RoPE保留空间语义,Aligner后置压缩对齐4096维;视觉Token全程参与长上下文与MoE路由、Agent推理,重塑多模态与工具调用效...

DeepSeek V4开放视觉,多模态智能体

admin2周前 (08-22)55
DeepSeek V4开放视觉,多模态智能体
DeepSeek V4 Vision-Exp 通过官方API开放视觉输入,支持图文混合理解与推理,长上下文与工具调用强化。图片按tokens计费,单图最多384 tokens,预算可控,助力多模态智能...

商汤U1.5 Lite:长上下文与原生4K全面升级

admin3周前 (08-22)61
商汤U1.5 Lite:长上下文与原生4K全面升级
商汤开源的 SenseNova U1.5 Lite 正式版,以统一多模态架构重塑数据与任务,强化长上下文指令执行、原生高分辨率与可信图像编辑,在文字与布局、身份一致性与精细控制上更可控更稳定,面向按要...

DeepSeek缓存命中涨到11倍,存储税来了

admin3周前 (08-18)57
DeepSeek缓存命中涨到11倍,存储税来了
DeepSeek将缓存命中价格高峰期提高至11倍,并启用按时间分段计费,折射长上下文应用的成本转向:算力更便宜,状态保存与搬运更昂贵。本文解析缓存命中原理、KV压缩、冷热分层(HBM/NVMe),以及...

Qwen3.8-27B:本地多模态Agent详解

admin3周前 (08-16)60
Qwen3.8-27B:本地多模态Agent详解
解读开源Qwen3.8-27B:原生多模态与超长上下文、可控推理,量化后可本地部署于3090/4090。实测在SWE-bench、OSWorld、AndroidWorld与WebArena等评测领先,...

OpenAI七周一更重塑AI竞争格局

admin5个月前 (04-24)246
OpenAI以七周一更的节奏发布GPT-5.5,在长上下文理解与多步骤自主性上实现质变,通过高频迭代压缩对手窗口,重塑AI行业竞争格局。...