GLM-5.3-Flash 技术说明:180 亿激活参数,加入原生视觉
AutoClaw 官方发布 GLM-5.3-Flash 技术说明,介绍其原生多模态设计。模型总参数为 3200 亿,激活参数为 180 亿。

AutoClaw 官方发布 GLM-5.3-Flash 技术说明,介绍其原生多模态设计。模型总参数为 3200 亿,激活参数为 180 亿。
Google 发布 Gemini 4 Argon,强调复杂编程和长任务能力。首批访问通过 Fairwind 计划向受信任的网络防御人员开放,更广泛的开发者与消费者访问仍待后续推出。
详细说明 GPT-6.1 Sol 在代码、文档与跨应用工作中的用法,区分客户端与 API 推理设置,配合两张官方流程图解释 Multi-agent,并拆解真实任务成本。
Anthropic 发布 Claude Sonnet 5.5,称输出速度较 Sonnet 5 提高逾三成,任务成本最多降低三成。输入与输出 token 单价不变,节省主要来自任务用量减少。
Anthropic 发布 Claude Opus 5.5,输入与输出 token 单价较 Opus 5 降低 20%。官方称典型任务成本降低约 40%,两种降幅口径不同。
Grok 4.7 面向长任务和知识工作,官方称其加强了自我检查。基础服务沿用 Grok 4.6 的价格与速度。
Qwen-Image-2.1 将文生图与编辑统一,原生支持透明图片。视觉生成组件采用 70 亿参数设计。
Qwen3.8-LiveTranslate 重构实时同传架构,加入说话人区分和原文译文同步显示。官方测得平均延迟由 2.8 秒降至 2.3 秒。
Grok Voice Transcribe 2.0 改进多语言与复杂环境转写,沿用上一版价格。官方提供批量和实时两种接入方式。
TypeSafe 的 Jev 走向结构化决策:六张发布与教程配图,详解 Choice、Score、Noul、成本评测、搜索重排和可运行的 Python 接入示例。
K2.8 Preview 已全量上线 Kimi Code,客户端继续使用 kimi-for-coding。官方称其改善了编程、智能体能力和思考效率。
OpenAI 将 GPT-Live-1 接入 API,支持边听边说的全双工对话。复杂推理与工具调用可交给后端模型处理。
DeepSeek 发布原生多模态 V4.1 Flash,API 标识为 deepseek-flash。它采用非对称架构,分别压缩输入与输出计算。
Astra 如何处理复杂代码、研究与跨应用工作?从百万 token 上下文到异步工具、工作中调整要求、Ultrafast,逐项说明使用方式、验收方法与费用。
Google 推出 Gemini 3.8 Flash 与 Flash Cyber,分别面向常规智能体任务和安全防御。Flash 沿用 3.7 Flash 的入门价格。
Anthropic 推出 Fable 5.1 与 Mythos 5.1,两者基于同一模型但采用不同防护设置。Fable 5.1 普遍开放,Mythos 5.1 限受信任访问计划。
Z.ai 发布 GLM-5.3,沿用 GLM-5.2 基础模型,通过后训练提升编程与长任务能力。新版不再支持关闭思考。