Z.ai宣布GLM-5.3,称其在多项基准测试中取得显著提升。文章分析了该模型与GLM-5.2的关系、后训练策略及其追赶前沿模型的可能原因。
Meta Superintelligence Labs 发布首个开放模型 Muse Glimmer。该模型参数规模为 300 亿,采用 Apache 2.0 许可证,面向本地代码智能体,并支持图像输入。
一组面向开放模型生态的免费数据工具发布:Artifacts Hub 聚合模型趋势、智能与采用指标,Adoption Dashboard 追踪下载与衍生模型分布。
开放模型生态并未按预期走向快速整合,更多机构正在训练并开放强模型。Inkling、Hy3、Laguna-S-2.1、DeepSeek-V4-Flash 等新进展显示,开放权重模型在性能、许可和商业化路径上都在加速演进。
Ollama 宣布已获得 8800 万美元融资,投资方包括 Benchmark、Theory Ventures、8VC、Y Combinator 及多位天使投资人。
Ollama 正在预览通过苹果 MLX 机器学习框架在 Apple Silicon 上运行的加速能力,目标是提供更快的本地模型运行体验。
Ollama 0.31 通过 MLX 支持多 Token 预测,使 Gemma 4 在 Apple Silicon 上运行更快;在 Aider polyglot 基准中,编码代理场景最高提速 90%。
作者回顾在 Ai2 参与 Olmo、Tülu 等开放模型工作的经历,讨论科研文化、公开传播与开放生态对 AI 影响力的意义。
美国政府要求 Anthropic 暂停 Claude 5 Mythos/Fable 访问,被视为 AI 治理进入新阶段的信号:前沿模型、国家安全、出口管制与主权 AI 的冲突正在加速显性化。
一场关于大模型后训练演进的访谈:从 InstructGPT 的三步 RLHF,到 DeepSeek R1 的推理 RL,再到多教师在策略蒸馏趋势。


