TypeSafe 发布 Jev,定位为补充慢速大模型的“系统一模型”,主打快速、低成本、校准决策,而不是聊天、写代码或复杂推理。
AIUC CEO Rune Kvist 谈 4000 万美元 A 轮融资、AIUC-1 标准、AI Agent 安全测试,以及当自主系统出错时的责任与保险问题。
NVIDIA 称 TensorRT Edge-LLM 在 Jetson AGX Thor 上完成 MLPerf Edge Agentic Benchmark,速度提升至 6.4 倍。
AI Evaluator Forum 发布 AEF-1 基线,围绕第三方评估的访问权限、利益冲突、资金关系与透明度提出要求,呼应前沿模型“降速”争论。
Cloudflare 新增“禁止 AI 训练”控制项,允许网站继续被搜索引擎发现,同时拒绝混合用途爬虫将内容用于 AI 训练。
MoE 模型可在每个 token 上只激活部分参数,例如 30B 模型每次仅用约 3B 参数,从而在容量与计算成本之间取得不同权衡。
NLP先驱、You.com创始人Richard Socher创办Recursive,押注递归自我改进,目标是打造能加速发明与AI研究的“尤里卡机器”。
DeepSeek V4.1-Flash采用新的因果编码器—解码器架构,并加入原生视觉理解。其重点不只是跑分,而是更高效地处理上下文与长时智能体任务。
FDE 正成为 AI 公司热门岗位,但不同公司对其职责理解差异很大。Vinoo Ganesh 以 Palantir、Citadel 与 Kepler 的经历,解释这一角色的定位、误区与组织实践。
本期梳理 Anthropic 安全事件、OpenAI 产品与治理变化,以及智能体评测、模型工具、机器人和本地推理基础设施的新动态。
一个新的 AEO 追踪项目用 6 种提示词变体、7 个前沿模型和 161 个类别,观察 AI Agent 在推荐产品与服务时的偏好。
作者试用 Grok Bot 后认为,它与 OpenClaw 的差异不在能力强弱,而在抽象层级:前者更像托管电脑,后者更像用户自有平台。




