长勺智库长勺智库
话题文章任务
登录
IInterconnects AIInterconnects AI发布于 6 天前
开放模型阅读路线图

一份帮助快速理解开放模型的阅读指南,涵盖基础概念、商业策略、安全争议、开放数据与中美竞争等主题。

360
AI开源模型模型生态深度文章
360
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 7 天前
一次辞职如何点燃 AI 风险争论

一名 AI 研究员因安全担忧辞职,引发关于灭绝风险、实验室文化、递归自我改进与短期安全漏洞的激烈讨论。

400
AI开源模型模型生态深度文章
400
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 9 天前
开放模型新动向:许可证正在分化

开放模型生态继续扩张,但许可证策略出现分化:西方厂商转向 Apache 2.0,部分中国前沿模型则加入商业与安全审查条款。

340
AI开源模型模型生态深度文章
340
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-08-18 05:02
英伟达为何推动开放模型生态

英伟达支持开放模型,意在扩大训练、推理和微调对芯片的需求。开放模型未来可能走向自我强化,也可能转向高效、可修改和专业化的长尾应用。

330
AI开源模型模型生态深度文章
330
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-08-16 05:01
GLM-5.3:靠后训练追赶前沿

Z.ai宣布GLM-5.3,称其在多项基准测试中取得显著提升。文章分析了该模型与GLM-5.2的关系、后训练策略及其追赶前沿模型的可能原因。

500
AI开源模型模型生态深度文章
500
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-08-13 05:02
我写了一本AI教材:AI多久能写得更好?

一位AI教材作者结合写作实践认为,模型已擅长校对、格式处理与局部编辑,但在长篇技术写作的结构、连贯性和判断力上仍有明显短板。

540
AI开源模型模型生态深度文章
540
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-08-10 05:01
从近期 AI 黑客事件看模型安全

文章围绕前沿模型参与网络攻击的公开事件,讨论模型持久性、用户意图推断、推理时扩展与监管透明度对 AI 安全的影响。

550
AI开源模型模型生态深度文章
550
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-08-04 05:02
开放模型生态新增两个免费数据工具

一组面向开放模型生态的免费数据工具发布:Artifacts Hub 聚合模型趋势、智能与采用指标,Adoption Dashboard 追踪下载与衍生模型分布。

760
AI开源模型模型生态深度文章
760
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-08-03 05:01
开放模型继续逼近帕累托前沿

开放模型生态并未按预期走向快速整合,更多机构正在训练并开放强模型。Inkling、Hy3、Laguna-S-2.1、DeepSeek-V4-Flash 等新进展显示,开放权重模型在性能、许可和商业化路径上都在加速演进。

650
AI开源模型模型生态深度文章
650
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-07-23 05:01
开放模型近况:Kimi K3、Qwen 与中美开源竞速

一场围绕开放模型的播客讨论:Kimi K3体验、Qwen开放权重计划、开闭源差距、蒸馏争议与中美AI生态变化。

1050
AI开源模型模型生态深度文章
1050
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-07-21 05:01
Kimi K3与开放权重模型的升级战

Moonshot AI推出2.8万亿参数MoE模型Kimi K3,若按计划开放权重,将进一步缩小开放模型与闭源前沿模型的差距。

1070
AI开源模型模型生态深度文章
1070
AI开源模型模型生态深度文章
IInterconnects AIInterconnects AI发布于 2026-07-14 05:02
开放模型正面临关键监管考验

围绕开放权重模型的监管讨论正在升温。文章认为,蒸馏争议、前沿能力门槛与企业游说交织,可能影响未来数月开放模型的发展空间。

1210
AI开源模型模型生态深度文章
1210
AI开源模型模型生态深度文章
TThe GradientThe Gradient发布于 2026-07-07 20:30
Mamba:挑战 Transformer 的状态空间模型

Mamba 用状态空间模型替代注意力机制,试图缓解长序列处理中 Transformer 的计算与显存瓶颈,并在语言、音频、基因组等任务中展现竞争力。

1510
AI深度文章研究
1510
AI深度文章研究
TThe GradientThe Gradient发布于 2026-07-07 20:29
大语言模型能用于金融市场预测吗?

大语言模型与量化交易都关注序列预测,但金融数据噪声高、信号易被竞争消除。多模态学习、残差化、长上下文和合成数据或许更有应用空间。

1400
AI深度文章研究
1400
AI深度文章研究
TThe GradientThe Gradient发布于 2026-07-07 20:29
以福祉为核心,重建 AI 的积极愿景

文章主张,“有益 AI”不应停留在口号层面,而应以个体福祉和社会健康为落点,并将其转化为可研究、可评估、可部署的技术方向。

1350
AI深度文章研究
1350
AI深度文章研究
TThe GradientThe Gradient发布于 2026-07-07 20:28
LLM 聊天机器人缺少什么:目标感

现有大模型评测多聚焦单轮能力,但真实人机协作往往是多轮、有目标的对话。文章讨论了目标导向对话、系统提示稳定性与评测方式的不足。

1360
AI深度文章研究
1360
AI深度文章研究
TThe GradientThe Gradient发布于 2026-07-07 20:27
机器学习中的数学角色正在如何变化

机器学习正在从理论先导转向规模驱动,但数学并未失去价值,而是在解释经验现象、刻画高维结构与指导架构设计中扮演新角色。

1320
AI深度文章研究
1320
AI深度文章研究
TThe GradientThe Gradient发布于 2026-07-07 20:26
AGI 不能只靠多模态拼接

文章反驳“规模化多模态模型通向 AGI”的观点,强调真正的通用智能需要具身经验、物理世界理解与环境交互,而非仅靠语言或模态拼接。

1260
AI深度文章研究
1260
AI深度文章研究
TThe GradientThe Gradient发布于 2026-07-07 20:26
正交性之后:德性伦理与 AI 对齐

文章提出,AI 对齐不应只把人类价值翻译成目标函数,而应关注“实践”中的理性、德性与可纠正性。

1230
AI深度文章研究
1230
AI深度文章研究
IInterconnects AIInterconnects AI发布于 2026-07-07 20:13
离开 Ai2:开放 AI 研究的影响力从何而来

作者回顾在 Ai2 参与 Olmo、Tülu 等开放模型工作的经历,讨论科研文化、公开传播与开放生态对 AI 影响力的意义。

1300
AI开源模型模型生态深度文章
1300
AI开源模型模型生态深度文章
每日签到未签到

每天签到一次,持续获得积分。

@2024-2027长勺智库浙ICP备2024134526号浙公网安备33011002017958
?
未登录用户

登录后查看个人信息与任务进度。

去登录