Page 1 - Showing 6 of 6 posts
View all posts by years →
- 拆解 DeepSeek Harness:九个设计决策,怎么让模型把能力兑现出来
拆 DeepSeek Harness 的九个设计决策:每个讲清它解决什么、DSH 怎么做、代价在哪。九条里有一条 DSH 自己也没答全——判定者那一格。
93 min - 让 Agent 睁开眼 · Qwen-MM-Plugins 把多模态装进每个 harness
Qwen 团队开源的多模态插件集,skill + MCP 双件套让任何 agent harness 原生看图像、视频、文档。从"为什么是插件"出发,拆解读图的预算机制、纯文本模型怎么借眼睛、长视频的四层图记忆怎么建怎么查。
46 min - Prime Agent 架构解析
Prime Intellect 开源自我改进 RLM Agent,上下文即变量的持久 IPython 内核,提示词/记忆/技能/子代理全部可 CRUD 的 Continual Harness。源码逐行拆解 /refine、A2A nuclear family 通信与 autonomous quality gate。
63 min - OpenWorker 架构解析 · 交付成品,不只是聊天
Andrew Ng 团队开源的桌面 AI 同事 OpenWorker,回合引擎、风险标注驱动的并发与权限、canonical 历史实现中途切模型、带外(out-of-band)审批,与 Claude Cowork、Manus、OpenClaw 等同类项目横向对比,拆解技术创新点与行业共识。
41 min - 22580:从 GPT-2 到 Kimi K3,一步步讲透
从 GPT-2 到 Kimi K3 的架构演化全解析。每一步架构变化都用可运行的 PyTorch 代码讲透——门控、路由、衰减与选择性机制,理解 22580 倍规模增长背后的每个决策。
36 min - 补上每个缺口:Transformer 通俗进阶七讲
从最简单的猜词游戏出发,七讲逐步补全 Transformer 的每个缺口:RNN 困境、Attention 诞生、QKV、位置编码、因果 Mask 与训练技巧。不需要任何前置知识。
23 min