ALGORITHM AI内部:从未被编程的东西 没有人编写这些规则。梯度下降自己找到了它们——一个隐藏的三角算法、一个自学的复制电路,以及一个从未有人绘制过的游戏棋盘,并将它们留在了权重中,研究人员现在可以将它们读出来。这里有三个真实的发现,其中两个是我从零开始复制的。
ALGORITHM 雅可比透镜:读懂 LLM 的内心 一种新的可解释性方法在Claude内部发现了类似全局工作区的东西。在一场精心设计的勒索测试中,模型在打出第一个字之前就默默权衡了筹码和生存,而且它已经猜到整个场景是假的。
ALGORITHM 为智能体工作流优化MLX引擎 在这篇帖子中,我将解释这项更新解决的缓存复用问题、为什么当前开源 LLM 模型让回退(rewinding)变得更困难,以及新的磁盘-backed 缓存是如何工作的。
ALGORITHM MinerU-Diffusion:OCR的新路径 令人不安的事实是,一些OCR系统看起来比实际更聪明,因为语言帮助它们填补了空白。 但当页面不再可预测时,真正的视觉阅读就变得难以伪造。
ALGORITHM 代码学习: GPT-2 vs LLaMA 3 如何通过真实代码理解现代LLM的架构——从nanoGPT(300行代码,忠实还原2019年论文中的GPT-2)开始,逐步走过导致LLaMA 3的四个刻意变更。每个替换都附有技术动机、代码差异和部署运营影响。
ALGORITHM 本福特定律:数据中的秘密指纹 数字中隐藏着一个奇特的指纹——一种如此微妙的模式,以至于大多数人从未注意到它,却又如此强大,以至于它揭露了财务欺诈、伪造的选举,甚至是数十亿美元公司里的做假账行为。