<?xml version="1.0" encoding="utf-8" standalone="yes"?><rss version="2.0" xmlns:atom="http://www.w3.org/2005/Atom" xmlns:content="http://purl.org/rss/1.0/modules/content/"><channel><title>LIMA on AI 学习笔记</title><link>https://jason-azure.github.io/ai-blog/tags/lima/</link><description>Recent content in LIMA on AI 学习笔记</description><generator>Hugo -- 0.146.0</generator><language>zh-CN</language><lastBuildDate>Sat, 11 Apr 2026 00:00:00 +0000</lastBuildDate><atom:link href="https://jason-azure.github.io/ai-blog/tags/lima/index.xml" rel="self" type="application/rss+xml"/><item><title>大理石假说——为什么微调不是在教 AI 新东西</title><link>https://jason-azure.github.io/ai-blog/posts/finetuning-illusion/</link><pubDate>Sat, 11 Apr 2026 00:00:00 +0000</pubDate><guid>https://jason-azure.github.io/ai-blog/posts/finetuning-illusion/</guid><description>预训练用了 15 万亿 tokens，微调只用了 1000 条。数据量差了一百亿倍，但行为变化却翻天覆地。更诡异的是，微调和预训练的算法完全一样——同样的反向传播、同样的梯度下降。那凭什么微调能起作用？答案简单到令人不安：因为你停了。</description></item></channel></rss>