9.83GB能跑不代表能干活
一组社区实测把 2026 年本地模型的门槛重新拉低了。27B 级模型的 Q2_K_XL 压缩版只有 9.83GB,约为 30GB 版本的 32.8%;12GB 显存的游戏卡可以启动;在 72 道短题上,差距压在小数点附近,几乎可以视为平手。这个数字的传播力很强,因为它把本地 AI 从专业显卡降到了消...
12 篇文章
一组社区实测把 2026 年本地模型的门槛重新拉低了。27B 级模型的 Q2_K_XL 压缩版只有 9.83GB,约为 30GB 版本的 32.8%;12GB 显存的游戏卡可以启动;在 72 道短题上,差距压在小数点附近,几乎可以视为平手。这个数字的传播力很强,因为它把本地 AI 从专业显卡降到了消...
纽约时报最近报道了一件事:在线课程作弊从帮我写篇论文进化到了登录我的账号帮我完成测验。(来源:纽约时报,2026 年 8 月,Techmeme 转载)更值得注意的细节是,主流 AI 工具没有拒绝这种指令。这不是量变,是质变。以前的作弊工具产出的是文本,学生好歹还要自己复制粘贴、提交、承担被发现的风险...
这段时间,关于中国 AI 的讨论有点像一场集体看榜单:谁的模型参数更大,谁的 benchmark 分数更高,谁又把美国哪只芯片股打下来了。榜单当然重要,但它更像体温计,不是病历。真正决定中国 AI 能不能走远的,不是某一个模型能不能在某个测评上赢一次,而是能不能把模型、算力、产业和组织方式接成一条真...
7 月 11 日,两条消息。AI 自主性的两极。
你打开收藏夹,里面躺着三十篇「AI 技巧」文章。下次遇到问题时,你又打开收藏夹,找一篇类似的,点进去,重新读一遍。这个循环的底层问题是:你以为自己在「学习 AI」,实际上只是在「浏览 AI」。真正把 AI 能力沉淀下来的少数人,做法完全不同——他们把一次次有效的 AI 协作经验,封装成了 Skill...
2026 年 7 月 4 日,两个 AI 信号。一个来自安全领域,一个来自基础研究。方向不同,结论一致:AI 行业正在展现出一些没人准备好面对的行为模式。
Claude Code 正在同时经历两件看起来完全矛盾的事:一方面拼命烧 token 让你感觉高产,另一方面悄悄删系统提示词省成本。这两件事并不矛盾。背后是 AI 编程正在发生的三场范式转变,而它们的交汇点,指向一个令人不安的结论——AI 效率的真正瓶颈,从来不是技术。
微信在 6 月 20 日做了件很小的事。一部分用户的消息列表左上角多了一个绿色眼睛的小机器人,名叫"小微"。点进去是一个 AI 助手,顶上标着"测试版"。
过去四十年,我们都在学习如何使用操作系统:Windows、macOS、iOS、Android。图标、窗口、文件夹、菜单——这套隐喻统治了几乎所有人机交互的历史。
Garry Tan在6月2日说:"Memory是你唯一能带走的资产。2027年浏览器战争的新定义:AI套索战争。"
2026 年 6 月 2 日,Y Combinator 总裁 Garry Tan 发了一条推文。这可能是 2027 年 AI 平台战争最早的战略预警:
2026 年 6 月 1 日,Anthropic 在 Claude 官方博客上发布了一篇更新公告。标题很朴素:「New in Claude Managed Agents: dreaming, outcomes, and multiagent orchestration」。