先抛一个反直觉的事实:腾讯混元 8 月 28 日发布的 Hy4 preview,总参数 770B,每次推理只激活 49B,上下文 1M,API 输入定价 6 元每百万 token。 大,通常意味着贵。但这次是又大又便宜。中间的矛盾,靠一个叫 MoE 的架构给抹平了。 这篇不讲公式,只把三件事讲明白:MoE 稀疏激活到底省了什么、1M 上下文意味着什么、以及这次发布里真正值钱的那条信息是什么。 一、…
把一个大模型装进手机里、不联网也能聊天,是很多隐私敏感用户一直以来的愿望。8 月 4 日登上 Hacker News 热榜的开源项目 Swiftlet,把这件事往前推了一大步:它用一套 Swift + Metal 运行时,让 80B 参数的大模型在 Mac 上运行时峰值内存只有 4.3GB,35B 版本甚至能在 iPhone 上原生运行——据开发者称,这是该量级模型首次在手机上原生跑通,全程不碰服…
2026年6月8日,港股”AGI第一股”云知声扔出一颗深水炸弹:新一代通用大语言模型U2正式发布。 这不是又一个万亿参数的”军备竞赛选手”,而是一个反过来质疑”参数越大越好”这条底层逻辑的挑战者。2660亿MoE总参数、100+步复杂工作流自主拆解、GPQA Diamond 87.9分超过DeepSeek-V4-Flash(H…