AI推理

17

大模型不靠蛮力:拆解混元 Hy4 的 MoE 稀疏激活 + 1M 上下文,看懂参数背后的成本与算力账

先抛一个反直觉的事实:腾讯混元 8 月 28 日发布的 Hy4 preview,总参数 770B,每次推理只激活 49B,上下文 1M,API 输入定价 6 元每百万 token。 大,通常意味着贵。但这次是又大又便宜。中间的矛盾,靠一个叫 MoE 的架构给抹平了。 这篇不讲公式,只把三件事讲明白:MoE 稀疏激活到底省了什么、1M 上下文意味着什么、以及这次发布里真正值钱的那条信息是什么。 一、…

刚刚!小米玄戒 O100 发布,手机本地跑大模型再提速

手机本地跑大模型这事儿,过去总卡在一个字上:慢。参数一大,云端来回传、显存带宽不够,体验就垮了。8 月 24 日,小米一口气发了三颗自研玄戒芯片,其中专门盯住”端侧大模型加速”的那颗——玄戒 O100——就是冲着这个瓶颈去的(来源:新华网客户端 xinhuanet.com,2026-08-25;21世纪经济报道,2026-08-25)。 玄戒 O100 到底是什么 玄戒 O…

只用 65% 训练数据逼近 Qwen3:扩散模型要翻盘?

大模型训练的「效率天花板」可能要被打破了。8 月下旬,中国人民大学高瓴人工智能学院李崇轩、文继荣团队联合蚂蚁集团,发布了一项重量级研究:首次系统刻画了混合专家(MoE)扩散语言模型的扩展定律,并据此从头训练出新一代扩散语言模型 LLaDA MoE v2——只用了 Qwen3 同规模约 65% 的预训练词元,就在多项基准上逼近甚至超越 Qwen3 的水平。 这是扩散语言模型路线的一个重要里程碑。但很…

小红书亲自下场做AI!dots3-note主打生活决策

你印象里的小红书,是种草笔记和攻略帖。但 8 月 16 日,小红书旗下的 dots 实验室悄悄干了一件「不像是小红书会干的事」——开源了一个大模型 dots3-note。而且它不是又一个通用聊天模型,而是主打一个很生活化的场景:帮你做模糊的生活决策。一个内容平台亲自下场做模型,这事儿挺值得聊。 小红书不晒笔记了,改做模型了 dots3-note 目前是 preview(预览版),已经在开源社区放出…

Codex多智能体v2上线,复杂活仅20%用最强模型

你有没有过这种体验:给 AI 下一个大任务,它吭哧吭哧干半天,结果中途卡住、上下文爆掉、越改越乱。8 月 16 日,OpenAI 工程师宣布 Codex「多智能体 v2(Multi-Agent v2)」全量上线——这一次,它不再是单打独斗的一个对话框,而是变成了一个会自己拆活、自己派活的「包工头」。 一个 Agent 带飞一群「小弟」,Codex 悄悄变了 过去我们用 Codex,基本是「你问我答…

OpenAI首颗自研芯片Jalapeño问世:9个月流片创行业纪录,推理成本直降50%,英伟达垄断被撕开第一道口子

OpenAI正式入局芯片赛道。2026年6月24日,OpenAI与博通联合发布首款定制AI推理芯片Jalapeño(墨西哥辣椒),从白纸设计到流片仅用9个月,创下高性能ASIC开发的历史最快纪录。博通CEO陈福阳现场表态:性能可与英伟达Blackwell和谷歌TPU媲美。 这颗芯片不对外销售,只供OpenAI内部使用——为ChatGPT、Codex、API和未来智能体产品提供算力。它的出现,标志着…

Flowith深度评测:画布式AI创作平台,让你的思维导图直接变成PPT和报告

传统的AI交互是什么样的? 打开ChatGPT,输入提示词,等待回复,复制粘贴到文档。 这个过程是线性的、串行的。如果你需要同时探索多个想法、对比不同方案、整理成结构化文档——你只能在各个工具之间来回切换。 有没有一种方式,能够把: 思维发散(像思维导图一样) AI协作(像对话一样) 内容生成(PPT、报告、文档) 整合到一个界面里? 这就是 Flowith 想要解决的问题。 一、Flowith是…

Qoder深度评测:多Agent协作架构,AI编程助手的下一个进化方向

一、Qoder是什么 Qoder是一款由国内团队开发的AI编程助手,于2024年正式发布。它通过多Agent协作架构,让AI能够自主完成整个编程任务,而不仅仅是提供代码补全。与传统的AI编程工具不同,Qoder强调”任务级”而非”代码级”的AI协作。 Qoder的核心特色是”Quest模式”——用户描述一个需求,Qoder会自…

Claude Code信任危机:思考深度暴跌67%,AI编程神话破灭?

2026年4月,AI编程圈发生了一场地震。 Anthropic旗下的明星产品Claude Code——那个被无数开发者称为”编程神器”的AI工具——正面临一场前所未有的信任危机。 起因是AMD AI团队负责人Stella Laurenzo在GitHub上发布的一份深度分析报告。这份报告基于对6852个Claude Code会话、234760次工具调用、17871个思考模块的…

锐智AI深度评测:96.2%满意度是如何炼成的?2026年学术写作AI新标杆

2025年,一份针对学术类AI工具用户满意度的调研报告在学术圈引发关注。在这份报告中,一款名为”锐智AI”的论文写作工具以96.2%的好评率位居同类产品第一,力压多款知名竞品。 这个数字让很多人感到意外。在AI论文写作工具这个竞争激烈的赛道上,锐智AI并不像某些大厂出品那样”含着金汤匙出生”,它凭什么能获得如此高的用户满意度? 作为一个长期关注AI学…

68爱写AI论文深度评测:十万字长文写作不断联,期刊职称论文首选利器

写期刊论文最怕什么?不是怕选题难,不是怕文献多,而是怕写到一半脑子断电——写了三千字发现逻辑断了,写了五千字发现前后矛盾,写了一万字发现跑偏了主题。 这是所有写过期刊论文、职称论文的人都有过的崩溃经历。传统AI论文工具的通病就是:短文本还行,长文本一写就崩,内容前后脱节,论点自相矛盾,最后还得全部推翻重来。 但68爱写AI解决了这个痛点。 它自称”长文写作专家”,宣称可以驾…

掌桥科研AI论文深度评测:3亿文献支撑的学术写作神器,实测30分钟产出万字初稿

凌晨三点,论文开题报告依然卡在”研究背景”不知道如何下笔;文献综述翻了几十篇PDF却不知道如何组织;好不容易写完正文,查重率却高达40%——这是每一个经历过学术写作的人都会懂的崩溃。 但现在,一款工具可能彻底改变这一切。 掌桥科研AI论文写作工具声称:30分钟产出万字论文初稿,查重率低于15%。它背后有3亿+真实文献数据库支撑,搭载自研论文学术大模型6.0+DeepSeek…

Gemini深度整合Gmail:AI邮件助手重磅升级,打工人效率提升40%

4月9日,谷歌扔出一颗重磅炸弹:旗下大模型Gemini正式深度整合进Gmail。这意味着什么?你的邮箱即将变身为一个全能的AI邮件秘书,不仅能帮你写邮件、润色措辞、生成回复建议,还能自动总结长邮件、按优先级排序收件箱。唯一的好消息是:谷歌强调这些功能不会用你的邮件数据训练AI模型。 这次整合不是简单的功能叠加,而是AI办公的一次质的飞跃。当全球最强大的大模型遇上全球使用最广泛的邮箱服务,产生的化学…

Bolt.new评测:AI全栈开发神器,一个浏览器搞定整个项目

2026年的AI编程赛道,已经从最初的代码补全助手,进化成了真正的”全栈开发平台”。 曾经,创建一个完整的Web应用需要专业团队:前端工程师、后端工程师、数据库管理员、运维工程师……每个环节都需要专门的人才。 现在,有了Bolt.new,你只需要一个浏览器,就能完成以上所有工作。 这听起来像是吹牛。但实测下来,Bolt.new确实做到了。它不仅能生成前端界面,还能处理后端逻…

【进阶实战】Day30:进阶项目综合——从需求分析到落地的完整案例

导语 30天,我们从AI是什么,一路学到了如何建立AI工作流、如何进行模型微调、如何设计评测体系、如何防御Prompt Injection。知识已经足够多,但”知道”和”做到”之间,还差一个完整的项目。 纸上得来终觉浅,绝知此事要躬行。今天,我们将用一个完整的实战项目,把30天学到的所有知识串联起来。 这个项目是:为一个律所构建AI法律咨询助手。 从…

库拉AI(Kula AI)深度评测:一站式聚合ChatGPT、Claude、Gemini、DeepSeek,到底有多香?

2026年,AI工具已经从”尝鲜时代”进入”实用时代”。 但问题来了:ChatGPT、Claude、Gemini、DeepSeek、通义千问…每个都很好用,但想用齐得注册十几个账号、记住十几个网址、有时候还得科学上网。 库拉AI(Kula AI)就是来解决这个痛点的——一个平台聚合所有主流AI模型,让你像”点菜”一样自由切换。…