大模型

大模型对比

130

马斯克的 Grok 4.6 来了:智能体实测全球第一,价格直接腰斩

马斯克又出手了。8 月 12 日,SpaceXAI 正式发布新一代大模型 Grok 4.6,直接把矛头对准了”AI 干活能力”和”价格”两件事:在真实世界专业任务评测中登顶第一,API 定价却只有其他前沿模型的一半。消息一出,AI 圈讨论度瞬间拉满——毕竟”性能第一 + 价格腰斩”的组合,在旗舰模型里并不常见。 Grok 4.…

深夜悄悄上线!DeepSeek V4 Pro 正式版,多项测试逼近 Claude

大模型圈这两天注定不平静。就在 8 月 12 日深夜,DeepSeek 官网的 API 文档里悄悄多了一个版本号:DeepSeek-V4-Pro-0813。没有发布会、没有高调官宣,新一代旗舰模型就这么上线了——但懂行的人都知道,这是一次值得关注的产品升级。消息传出后,从开发者社区到科技媒体,讨论热度一路走高,很多人的第一反应都是:DeepSeek 又偷偷憋了个大招。 深夜上线的旗舰模型 据 De…

橡木果发布全球首款具身本能模型 Natus AGE-0:不靠海量数据,机器人也能凭”本能”干活

具身智能赛道的玩家们正在集体”卷数据”,一家成立不到两年的初创公司却反着来。8月10日,橡木果机器人(Acorn Robot)正式发布「Natus AGE-0 具身本能模型」,号称不依赖任何数据预训练,就能让机器人实现零样本泛化与毫秒级自适应操作。 同一天,这家公司还披露完成天使轮融资,由招商局创投、蔚来资本共同领投。一边是行业主流拼命堆数据、堆算力,一边是这家清华哈佛背景…

打工人福音:国产顶级大模型白菜价,12 元跑百万字,缓存命中只要 1.5 元

打工人福音:国产顶级大模型白菜价,12 元跑百万字,缓存命中只要 1.5 元 大模型一直在涨价?不,这一次轮到国产厂商把价格打下来了。2026 年 8 月 3 日,阿里发布旗舰模型 Qwen3.8-Max,智能水平直逼 Claude,但价格只有国际顶流的零头——国内每百万 Tokens 输入仅 12 元。 价格到底有多狠? 输入:12 元/百万 Tokens,大约是 100 万字的量级 输出:36…

刚刚!阿里发布 Qwen3.8-Max:全球第一梯队,编程超越 Opus5,下周开放下载

刚刚!阿里发布 Qwen3.8-Max:全球第一梯队,编程超越 Opus5,下周开放下载 很多人以为国产大模型只能跟在 OpenAI 后面跑,但今天这个判断要改了。2026 年 8 月 3 日,阿里巴巴正式发布新一代旗舰大模型 Qwen3.8-Max——总参数量 2.4 万亿,编程能力一度超越 Claude Opus 5,权威榜单排名全球第一梯队,而且下周就开源。 Qwen3.8-Max 是什么?…

Kimi K3 正式开源:2.8 万亿参数登顶全球开源模型,中国 AI 开源生态迎来里程碑时刻

2026 年 7 月 27 日深夜,月之暗面(Moonshot AI)在 Hugging Face 上正式发布 Kimi K3 完整模型权重,以 2.8 万亿参数成为目前全球参数规模领先的开源 AI 模型。权重发布后受到开发者社区广泛关注,迅速登顶 Hugging Face 趋势榜。 这不仅仅是一次模型发布——同步公开的还有 47 页详细技术报告和三套关键基础设施工具(MoonEP、FlashKD…

AI Agent 到底是什么?2026 年最值得搞懂的 5 个核心概念

如果你最近打开技术社区,会发现一个词的出现频率高得吓人——AI Agent。 GitHub 上 Agent 相关的开源项目数量,2026 年比 2025 年增长了将近 10 倍;招聘平台上”AI Agent 工程师”的岗位数半年翻了三倍;OpenAI、Anthropic、Google、阿里、字节、腾讯,几乎所有大厂都在 2026 年把 Agent 列为核心战略方向。 但如果…

“豆包,收费了!”–月活3.45亿的国内第一AI应用,选了条和行业完全不同的路

“豆包飘了!””免费版要变智障了!””AI的免费午餐结束了!” 2026年6月24日,豆包专业版正式上线的消息一出,社交媒体直接炸了。月活3.45亿、国内AI原生APP用户量第一的豆包,终于对部分用户收费了。最高一档连续包年5088元,让不少习惯了免费的用户倒吸一口凉气。 但如果你仔细看豆包的收费策略,会发现一个反直觉的事实:…

港府InnoHK重磅成果:HKGAI V3大模型 + Agent智能体双发

2026年6月3日,香港生成式人工智能研发中心(HKGAI)举行”HKGAI V3大模型发布暨生态合作大会”,正式发布最新版本的本地大模型HKGAI V3,并同步推出香港首个生产力级超级智能体”Agent Workshop”。这场发布会被命名为”Agentic HK”——香港正式宣告迈入Agent时代。 最令人震撼的,是一组关…

Claude Opus 4.8″两个0%”硬指标:AI开始主动说”我不行”,Anthropic进入快迭代时代

2026年5月28日,Anthropic干了件让整个AI圈炸锅的事。 这家公司不仅正式发布了旗舰大模型Claude Opus 4.8,更同步完成H轮650亿美元融资,投后估值达到9650亿美元——一举超越OpenAI,成为全球估值最高的AI独角兽。 但真正让技术圈刷屏的,不是估值数字,而是这次升级的核心理念:“不装懂的AI,比跑分高的AI更重要”。 Anthropic官方反…

未来3年每家公司都将是智能体公司:刘江眼中的大模型革命

「18年我创立了智源,20年开始搞大模型。智源是实现中国大模型的摇篮,业界还是认可的,确实全中国最早开始的就是我们,也孵化了像智谱这样的公司。智谱今天的市值都8000多亿,远远超过了之前美团。」 这段话出自图灵智能研究院院长、北京智源人工智能研究院创始副院长刘江之口。2026年5月,在一场以「智变:人工智能重构增长新范式」为主题的数字经济大会上,刘江分享了他对大模型和AI发展的最新思考。 一个核心…

2026年AI普及率突破42.8%:一场史无前例的技术渗透

2026年,中国AI普及率正式突破「半数」门槛。 截至2025年12月,中国生成式AI用户规模达6.02亿,较2024年底增长141.7%,普及率同比大幅提升25.2个百分点至42.8%。到2026年,这一数字有望超过50%——这意味着,届时每两个中国人中,就有一个在使用生成式AI。 这不是一场渐进式的技术普及,而是一次决定性的范式转移。 一、数字背后:一场史无前例的渗透速度 42.8%的普及率是…

DeepSeek狂吞17万亿Tokens,国产AI算力迎来最关键一战

国产AI算力迎来最关键一战。 2026年5月,一组数据震动了整个AI行业。根据OpenRouter最新发布的模型月榜,DeepSeek旗下三款模型集体闯入前十:V4 Flash以9.13万亿tokens的月调用量稳居榜首,V4 Pro达3.89万亿排第九,V3.2为4.07万亿排第八——三者累计调用量突破17万亿tokens。 这不是孤例。排名前两位的Hermes Agent和OpenClaw,月…

免费无限用全球顶级大模型?这个AI评测平台可能是2026年最值得收藏的工具

当整个AI行业都在疯狂收费的时候,这个平台却说:免费无限用。没错,就是Arena AI——那个让GPT、Claude、Gemini同台竞技的AI模型盲测平台。 你可能用过ChatGPT、Claude、DeepSeek,但你有没有想过:这些模型到底哪个更强?官方各自都说自己第一,普通用户根本分不清真假。而Arena的做法很简单粗暴:让真人来打分,让结果说话。 这可能是2026年普通用户能接触到的、最…

GPT-5.6泄露:150万Token上下文+神级UI,6月AI大战一触即发

刚刚,OpenAI扔出一颗深水炸弹。 距离GPT-5.5发布仅仅三周,多名开发者在OpenAI Codex后端日志中,赫然发现了一个从未公布的神秘模型——GPT-5.6,内部代号”iris-alpha”。不是官方发布,是意外泄露。但这次泄露透露的信息量,比一次正式发布会还要多。 最炸裂的数字:上下文窗口150万tokens。作为对比,现行GPT-5.5 API是105万,提…

天工AI重磅发布SkyClaw-v1.0:百万上下文+价格屠夫,国产Agent模型杀入全球第一梯队

天工AI重磅发布SkyClaw-v1.0:百万上下文+价格屠夫,国产Agent模型杀入全球第一梯队 5月26日,昆仑万维旗下天工AI正式抛出深水炸弹——高性能Agent模型SkyClaw-v1.0横空出世,同步上线轻量化版本SkyClaw-v1.0-lite。这款模型以”顶级性能+极致性价比”双杀市场,支持百万Token上下文,价格却低至行业主流一半甚至更低,被业界视为国产…

中国AI全球排名大洗牌:Kimi K2.6登顶,DeepSeek紧追,GPT-5被挤到第三

2026年5月,一份重量级榜单的出炉,让整个AI圈炸了锅。 在第三方权威评测机构Arena公布的全球大模型盲测总榜上,出现了一个历史性场面:月之暗面的Kimi K2.6以94.3分登顶,DeepSeek V4以93.8分紧随其后,而OpenAI的GPT-5以93.5分排在了第三。(来源:量子位2026年5月20日第四届中国AIGC产业峰会发布数据) 前三名差距不到1分。 这意味着什么? 意味着中国…

刚刚,阿里重磅发布Qwen3.7!国产大模型王座再易主

5月20日,杭州西子湖畔。 2026阿里云峰会如期而至,但今年的画风明显不同。开场前30分钟,会场外已经排起长队,主会场座无虚席,过道、墙边、甚至后排摄像机位旁都站满了人——连投资人都全程站着看完了整场发布会。 这种久违的盛况,指向同一个焦点:阿里巴巴正式发布全新一代千问旗舰模型Qwen3.7-Max。 一出手就是王炸。 在全球权威评测机构Arena公布的最新一期盲测总榜中,Qwen3.7-Max…

2026全球AI终端展深圳开幕:从芯片到机器人,AI落地进入”真枪实弹”时代

5月14日,第七届深圳国际人工智能展览会在会展中心正式启幕,为期三天。 这不是一场”PPT展会”——参展商带来的是已经量产、已经商用的产品和技术。 规模有多大 展览面积超过5万平方米,参展企业超过800家,涵盖了AI产业链上中下游:从算力芯片到终端设备,从大模型到行业应用,从机器人到智能汽车。 主要展区包括: AI芯片区:英伟达、AMD、华为昇腾、寒武纪等主流AI芯片厂商悉…

GPT-5.5深度评测:史上最强AI发布,全面超越Claude 4.7与Gemini 3.1

4月24日深夜,OpenAI扔出了一颗”核弹”——GPT-5.5正式发布。这是OpenAI与英伟达联合打造的新型智能体模型,一出场就刷新了13项测试纪录,在Artificial Analysis综合智能指数上直接登顶,全面超越Claude Opus 4.5和Gemini 3.1 Pro。 这不是一次常规的版本迭代。GPT-5.5被官方定位为”面向实际工作与智能体…

DeepSeek-V4教程:3个真实场景带你玩转百万Token超长上下文

【AI智习室 4月25日】 4月24日,DeepSeek正式发布V4版本,最大的亮点只有一个:100万Token的超长上下文窗口。这个数字意味着什么?意味着你可以一次性把一整部《资本论》、一整套《中华人民共和国法律法规》、一份300页的财务报告全部丢给AI,让它帮你分析、总结、对比。 这不是科幻,这是今天就可以用上的能力。本文用3个真实场景,手把手教你用好DeepSeek-V4的超长上下文能力。 …