AI 学习

AI 零基础入门到精通

共 248 篇

隐私党狂喜?80B 大模型在 Mac 上只占 4.3GB 内存,手机也能跑 35B

把一个大模型装进手机里、不联网也能聊天,是很多隐私敏感用户一直以来的愿望。8 月 4 日登上 Hacker News 热榜的开源项目 Swiftlet,把这件事往前推了一大步:它用一套 Swift + Metal 运行时,让 80B 参数的大模型在 Mac 上运行时峰值内存只有 4.3GB,35B 版本甚至能在 iPhone 上原生运行——据开发者称,这是该量级模型首次在手机上原生跑通,全程不碰服…

刚刚,Soup 开源:8B 模型微调挤进 4GB 显存,AI 私有化训练终于平民化

想训练一个属于自己的 AI 模型,过去绕不开三样东西:一台几千上万的显卡,或者按小时计费、贵得肉疼的云 GPU,外加一堆繁琐的环境配置。而现在,一个 8 月 4 日登上 Hacker News 热榜的开源项目 Soup,把”微调 8B 大模型”这件事,压缩到了 4GB 显存笔记本就能完成的程度——根据作者实测,一块 RTX 3050 笔记本显卡(4GB 显存、Windows…

商汤刚开源 U1.5:手绘草图一键变商业海报,设计小白也能做出高级感

先看一个真实案例:一张只有简单线条、栏目框架和流程箭头的手绘草图,交给 AI 之后,直接变成了一张符合商业出版标准的”深海潜水装备流程”高精海报——模型不仅认出了草图里的氧气瓶、面镜、潜水电脑表,还保留了”装备总览、功能详解、下潜前检查、安全下潜流程、下潜后检查”五个板块结构,并自动为每个栏目补充了图片、图标和说明文字。完成这件事的,是商汤 8 月 …

零基础教程:阿里最强模型 Qwen3.8 怎么白嫖怎么用

零基础教程:阿里最强模型 Qwen3.8 怎么白嫖怎么用 阿里最强模型 Qwen3.8-Max 今天发布了,很多人看完新闻就划走了——但真正的问题只有一个:我该怎么用上它?这篇教程不聊技术术语,用大白话告诉你普通人怎么上手。 第一步:Qwen3.8 现在能用吗? 能。根据阿里官方信息,Qwen3.8-Max 的 API 今天已在千问 AI 平台上线。普通用户可以直接通过千问 AI 平台使用,开发者…

多 Agent 编排深度:Orchestrator / 对等 / 混合三种模式的实战对比

前面一篇讲多 Agent 实战用的是「5 个 Agent 模拟一个团队」这种偏概念的方式。今天这篇文章往深处推——讲企业级多 Agent 系统必然会遇到的「编排」问题。 当你有 5 个、10 个、20 个 Agent 在一个系统里同时跑,关键问题不再是「单个 Agent 怎么做」,而是「这些 Agent 之间怎么配合、谁调度谁、信息怎么传、出了错怎么办」。这就是「多 Agent 编排」(Multi…

大模型微调实战:LoRA / QLoRA / DPO 全流程

RAG 和 MCP 已经这么强了,为什么还要学微调? 这是 2026 年 AI 工程师最常问的问题之一。答案是:RAG 和 MCP 解决的是”知道什么”,微调解决的是”怎么说、怎么思考”。这两个维度是互补的,不是替代关系。 RAG 让模型能查到你公司的私有文档,但它不能让模型”用你公司的语气说话””遵守你公司的内部…

RAG 进阶:从 Naive RAG 到 Agentic RAG 的 16 种方案对比

如果你的项目已经在用 RAG,大概率会有这种体验:最基础的”向量检索 + LLM 生成”能跑,但准确率不够高——用户问个稍微复杂的问题,系统要么检索不到相关内容,要么检索到了但 LLM 没正确理解。怎么办?改 embedding?改 prompt?改 chunk size? 这些”打补丁”的做法只能缓解表面问题。要真正提升 RAG 的能力,你需要从架…

Harness Engineering 深度:从 OpenAI 100 万行实践看 Agent 工业化

前面两篇文章我们分别从资讯(腾讯应用宝 + 北大定调)和零基础入门(AI Agent 核心概念、LangGraph 实战)的角度讲了 Harness 的概念。今天我们把这个话题推到最深处——从 OpenAI 的工业级实践出发,讲清楚 Harness 到底是什么、为什么关键、怎么在你的 Agent 项目里落地。 Harness Engineering 是 OpenAI 在 2026 年 2 月正式提…

多 Agent 实战:基于 CrewAI / AutoGen 搭协作团队

如果你做过几个 Agent,大概率会有这种体验:一个 Agent 能搞定”查天气””查数据库””算个数”这种单一任务,但当任务稍微复杂——比如”写一篇包含数据调研、用户访谈、竞品分析的完整报告”——单 Agent 就开始跑偏、漏步骤、生成质量下降。 原因很简单:一个 Agent 的能力边界是有限的。它一…

Vibe Coding 实战:用 Cursor + Claude Code 两天搭一个 SaaS

上篇文章我们讲了 Vibe Coding 是什么、为什么它能降低编程门槛。今天我们讲实战——用 Cursor + Claude Code 两天搭一个可上线运行的 SaaS 产品。 为什么是 SaaS?因为 SaaS 是 Vibe Coding 最合适的载体: 边界清晰(用户、订阅、付费、续费这些都有成熟的模式) 技术栈成熟(前后端 + 支付 + 部署) 用 Vibe Coding 做出来后,马上能…

RAG 实战:从零搭建企业私有知识库

如果你是产品经理、运营、技术支持,大概率有过这种痛点:公司内部文档散落在 Confluence、飞书、Notion、Google Drive、邮件附件里,新人问个问题,要么翻半天找不到答案,要么找到的答案是过时版本。如果能让 AI 直接基于公司内部知识回答问题,效率会大幅提升。 RAG(Retrieval-Augmented Generation,检索增强生成),正是解决这个问题的核心技术。202…

手把手搭建第一个 AI Agent:基于 LangGraph 实战

学完 AI Agent 基础概念,接下来最重要的一步,就是自己动手做一个 Agent。这篇文章就是带你”从零到一”——跟着走,30 分钟后你会有一个真正能干活的 Agent,会查数据库、能查天气、能记住对话、能自主决定下一步该做什么。 我们用 LangGraph。这个框架在 2026 年已经是 Agent 开发的首选——它比 LangChain Agent 更灵活,比 Au…

从零开始学 Prompt:写好提示词的 5 个基本原则

如果你已经用过 ChatGPT、文心一言、豆包、Kimi 这些 AI 聊天工具,大概率有过这种体验:有时候 AI 回答得特别好,有时候答非所问、答得很水。你以为是”AI 不够聪明”,但换个问法,同一个 AI 就能给出惊艳的回答。 这里的关键差异,就是 Prompt。 Prompt 是你给 AI 的指令。它的质量直接决定 AI 输出的质量——给你一个”垃圾 pro…

Cursor 入门:用自然语言写代码,新手 30 分钟出第一个网页

如果你 2026 年想开始学 AI 编程,Cursor 是一个绕不开的工具。 它不是一款”普通编辑器”——Cursor 是基于 VS Code 内核深度改造的 AI 原生 IDE,内置了 GPT-4、Claude 4.5、Gemini 2.5 等顶级模型的能力,可以通过自然语言指令直接生成、修改、调试代码。最关键的是,它对新手极其友好——你不需要懂任何编程语法,只要会说&#…

AI Agent 到底是什么?2026 年最值得搞懂的 5 个核心概念

如果你最近打开技术社区,会发现一个词的出现频率高得吓人——AI Agent。 GitHub 上 Agent 相关的开源项目数量,2026 年比 2025 年增长了将近 10 倍;招聘平台上”AI Agent 工程师”的岗位数半年翻了三倍;OpenAI、Anthropic、Google、阿里、字节、腾讯,几乎所有大厂都在 2026 年把 Agent 列为核心战略方向。 但如果…