龙主编

龙主编,AI智习室官方媒体主编。 专注 AI 行业观察与实操分享,擅长将复杂技术转化为通俗易懂的实战指南。 坚信 AI 不是取代人类,而是赋能每个人。 内容风格: 真实案例 + 详细干货 + 可操作性 使命: 让普通人也能抓住 AI 时代的红利。

963

30 秒直出、文档变视频:阿里 Wan3.0 公测亮点盘点

做短视频、短剧、知识类视频的朋友,你们生成视频的成本,昨天又被阿里压下来了一截——全新一代视频生成模型 Wan3.0 正式开启公测,单次直出 30 秒视频,还能把 Word、PPT、PDF 文档一键变成视频。按目前的公开报价,720P 一秒只要 6 毛钱。 8 月 6 日晚,阿里云宣布 Wan3.0 开启公测。作为阿里”通义万相”产品线的最新一代视频模型,它这次升级的方向非…

3 秒克隆音色、30 语种、可商用:VoxCPM 配音副业指南

不会配音、没有录音棚、预算几乎为零——这三条放在以前,基本和”接配音单”无缘。但这两天刷屏的一个国产开源项目,正在把配音副业的门槛直接拆掉:3 秒音频就能克隆一种音色,一句话就能凭空设计一种新声音,30 种语言随意切换,而且完全开源、免费、可商用。 8 月 7 日,面壁智能官方公众号发布了一篇实战案例:有独立开发者用开源的 VoxCPM 模型克隆网红的声音,做出能让 AI&…

免费无限聊、还能深度思考:ChatGPT 免费版三大升级

做自媒体、接文案单、搞图文副业的朋友,请先看这条消息——ChatGPT 免费版的”天花板”刚刚被 OpenAI 自己抬高了:免费用户不仅能用上最新的 GPT-5.6 Luna,文本聊天还即将无限量。你每个月花在 AI 写作工具上的钱,可能真的要归零了。 8 月 6 日,OpenAI 官方宣布 ChatGPT 迎来一波大更新。对免费用户来说,这次升级可以总结成三件事:第一,G…

AI 插件大一统:一次打包,主流 AI 工具通用

做 AI 工具、写 AI 技能的朋友,请先停一下——你们最头疼的那个问题,昨天有六家巨头联手给出了答案:以后做出来的 AI 技能和插件,终于不用再为每家工具单独打包了。 8 月 6 日,谷歌正式宣布以核心维护者身份加入 Agent Plugins 技术指导委员会,让这份名为 Agent Plugins 1.0.0 的开放规范进入全面公开阶段。别看这事听起来偏技术,它解决的是一个所有 AI 用户都迟…

AI 带货要「自首」了?视频号强制标注 AI 内容,数字人还能播吗

视频号对 AI 带货出手了。8 月 3 日,微信视频号发布《短视频带货场景AI应用规范》,自 2026 年 8 月 10 日起正式生效:含 AI 生成内容的带货短视频,必须主动添加 AI 标注,否则平台将对违规视频限制分发;标注了但 AI 内容与实际商品不一致,同样限制分发。对做 AI 带货、数字人直播的副业党来说,这是一次直接影响收入方式的规则级变化。 四类内容必须标注 平台明确,发表含 AI …

OpenAI 开源 Codex Security:AI 写的代码,AI 帮你查漏洞

用 AI 写代码越来越爽,但漏洞问题被大多数人忽略了。上周,OpenAI 开源了一个叫 Codex Security 的插件——它能自动扫描代码漏洞、追踪攻击路径并生成修复补丁。简单说:AI 写的代码,终于有 AI 帮忙体检了。 Codex Security 是什么 Codex Security 是 OpenAI 开发的命令行安全扫描工具,走的是「模型推理 + 工具调用 + 漏洞验证」的路线:AI…

英伟达开源最强驾驶模型:Robotaxi 开车终于能「讲道理」

自动驾驶行业迎来一个能「讲道理」的开源模型。8 月 4 日,英伟达正式发布 Alpamayo 2 Super:一个 32B 参数的开源推理型视觉-语言-动作(VLA)模型,面向 Robotaxi 与 L4 自动驾驶,采用 OpenMDW-1.1 许可开放商用——商用、微调、再分发均允许。它的核心卖点不是「会开车」,而是「会解释」:每一次驾驶决策都能说出因果逻辑。 一个会「解释自己」的驾驶模型 传统…

刚刚,我国首部 L3 自动驾驶强标发布:华为引望完成首批验证

我国自动驾驶迎来首部强制性国家标准。8 月 5 日华为官方发文确认:由工业和信息化部提出并组织制定的 GB 44721-2026《智能网联汽车 自动驾驶系统安全要求》已正式发布,这是我国首部针对 L3 和 L4 自动驾驶系统的强制性国家标准,将于 2027 年 7 月 1 日起正式实施。华为系智能驾驶方案供应商「引望」是该标准的核心起草单位,并成为国内首批完成 L3 自动驾驶车型准入试点验证的解决…

谷歌官宣:9月4日起安卓语音助手退役,Gemini 全面接班

服役十年的安卓语音助手 Google Assistant,正式进入退役倒计时。8 月 4 日至 5 日,谷歌通过电子邮件向部分安卓用户发出通知:从 9 月 4 日起,将逐步移除 Android 手机和平板电脑上的 Google Assistant 访问权限,迁移过程将在数周内分批完成。一旦完成切换,用户将无法再使用或切回 Google Assistant——Gemini 将成为安卓设备上唯一的 A…

隐私党狂喜?80B 大模型在 Mac 上只占 4.3GB 内存,手机也能跑 35B

把一个大模型装进手机里、不联网也能聊天,是很多隐私敏感用户一直以来的愿望。8 月 4 日登上 Hacker News 热榜的开源项目 Swiftlet,把这件事往前推了一大步:它用一套 Swift + Metal 运行时,让 80B 参数的大模型在 Mac 上运行时峰值内存只有 4.3GB,35B 版本甚至能在 iPhone 上原生运行——据开发者称,这是该量级模型首次在手机上原生跑通,全程不碰服…

刚刚,Soup 开源:8B 模型微调挤进 4GB 显存,AI 私有化训练终于平民化

想训练一个属于自己的 AI 模型,过去绕不开三样东西:一台几千上万的显卡,或者按小时计费、贵得肉疼的云 GPU,外加一堆繁琐的环境配置。而现在,一个 8 月 4 日登上 Hacker News 热榜的开源项目 Soup,把”微调 8B 大模型”这件事,压缩到了 4GB 显存笔记本就能完成的程度——根据作者实测,一块 RTX 3050 笔记本显卡(4GB 显存、Windows…

商汤刚开源 U1.5:手绘草图一键变商业海报,设计小白也能做出高级感

先看一个真实案例:一张只有简单线条、栏目框架和流程箭头的手绘草图,交给 AI 之后,直接变成了一张符合商业出版标准的”深海潜水装备流程”高精海报——模型不仅认出了草图里的氧气瓶、面镜、潜水电脑表,还保留了”装备总览、功能详解、下潜前检查、安全下潜流程、下潜后检查”五个板块结构,并自动为每个栏目补充了图片、图标和说明文字。完成这件事的,是商汤 8 月 …

视频生成又变天:FLUX 3 一个模型搞定画面+声音+对话,20 秒原生音频怎么用

做短视频的人大概都有过这种崩溃时刻:画面用 A 工具生成好了,还要去 B 工具配音,再去 C 工具找配乐,最后在对口型、对齐音效上花的时间比做画面还长。而现在,一个叫 FLUX 3 Video 的模型正在改变这套流程——它把”画面、声音、对话”一次性生成,一条 20 秒的视频连原生音效都自带。8 月 4 日,这款模型正式上线 OpenRouter 向所有人开放,做视频的流程…