AI 快讯AI 产品的竞争重心,正从单次生成质量转向完整工作流与可控交付。查看详情 ›

最新 AI 资讯

事实标注来源,观点标明作者,信息更新保留修订说明

更新于 2026.08.27
Google 想让 AI 视频「听话」:Gemini Omni 1.1 Flash 上线,40 秒场景扩展、首尾帧控制、4K 放大,还便宜到 0.03 美元/秒封面

Google 想让 AI 视频「听话」:Gemini Omni 1.1 Flash 上线,40 秒场景扩展、首尾帧控制、4K 放大,还便宜到 0.03 美元/秒

8 月 27 日,谷歌面向开发者发布 Gemini Omni 1.1 Flash——一个专注于「可控制」的视频生成模型。它把此前 AI 视频最棘手的问题——如何让片段连起来、如何保持角色和场景一致——往前推了一大步:以 10 秒为增量续生成、累计最长 40 秒;可指定首尾帧控制镜头运动与转场;360p 预览成本只有 720p 的三分之一;成片支持 1080p/4K。背后是 Google Flow 和 Gemini API 的全面整合。

词词元编辑部创作与多媒体8 分钟
Viggle 正在让「人人都是动画师」变成现实:一张静态图,一段会动的 3D 角色,5000 万创作者已经在用封面

Viggle 正在让「人人都是动画师」变成现实:一张静态图,一段会动的 3D 角色,5000 万创作者已经在用

你或许没听过 Viggle,但你一定刷到过它的作品——Lil Yachty 在舞台上被换成小丑、Joker 在音乐节蹦迪、各种名场面被替换成朋友。这家加拿大 AI 初创用「角色替换 + 动作迁移」把静态图片变成 3D 动画,2024 年 8 月拿下 a16z 领投的 1900 万美元,2026 年 2 月发布 V4 模型,如今 API 全面开放,5000 万创作者正在用它做 Meme、做游戏、做动画。

词词元编辑部创作与多媒体6 分钟
「生成速度比播放还快」!MiniMax H3 Max 上线:5 秒 768p 视频不到 3 秒出片,还被接进 Twitch 做 AI 无限直播封面

「生成速度比播放还快」!MiniMax H3 Max 上线:5 秒 768p 视频不到 3 秒出片,还被接进 Twitch 做 AI 无限直播

8 月 31 日,MiniMax 宣布 H3 Max(768P / 480P)正式接入 MiniMax 开放平台与 MiniMax Design。它最大的不同,是做到了「生成速度快过播放速度」:一段 5 秒、768p 的完整音视频,生成时间不到 3 秒,吞吐量约为 MiniMax H3 官方端点的 35 倍。当上一段还在播,系统已经在后台准备下一段 —— 视频模型第一次从「等它出片」变成可以持续供给实时内容。

词苏墨模型与产品7 分钟
阿里这步走得不声不响:Wan 3.0 视频模型把「喂 PDF 一键成片」做成了现实,单次 30 秒、价格只有谷歌 Veo 3.1 一半封面

阿里这步走得不声不响:Wan 3.0 视频模型把「喂 PDF 一键成片」做成了现实,单次 30 秒、价格只有谷歌 Veo 3.1 一半

当同行还在卷「一条提示词能生成多长的视频」时,阿里通义万相换了个打法:Wan 3.0 能喂进去的不只是文字和图片——PDF、PPT、电子表格、音频、视频,全都能一键变成一条视频。单次生成 30 秒(是前代 Wan 2.7 的两倍),最高 1080p,输出还能保证角色、物体、背景、空间布局的一致性,甚至带面部微表情同步和多语言语音。价格却只有谷歌 Veo 3.1 的一半。

词周野创作与多媒体7 分钟
「龙虾」史上最大更新:OpenClaw 2.0 发布,933 名贡献者、1.6 万 PR,7 周磨一剑——安装更简单、浏览器重写、还多了多人协同封面

「龙虾」史上最大更新:OpenClaw 2.0 发布,933 名贡献者、1.6 万 PR,7 周磨一剑——安装更简单、浏览器重写、还多了多人协同

沉寂近两个月后,8 月 30 日开源个人 AI 智能体 OpenClaw 正式发布 v2026.8.1,团队直接称之为「OpenClaw 2.0」。按官方数据,这是项目诞生以来规模最大的一次更新:933 名贡献者(其中 569 人是第一次提交代码)合并了超过 1.6 万个 PR,约占 OpenClaw 迄今全部合并量的一半。更新覆盖安装、消息、记忆、技能、模型、自动化、浏览器、原生应用、插件与安全。

词词元编辑部技术与开源5 分钟
腾讯憋了个大的!混元 Hy4 preview 开源:770B 总参、1M 上下文、DeepSWE 64.3 吊打对手,还给了个 214GB 轻量版封面

腾讯憋了个大的!混元 Hy4 preview 开源:770B 总参、1M 上下文、DeepSWE 64.3 吊打对手,还给了个 214GB 轻量版

8 月 28 日,腾讯发布并开源最新一代旗舰模型混元 Hy4 preview(770B-A49B)。总参数量从上一代 Hy3 的 295B 直接跳到 770B,激活参数从 21B 增至 49B,上下文也从 256K 扩展至 1M;在 DeepSWE 上拿到 64.3,超过阿里 Qwen-3.8 Max(56.6)和 DeepSeek-V4 Pro(62.7)。它已同步进入 WorkBuddy、CodeBuddy、元宝,上线即排队超 5000;更狠的是,9 月 1 日又推出把权重从 1.5TB 压到 214GB 的轻量版,还能跨异构设备联合推理。

词林屿模型与产品6 分钟
MiniMax × GMI Cloud 联手搞事:14 天免费把 M3、M2.7、语音 2.8、音乐 3.0 全解锁,还砸 1500 美元办「AI 饕餮挑战赛」封面

MiniMax × GMI Cloud 联手搞事:14 天免费把 M3、M2.7、语音 2.8、音乐 3.0 全解锁,还砸 1500 美元办「AI 饕餮挑战赛」

AI 算力云 GMI Cloud 与 MiniMax 联合推出「MiniMax Week」限时活动:生成式视频与前沿推理模型集体开闸,M3、M2.7、Speech 2.8、Music 3.0 免费 14 天,H3 按标准价计费;并通过 OpenRouter / GMI API 原生接入 Hermes Agent、Trae、OpenCode、Pi 等工具。同期举办 14 天 MiniMaxathon 挑战赛,三条赛道、三名获胜者、1500 美元额度奖励。

词词元编辑部模型与产品6 分钟
阿里把「下一代的模型」提前开源了:Qwen3.8-Flash 炸场,125B 参数只激活 6B、超 Claude Opus 4.6、训练成本降近 90%封面

阿里把「下一代的模型」提前开源了:Qwen3.8-Flash 炸场,125B 参数只激活 6B、超 Claude Opus 4.6、训练成本降近 90%

8 月 26 日晚,阿里通义千问正式发布并开源 Qwen3.8-Flash——名字还挂着 3.X,内里已是下一代 Qwen4 架构的「技术预览版」。这是一款多模态 MoE 模型:主模型 125B 参数(约 1250 亿)、另配 51B N-gram Embedding,每个 token 却只激活约 6B 参数,就能拿到超越 Claude Opus 4.6 的前沿性能。原生支持 26 万 token 上下文、可扩展到 100 万,训练成本较上一代骤降近 90%,API 输入仅 1 元/百万 token。

词词元编辑部模型与产品7 分钟
悬案揭晓:神秘「牛来模型」就是 GLM-5.3-Flash!智谱开源 320B 原生多模态,10 万张国产卡撑场,价格还砍了 97.5%封面

悬案揭晓:神秘「牛来模型」就是 GLM-5.3-Flash!智谱开源 320B 原生多模态,10 万张国产卡撑场,价格还砍了 97.5%

此前以 Ox Alpha 之名匿名爆红、中文社区亲切叫它「牛来」的神秘模型,终于被揭晓真身——智谱(Z.ai)8 月 26 日正式上线并开源 GLM-5.3-Flash(320B-A18B),这是 GLM-5 系列的首个原生多模态模型:3200 亿总参数、180 亿激活,支持图片、视频、文件、文本输入,1M 上下文,在 Artificial Analysis 综合智能指数拿 57 分进入全球前沿区间,限时 5 折后输入仅 0.4 元/百万 token。而它背后,是 10 万张国产芯片撑起的算力底座。

词顾言模型与产品6 分钟
字节「豆包工作」重磅上线:把整份工作交给 AI,拆解任务、调用工具、直出报告,还与飞书深度绑定——AI 办公「三国杀」开打封面

字节「豆包工作」重磅上线:把整份工作交给 AI,拆解任务、调用工具、直出报告,还与飞书深度绑定——AI 办公「三国杀」开打

8 月 25 日,字节跳动正式发布面向生产力场景的 Agent 产品与品牌「豆包工作」——这是 7 月底豆包与飞书团队整合后交出的第一个产品,也是 TRAE、扣子并入豆包体系后的统一办公入口。它能围绕目标自主拆解步骤、调用工具、生成并迭代成果,原生长在飞书上,让企业知识直接参与工作。

词词元编辑部模型与产品6 分钟
神秘 AI「Ox Alpha」3 天屠榜:0 元、1M 上下文、能看图看视频,却死活不肯报出开发团队——硅谷掀起的猜谜大战封面

神秘 AI「Ox Alpha」3 天屠榜:0 元、1M 上下文、能看图看视频,却死活不肯报出开发团队——硅谷掀起的猜谜大战

8 月 20 日,一个连正式名称和开发方都藏着掖着的模型「Ox Alpha」悄悄上架 OpenRouter。结果几天内它就冲到消费 token 数第一;在 OpenCode、Cline 里更是登顶、创下史上最快增长。1M 上下文、128K 输出、支持图文视频输入、完全免费——却有分析发现它的分词行为与 Z.ai 的 GLM-5 系惊人一致,一场「这到底是谁家的模型」的猜谜大战,在硅谷和全网炸开。

词词元编辑部模型与产品6 分钟
开源 AI 画图工具 ComfyUI 估值 5 亿美元:4 百万用户、130K Star、连亚马逊苹果都在用,却被一家小工作室做成了一门大生意封面

开源 AI 画图工具 ComfyUI 估值 5 亿美元:4 百万用户、130K Star、连亚马逊苹果都在用,却被一家小工作室做成了一门大生意

一个 2023 年诞生的「节点式扩散模型工具」,2026 年完成 3000 万美元融资,估值 5 亿美元,由 Craft Ventures 领投,Pace Capital、Chemistry、TruArrow 跟投。它的客户名单上写着 Amazon、Apple、Autodesk、Harman、HP、Lucid、Netflix、Nike、Pixomondo、Tencent、Ubisoft。它做的事说起来一句话——「把 ChatGPT 类提示词工具那最后 20% 的不听话,交给人自己来」

词词元编辑部技术与开源8 分钟
「一镜到底」成真!字节跳动 Seedance 2.5 重磅发布:单次生成 30 秒长片,还能一键编辑、白模控镜、精准参考封面

「一镜到底」成真!字节跳动 Seedance 2.5 重磅发布:单次生成 30 秒长片,还能一键编辑、白模控镜、精准参考

字节跳动 Seed 团队正式推出新一代音视频生成模型 Seedance 2.5:单段视频从 15 秒直接拉到 30 秒并支持多轮延长,一次可参考 30 张图 / 10 段视频 / 10 段音频,把「生成一个片段」升级为「完成一部作品」,即梦、豆包已上线,API 即将开放。

词词元编辑部模型与产品8 分钟
马斯克 600 亿美元收购 Cursor 后亮出首张王牌:Grok Bot「数字同事」正式上线——一个 Bot 就是一台云端电脑,$300/月起封面

马斯克 600 亿美元收购 Cursor 后亮出首张王牌:Grok Bot「数字同事」正式上线——一个 Bot 就是一台云端电脑,$300/月起

SpaceXAI 与 Cursor 联手 8 月 11–15 日发布 AI 代理产品 Grok Bot,定位「持久在线的数字同事」:每个 Bot 都拥有自己的云端 Linux 虚拟机、浏览器、文件管理器、终端,能像真人一样登录 SaaS、点按钮、填表格、返回成稿交付物;售价从 300 美元/月起,登陆 macOS、Windows、Linux、iOS、Android。同期发布的还有 Grok 4.6 大模型,500K 上下文,GDPVal-AA v2 / AA-Briefcase / Harvey LAB 三大真实工作榜均登顶。

词词元编辑部模型与产品7 分钟