OpenMontage:开源的 AI 视频自动生产系统,60 秒动画成本 1.33 美元
OpenMontage 是开源的智能体式 AI 视频自动生产系统,端到端流水线自动化生成完整视频,60 秒动画成本仅 1.33 美元,且支持无付费 API 密钥免费跑通。
编程、视频、办公与企业级应用
OpenMontage 是开源的智能体式 AI 视频自动生产系统,端到端流水线自动化生成完整视频,60 秒动画成本仅 1.33 美元,且支持无付费 API 密钥免费跑通。
谷歌发布 AlphaGenome Atlas:用 AI 对参考基因组约 30 亿个位置逐一替换碱基,累计完成约 90 亿次单碱基变化影响评估 结果整理成研究者可直接查询的公开资源,相关论文同期发表于《自然》(Nature)杂志
字节跳动发布豆包手机助手消费者版,首次向普通用户开放操作手机功能,并推出屏幕自动化操作声明协议(SAEP),让第三方 App 自主声明允许或拒绝 AI 自动操作。
阿里正式发布视频生成大模型 Wan3.0,可据文档、表格、PPT 生成最长 30 秒视频 开源模型家族 Qwen 过去半年全球下载量超 30 亿次,超过谷歌与 Meta 的开源模型生态
现代汽车集团将自研驾驶辅助系统 Atria AI 的量产时间推迟至 2029 年下半年,2028 年起先用英伟达方案推出过渡车型。 集团采取并行开发策略:用英伟达平台快速商业化并积累真实道路数据,同时训练自研模型,目标 2033 年前后累计驾驶数据超过竞争对手。
Roblox 在年度开发者大会(RDC)推出生成式 AI 游戏创建功能 Build,用户用自然语言描述即可生成可玩游戏 游戏将支持打包为独立应用跨平台发布、年底前可在浏览器直接游玩,并推出电子钱包与银行卡补齐创作者变现工具
美图把 AI 视频生成能力编排成工作流,盯住口播、营销、音乐视频等垂直场景,开拍 MAU 同比增长超 100%、付费订阅用户增长超 150% MVLAND 上线三个月 ARR 翻倍,月均 ARPPU 约 220 元,是美图历史所有产品平均水平的 13 倍,视频比修图更赚钱的生意已经跑通
蚂蚁国际发布自研时序预测大模型「鹰序 TST」2.0,在 GIFT-Eval 基准拿下当前最优成绩,MASE 降至 0.666,预测准确率稳定超过 93% 巴克莱、花旗、德意志、渣打四家国际银行已接入其现金流预测与外汇管理场景,试点客户对冲成本节省约 30%
开源求职自动化框架 ai-job-search:69 份申请、20 场首轮面试、1 份合同 基于 Claude Code 的 14 条命令求职流水线,双代理起草审查,简历可过 ATS 机器初筛
微信聊天图片新增「AI 处理」按钮,支持美化、修改、提取信息三类操作,目前处于灰度测试阶段 小微 AI 已覆盖公众号、朋友圈、扫一扫、聊天等高频场景,图片处理是这条路上最新的一个节点
Slack 推出 Slackforce Surfaces:用大白话向 Slackbot 描述需求,即可在聊天窗口直接生成报表、仪表盘等交互工具 功能对全部客户开放,免费版可用,2026 年 10 月起支持接入实时数据
高德发布全球首个「3D 原生」城市世界模型 ABot-Earth 0.7:一张卫星图或一句文字描述,10 分钟即可在消费级 GPU 上生成公里级立体城市。 效率较传统方式提升 1000 倍,覆盖 196 个以上国家和地区,已接入飞行街景 2.0,梅赛德斯-奔驰成为首个汽车合作伙伴。
GPT-6 单独生成精细 3D 模型能力有限,实测成品细节粗糙 将 Hyper3D Rodin 通过 MCP 接入 Codex 后,普通人也能复刻 3200 万浏览的解剖网页 3D 正在成为 AI 可以随取随用的能力,项目起点从「会不会建模」变为「有没有想法」
开源命令行工具 RTK 宣称能大幅节省 AI 编程的 token 成本,GitHub 超 7.9 万星标 独立团队 Quesma 实测 1740 次后得出结论:真实账单几乎没降——Claude Code 只降 5%,DeepSeek 反而涨 5%
Google Labs 推出的 AI 应用 Dreambeans 于 9 月 10 日起向美国全量开放,每天用 AI 把日历、邮件、相册、搜索与 YouTube 等授权应用里的信息编织成个人故事合集,支持 Android 与 iOS。
Meta 新 AI 应用 Muse 上线一周便冲上美国 App Store 下载榜第二,iOS 端下载量超 8.3 万次 消费级 AI 代理赛道竞争升温,Muse 面临 Instinct 等对手,隐私信任短板成潜在包袱
智谱联合杭州市与上城区推出「智谱 · 杭州全城 Coding 计划」:个人季卡减免 44%、年卡减免 51%,上城区企业年卡减免 55%(单家上限 100 万元),活动持续至 12 月 9 日 这是全国首个由城区政府与 AI 厂商联合推出的 AI 模型调用普惠行动
西门子在中国开卖自研 Eigen 工程智能体,并用 Xcelerator 平台把工业 AI 的开发与分发能力开放给生态伙伴 核心路径:自研产品打样、开发套件开放、Marketplace 分发,从一次成功走向规模化复制
AI 助手 Instinct 为每位用户分配一个独立邮箱地址,可替用户注册账户、联系商家、处理退货,迈向「智能体拥有自己的数字身份」。
蚂蚁集团百灵团队发布并开源金融增强开放模型 Ling-3.0-flash-Fin,目标打通「找资料、做分析、算估值、写研报」的完整投资研究工作链 同步开源的金融 AI 评测基准 FinFIRST 覆盖多市场、多信源场景,让金融 AI 的能力判断有了一把可对照的尺子
CrowdStrike 联合英伟达发布智能体式网络安全系统 SafeMind,基于开源模型 Nemotron 构建攻防共演防御体系,成本较闭源前沿模型显著降低。
DeepMind 发布 AlphaGenome Atlas 公开数据库,用 AI 预计算人类基因组全部约 90 亿种单核苷酸变异对细胞分子机制的影响,数据总量达 1 PB 配套 AVI 评分把编码区与非编码区的变异影响统一成单一分数,帮助研究者优先排查高影响变异;已向全球科研人员免费开放
字节跳动正基于视频生成模型 Seedance 开发实时空间视频生成模型(世界模型),创始人张一鸣亲自下场协调算力与跨部门资源,最快 10 月亮相,计划与 VR 头显 Pico 打通,将「刷视频」变成「走进视频」。
阿里云千问办公推出多人工作台:用自然语言即可生成支持百人同时在线协作的网页应用,覆盖家校协作、达人投放、连锁店铺等场景
2026 年 8 月 29 日,阿里旗下 AI 编程产品 Qoder 发布全新桌面端,把过去一年积累的 Agentic Coding 能力从 IDE 里搬了出来:用户以桌面宠物形态的对话界面提出需求,不写一行代码,也能做出可运行、可操作的软
高通披露新一代 Adreno GPU:3 个矩阵核心专攻端侧 AI,神经融合减少画面瑕疵、功耗最多降低 40% 第六代骁龙 8 至尊版系列 CPU 首次跨过 5GHz,端侧 AI 算力与游戏画面质量是两大升级方向
高通披露新一代 Adreno GPU:3 个矩阵核心专攻端侧 AI,神经融合减少画面瑕疵、功耗最多降低 40% 第六代骁龙 8 至尊版系列 CPU 首次跨过 5GHz,端侧 AI 算力与游戏画面质量是两大升级方向
OpenClaw 2.0 发布:开源智能体平台转向多人协作编程,新增共享云会话与多用户协作,重做 Control UI,并在沙箱、权限、审批、密钥、审计五个方向补齐企业级安全控制。 整个版本由 933 名贡献者完成,合并超 16,000 个 PR;但沙箱与执行审批默认关闭,加固需企业主动配置。
努比亚 AI 智能体手机「豆包手机」定档 9 月开售,NaviX Ultra 已获入网许可 豆包手机助手弃用读屏模拟点击,改走应用开放 MCP 接口的路线,落地取决于头部应用开放程度
谷歌发布 AI 图像创建与编辑工具 Google Pics,由 Nano Banana 模型驱动,首批集成于 Docs 与 Slides,面向 Workspace 客户与 AI 订阅用户开放。
Glassdoor 数据:提及 AI 的美国保险理赔员中 98% 持批评态度,行业就业一年下降 21% 自动化比例持续走高(Lemonade 机器人处理 96% 首次理赔报告),但责任倒挂令一线员工承担 AI 错误的成本
来伊份将200多个智能体投入门店巡检、智能补货、流程审批等核心环节,基于火山引擎HiAgent平台与豆包大模型搭建 AI巡检覆盖近3000家门店,飞单识别准确率达95%,单据审批耗时降低70%;采用"1+N+X"矩阵与5级治理机制推动AI落地
金山办公启动 WPS Comate 百城赋能计划,彩讯五大能源智能体进入电网生产环境,慧择 AI 客服自主服务率超 50%,阿里发布图形界面智能体基座 Qwen-UI-Agent 智能体正在结束演示阶段进入真实生产系统,但失控风险与盈利压力同步升温
五征集团将企业级智能体部署到客服端、焊接车间、食堂库房和拖拉机驾驶室,月底盘库从过去的 3 小时缩短到约 5 分钟 从制造业到金融、零售与互联网,企业级智能体正从「能不能对话」走向「能不能干活」,加速嵌入真实业务流程
字节跳动发布 Seedance 2.5:单次可生成 30 秒视频、50 项参考输入与时间戳级区域编辑,但预览承诺的原生 4K 输出未落地,量产版分辨率仅 480p/720p。
字节跳动 Seedance 2.5 把单次生成时长拉到 30 秒,但 2.5 并非 2.0 的全面替代——2.0 才支持 1080p/4K 原生输出。 选型先定分辨率和时长两条硬约束,再按固定 brief 做对比测试,别只看版本号新旧。
2026 年 8 月,字节跳动、Sand.ai、MiniMax、Black Forest Labs 密集发布新一代视频生成模型,四款均支持原生同步音频——视频与声音由同一模型同一次生成直接产出。 单流统一架构与开源 MoE 将千亿参数视频模型单条推理成本压至约 0.5 元/10 秒,AI 视频首次具备低成本批量生产能力。