Seedance 2.5 正式发布:30 秒原生直出,视频生成迈入完整创作
2026-07-31 字节跳动正式发布 Seedance 2.5,上线豆包专业版与即梦AI。三项核心升级:单条视频最长 30 秒(上一代 15 秒)、最多 50 个全模态素材联合、30 秒单段原生直出。叙事能力跃迁,从「片段拼接」进入「单段完整创作」。Seedance 2.0 曾全球第一。
首页
紧跟 AI 行业热点事件,快速追踪解读,约 1000 字精炼分析。
2026-07-31 字节跳动正式发布 Seedance 2.5,上线豆包专业版与即梦AI。三项核心升级:单条视频最长 30 秒(上一代 15 秒)、最多 50 个全模态素材联合、30 秒单段原生直出。叙事能力跃迁,从「片段拼接」进入「单段完整创作」。Seedance 2.0 曾全球第一。
美众议院两委员会主席联名致信 DoorDash CEO Tony Xu,调查其使用中国 AI 模型 Kimi K2.6。DoorDash 内部 AI 实验室因中国模型在某些任务上性能更优而采用,却撞上国安数据安全红线。事件折射出企业选型时性能与合规的根本矛盾。
2026-07-08 SpaceXAI 发布 Grok 4.5,1.5T V9 底座 + Cursor 联训的首款 coding+agent 模型,定价 $2/$6、500K 上下文,内部口径"接近 Opus 4.7 但更快";无公开跑分,定位为便宜的 Opus 级平替与 Cursor 原生 coding agent,与 Opus 5 / GPT-5.6 Sol 的错位点在 Cursor 生态而非榜单。
2026 年 7 月 9 日扎克伯格时隔三年重返 X 发布 Muse Spark 1.1,1M 上下文 agentic 模型,$1.25/$4.25 定价,配 Meta 首个付费 API。agentic 工具使用跑分领先(MCP Atlas 88.1/JobBench 54.7),但独立智能指数仅 51、coding 与长程 GDPval-AA v2 落后;发布半月后 Opus 5/GPT-5.6 上场使其位置被动,真正卖点是极低单价下的 token 效率(每任务约 $0.26)。
2026-07-31 DeepSeek-V4-Flash 正式版 API 上线公测,model 名仍是 deepseek-v4-flash、结构与 Preview 一致仅重做后训练。Agent 能力大幅增强、官方基准远超 V4-Pro-Preview(Terminal Bench 2.1 82.7、Cybergym 76.7、DeepSWE 54.4 等)。原生支持 Responses API 并适配 Codex;V4-Pro 正式版随后发布。
Anthropic 于 2026-07-24 发布 Claude Opus 5,在 Artificial Analysis 智能指数(61)与 Agent 指数(55.3)双双登顶,定价 $5/$25 与上代持平。它真正的护城河是 agentic 能力(AA-Briefcase/GDPval 大幅领先),但跑得慢、烧 token、幻觉率升至 50%,适合复杂长任务而非简单问答。
V8.1 于 2026 年 4 月上线、整个夏天作为默认模型迭代,7 月集中发力视频生成--它把高质量静图变成 5 秒动图,补上“让作品动起来”这一刀,而非替代 Sora 做最好的视频工具。
OpenAI 自家报告显示 Codex 半年从尝鲜到主力——Research 部门内部用量涨 56 倍、70.2% 抽样用户做过 ≥1 小时任务、25.6% 超 8 小时。非开发者正成为企业 agent 增长主力,长任务能不能交给 agent 取决于边界清不清晰。
Mistral AI 发布首个具身模型 Robostral Navigate,8B 参数、单 RGB 摄像头即可自主导航,在 R2R-CE 基准上成功率 76.6%,超越多传感器方案。
美团开源 1.6T 稀疏 MoE 编码模型 LongCat-2.0,训练全程用国产 ASIC、零英伟达,曾以代号 Owl Alpha 在 OpenRouter 匿名霸榜约两个月,编码基准全面领先 Qwen3.6-27B。给普通开发者三点选型启示。