FLUX 3:Black Forest Labs 的多模态世界模型,一次生成带原生音频的 20 秒视频
官方背景 FLUX 3 是德国 Black Forest Labs 于 2026 年 7 月 23 日发布的多模态基础模型,由 FLUX.1 / FLUX.2 图像系列升级而来。它不再只是图像生成器,而是用统一架构联合学习图像、视频、音...
Qwen-Image(通义万相)
官方背景 Qwen-Image(中文品牌'通义万相')是阿里通义实验室(Tongyi)于 2025 年推出的开源图像生成基础模型,对外以'通义万相'产品形态提供服务(tongyi.aliyun.com / 阿里云百炼 Model Studi...
DeepSeek深夜开源dsh!一行命令起Agent,”一切皆插件”对标Claude Code
第一章 DeepSeek 下场做'Agent 操作系统' 8月13日深夜,DeepSeek 悄悄干了一件大事:开源了首款 Agent 产品 DeepSeek Harness,代号 dsh,开发者预览版 v0.1,MIT 协议,代码全扔到 GitHub 了。...
Muse Image
官方背景 Muse Image 是 Meta 超级智能实验室(Meta Superintelligence Labs, MSL)于 2026 年 7 月发布的旗舰级图像生成模型,也是 Meta 迄今最先进的生图模型。它与同底座的视频模型 Muse Vide...