Meta 正式发布了其全新的旗舰图像生成模型——Muse Image,并首次展示了视频生成器 Muse Video 的早期版本。这两款产品均由 Meta 超级智能实验室开发,标志着该公司在人工智能内容创作领域迈出了重要一步。

Muse Image 现已通过 Meta AI 应用、网页版 meta.ai、Instagram Stories 以及部分 WhatsApp 功能向美国用户开放。据 Meta 称,这是目前最先进的图像生成模型。其核心优势在于对提示词的高度精准遵循、对已生成图像的编辑能力,以及通过多个参考素材构建场景的功能。该模型特别注重整合 Instagram 的社交语境,从而生成更具相关性和个性化的内容。

Muse Image 的架构基于智能体模型设计:它能够自主进行网络搜索,利用工具编写和执行代码,并在生成过程中对图像进行优化。这使得它不仅仅是一个生成器,更是一个面向创意任务的全面助手。

此外,Muse Image 还与另一款模型 Muse Spark 实现了集成。这两款 AI 的结合能够生成动画 GIF、包含内嵌图像的完整网站,甚至交互式视觉游戏,同时运用了媒体生成和代码编写能力。

Muse Video:未来预览

与此同时,Meta 展示了 Muse Video 的早期预览版。该模型基于与 Muse Image 相同的预训练基础,确保了高视觉质量和对音频的原生支持。Meta 承认最终版本仍在开发中:目前主要精力集中在音频与视频的同步,以及快速动作的物理精确呈现上。

版权保护与市场地位

Meta 在 Muse Image 中引入了不可见水印系统 Content Seal。据该公司称,即使经过裁剪、压缩、调整大小或截屏,该水印依然能够保留。未来计划将这一保护机制扩展到视频领域。

根据 Arena 的指标,Muse Image 在文生图、单图编辑和多图编辑类别中均排名第二,仅次于 GPT Image 2。这证实了 Meta 在生成式 AI 市场上的强大竞争力。

Cryptalist 专家观点: Muse Image 的发布和 Muse Video 的预告不仅仅是常规更新,更是 Meta 在创意 AI 工具领域抢占市场份额的战略举措。Muse Image 的智能体架构尤其值得关注,它可能成为未来自主 AI 助手的基础。然而,关键挑战在于将 Muse Video 提升到具有竞争力的水平,尤其是在物理运动模拟方面,OpenAI 和 Runway 的模型目前仍保持优势。