您现在的位置是：首页 >每日动态 > 2024-06-18 14:45:06 来源：

AI日报：新王诞生！Runway重磅发布Gen-3 Alpha；Luma AI发布Extend功能；DeepSeek又开源了一个模型；ElevenLabs可为视

导读欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南，每天我们为你呈现AI领域的热点内容，聚焦开发者，助你洞悉技术趋势、了解创...

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南，每天我们为你呈现AI领域的热点内容，聚焦开发者，助你洞悉技术趋势、了解创新AI产品应用。

新鲜AI产品点击了解：https://top.aibase.com/

1、AI视频王者回归！Runway全新Gen3模型又让网友惊艳了一把

这篇文章介绍了Runway最近推出的新一代视频生成模型Gen-3Alpha，该模型在保真度、一致性和动作表现方面有重大改进，为构建通用世界模型迈出了重要一步。Gen-3Alpha具备多项显著功能和特点，成为创意产业中的新星。

2、Luma AI发布了 Extend 功能视频时长扩充到10秒以上

Luma AI最近更新了Dream Machine视频模型，新增了Extend功能，可以将视频时长扩充到10秒以上，并保持原视频风格、人物对象一致。虽然Extend功能生成延长视频耗时较长，但风格一致性保持得很好。

3、DeepSeek发布开源模型DeepSeek-Coder-V2

DeepSeek最近发布了开源模型DeepSeek-Coder-V2，该模型在代码和数学能力方面超越了GPT-4-Turbo，具有全球领先的性能。模型采用MoE架构，支持多语言和更长的上下文处理长度。用户可免费商用，无需申请。

4、Adobe Acrobat迎来重大AI升级

Adobe即将推出一系列重磅AI升级，提升Acrobat的AI助手功能、图像生成能力，保证数据隐私保护。这次更新将极大提升办公效率，为处理大量文档和优化视觉内容带来便利。

5、苹果在Hugging Face平台发布20个Core ML模型

苹果在Hugging Face平台发布了20个新的Core ML模型和4个数据集，展示了其在推动AI发展方面的重大进展。这次更新不仅包括着眼于文本和图像的令人振奋的新模型，还涵盖了广泛的应用，如图像分类、单目深度估计和语义分割。苹果强调了设备AI的重要性，通过在用户设备上运行优化的模型，提升了应用程序性能，同时保障用户数据安全和隐私。

6、ElevenLabs开源视频生成音效工具

ElevenLabs是一家专注于音频生成技术的公司，最近宣布涉足视频生成领域，开源了一个项目可以自动为上传的视频配音，生成合适的音效。他们推出了新功能，用户可以通过输入文本生成各种逼真的音乐特效，为电影、游戏、短视频等行业带来巨大帮助。除音效生成外，还提供语音克隆和文本转语音等强大功能。

7、Stability AI的SD3因许可问题遭反对，CivitAI社区封禁相关内容

Stability AI最新发布的重大模型SD3因许可问题引发争议，面临AI社区反对。CivitAI社区封禁与SD3相关内容，引发许可协议争议。公司推出面向消费者的创作者许可，限制开发者条件和图像生成数量。SD3存在无法生成特定人体姿势等问题，未来不确定。CEO离职裁员，公司需解释新许可协议影响。整个争议对AI社区和开源模型发展有潜在影响。

8、乐高打印机Pixelbot 3000

这篇文章介绍了YouTube频道创作者@Creative Mindstorms设计制造的Pixelbot3000乐高打印机，利用自定义代码和人工智能生成乐高马赛克。用户只需输入艺术作品名称，AI生成图像后Pixelbot3000自动组装马赛克。

9、研究人员教会 AI 识别人类线描的草图

这篇文章介绍了萨里大学和斯坦福大学研究团队开发的新方法，教会人工智能理解人类线描草图的重要性和成果。通过结合草图和文字描述，人工智能展现出接近人类水平的理解能力，对复杂场景中的对象进行准确识别和标记。这一研究为人机交互和设计工作流程带来了新的可能性。

10、研究：AI生成图像未能准确呈现伊斯兰建筑文化细微差异

人工智能（AI）在建筑设计领域带来革命性变革，但在伊斯兰建筑等文化敏感领域，AI生成的图像未能正确呈现历史元素。研究指出AI生成器存在历史知识不足，建议谨慎使用。作者认为AI可成为有价值工具，但需结合人类专业知识和文化敏感度。

免责声明：本文由用户上传，如有侵权请联系删除！

标签：