热闻岛
返回全网热点

AI日报:京东开源视频实时编辑模型;Qwen-Image-3.0上线;腾讯混元发布Hy ASR 3.0 preview

1天前7 阅读
AI日报:京东开源视频实时编辑模型;Qwen-Image-3.0上线;腾讯混元发布Hy ASR 3.0 preview配图
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。 1、京东开源视频实时编辑模型:30 帧秒级推理,边看边改重新定义视频创作 京东开源了自研的实时流式视频编辑模型 JoyAI-Video-Edit,该模型在处理速度和视频长度方面均取得突破,能够实现边观看边修改

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。

1、京东开源视频实时编辑模型:30 帧秒级推理,边看边改重新定义视频创作

京东开源了自研的实时流式视频编辑模型 JoyAI-Video-Edit,该模型在处理速度和视频长度方面均取得突破,能够实现边观看边修改视频的效果。同时,它还为机器人训练数据的合成提供了新的技术路径。

2、阿里千问图像生成模型Qwen-Image-3.0 上线 开放API且0.18元/张

阿里巴巴千问图像生成模型Qwen-Image-3.0正式上线,并面向用户全量开放。该模型在文生图榜单中位列国内 第一 ,支持超长文本理解和精细化渲染,覆盖多种艺术风格和语言,定价合理,适用于商业工作流。

AI日报:京东开源视频实时编辑模型;Qwen-Image-3.0上线;腾讯混元发布Hy ASR 3.0 preview配图

3、腾讯混元发布 Hy ASR 3.0 preview:语音识别不再逐字硬转,而是真的听懂了语境

腾讯混元发布的Hy ASR 3.0 preview在语音识别和语义理解方面实现了重大突破,提升了多语言的识别准确率,并优化了专业场景的适配能力。

AI日报:京东开源视频实时编辑模型;Qwen-Image-3.0上线;腾讯混元发布Hy ASR 3.0 preview配图

4、字节 Seed 甩出 SeedRealtime:音视频全双工大模型上车豆包,边看边听边说不再卡拍

字节 Seed 团队推出的 SeedRealtime 是一个原生融合音视频和文本的全双工大模型,已在豆包 App 上线,显著提升了实时交互的自然性和流畅性。

5、马斯克放话:Grok 4.6 下周登场,SpaceX 全部历史数据将灌入模型训练

马斯克在SpaceX 首次 财报电话会上透露了Grok的 最新 进展,包括Grok4.6和Grok4.7的发布时间,并强调将SpaceX的历史数据整合到Grok的训练中,以提升模型的能力。

6、影石 AI 硬件牵手阿里千问:Go Ultra 口袋相机率先装上语音助手 Kira

影石 Insta360 正在将 AI 技术融入硬件产品,特别是其 Go Ultra 系列口袋相机。通过自研技术与阿里千问大模型的融合,AI 语音助手 Kira 将为用户提供更智能的交互体验,同时兼顾地域差异。

AI日报:京东开源视频实时编辑模型;Qwen-Image-3.0上线;腾讯混元发布Hy ASR 3.0 preview配图

7、Mistral 推出 Shieldstral:3B 小模型单卡 16GB 跑起多模态审核,号称拿下开源 SOTA

Mistral AI 推出了 Shieldstral 内容审核模型,该模型具有30亿参数,采用开放权重并依照 Apache2.0许可证发布。它支持12种语言,并且能够在单张16GB GPU 上运行。Shieldstral 的独特之处在于它将审核政策写入输入中,从而实现灵活的审核机制。此外,它能够覆盖多种审核任务,包括提示词分类、回答审核和毒性检测,同时在多模态内容审核领域达到了当前 最先 进的水平。

8、一签约5.2万元!机器人独角兽宇树科技冲击科创板,发行价预估超百元

宇树科技作为国内人形机器人领军企业,正式开启科创板IPO,预计募资超40亿元,发行价或达104元/股,标志着具身智能与机器人产业链资本化进程全面提速。

要点速读

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技

  • 欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技
  • 更多细节仍在持续更新中
  • 更多细节仍在持续更新中