AI日报:MiniMax发布全模态模型H3;Seedance 2.5发布,30秒一镜到底;DeepSeek-V4-Flash正式版上线

欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。 1、MiniMax发布通用全模态模型H3,15秒2K音视频生成价格不到主流模型三分之一 MiniMax发布通用全模态模型H3,实现了文本、图像、视频、音频的统一理解与生成,标志着多模态生成模型从专用专家向通用
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技术趋势、了解创新AI产品应用。
1、MiniMax发布通用全模态模型H3,15秒2K音视频生成价格不到主流模型三分之一
MiniMax发布通用全模态模型H3,实现了文本、图像、视频、音频的统一理解与生成,标志着多模态生成模型从专用专家向通用助手迈出关键一步。H3在指令遵循、品牌信息呈现、V2V动作迁移等场景下表现出商用级稳定性,已可应用于广告、电商、游戏、UI设计等多个商业领域。同时,H3在设计初期就考虑了多款国产芯片的兼容性,其开源将进一步降低国内企业在多模态AI应用上的技术门槛。
2、字节跳动 Seedance 2.5 发布:30 秒一镜到底,AI 视频开始会讲故事了
字节跳动发布 Seedance 2.5 视频生成模型,将单次视频生成时长提升至 30 秒,并具备长叙事能力、多模态参考和编辑能力,可完成完整创作。

3、DeepSeek-V4-Flash正式版上线,130亿激活参数撬动Agent战场
DeepSeek-V4-Flash正式版API公测上线,标志着其在Agent赛道上的重要进展。该模型在多项基准测试中表现优异,且激活参数仅为130亿,与旗舰模型V4-Pro相比具有显著成本优势。同时,其自研Agent框架DeepSeek Harness 首次 亮相,并支持OpenAI的Responses API格式,便于开发者迁移应用。
4、DeepMind发布Gemini Robotics ER 2, 首次 解锁多机协同
文章介绍了DeepMind发布的Gemini Robotics ER2模型,该模型在多机器人协同、实时决策和任务监控方面取得重大突破,标志着具身智能向规模化商用迈出了坚实一步。

5、谷歌将 Nano Banana2集成至 Google Earth,支持在线AI生成地理场景图像
谷歌宣布将 最新 Nano Banana2 AI图像生成模型集成至Google Earth,面向全球用户开放AI图像生成功能,提升地理空间内容的可视化能力。

6、华为开源5050亿参数openPangu-2.0-Pro模型,权重与推理代码同步开放
华为正式开源盘古AI模型品牌openPangu旗下openPangu-2.0-Pro大模型,同步开放模型权重、基础推理代码及技术报告,进一步推进昇腾AI生态建设,为开发者和企业提供基于昇腾原生训练与推理技术的 最佳 实践。
7、阿里千问发布Qwen-Audio-3.0-ASR-Flash,语音识别攻克专业场景最后一公里
阿里千问发布Qwen-Audio-3.0-ASR-Flash,语音识别攻克专业场景最后一公里。新模型在五大维度实现升级,包括长音频上下文记忆、内置多行业词库、分级热词定制、集成语音润色以及多语言支持。该模型已在多个领域广泛应用,如会议纪要、实时字幕、教育录播和智能客服等。
8、特斯拉中国车机正式接入豆包大模型
特斯拉中国正式推送2026.14.13版本的车机软件更新,其中最引人注目的是引入了豆包大模型,提升了车机系统的智能交互体验。不过,该功能需要用户开通 高级 车载娱乐服务才能使用。
要点速读
欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技
- 欢迎来到【AI日报】栏目!这里是你每天探索人工智能世界的指南,每天我们为你呈现AI领域的热点内容,聚焦开发者,助你洞悉技
- 更多细节仍在持续更新中
- 更多细节仍在持续更新中