新SeedRealtime – 字节Seed团队发布的原生音视频全双工大模型
SeedRealtime是字节跳动Seed团队于2026年8月5日正式发布的原生音视频全双工大模型。该模型采用统一端到端架构,将音频、视频与文本原生融合,能够在连续多模态信息流上进行实时交互,官方将其...
新JoyAI-Video-Edit – 京东开源自研的实时流式视频编辑模型
JoyAI-Video-Edit是京东探索研究院于2026年8月5日正式开源自研的实时流式视频编辑模型。该模型于2026年7月18日在世界人工智能大会(WAIC)上首次亮相,8月5日在 Hugging...
新MAGI-2 Preview – Sand.ai发布并开源的统一音视频生成模型
MAGI-2 Preview是北京AI视频生成创企Sand.ai(清华系团队)正式发布并开源的统一音视频生成模型。该模型总参数约114B(千亿级),采用MoE(混合专家)架构,单次前向计算仅激活约6B...
新Shieldstral – Mistral AI发布的开源多模态内容安全审核模型
Shieldstral是Mistral AI发布的开源多模态内容安全审核模型(Shieldstral 1.0-3B)。这是一款仅30亿参数的多模态内容安全分类器,已在 Hugging Face 以Ap...
新Qwen-CUA – 阿里巴巴通义实验室推出的原生计算机使用智能体框架
Qwen-CUA是阿里巴巴通义实验室推出的原生计算机使用智能体(Computer-Use Agent, CUA)框架,其核心能力是让大模型直接通过视觉感知屏幕界面,像人类一样操作鼠标键盘完成跨应用任务...
新MemHarness – 上海AI Lab团队及其合作者推出的智能体记忆重构框架
MemHarness 是由上海人工智能实验室(Shanghai AI Lab)团队及其合作者提出的一种“LLM Agent 经验重构”框架。其核心目标是让 AI 智能体(Agent)的记忆机制像人类一...
新AI视频生成平台有哪些,顶级AI视频生成工具Top5推荐
当前AI视频生成平台已从技术演示阶段迈入规模化商用落地,主流工具普遍解决画面连贯性、音画同步、角色一致性三大行业痛点。小编推荐以下5款平台凭借技术成熟度、生态适配性及性价比成为2026年最热门选择,尤...
新Orchard – 微软研究院开源的一个用于训练和评估AI智能体的框架
Orchard 是微软研究院开源的一个用于训练和评估AI智能体(Agentic AI)的框架。它旨在解决当前智能体研究中普遍存在的基础设施壁垒,通过提供一个可复用、轻量级的环境服务,让研究人员能够以更...
新Hy ASR 3.0 Preview – 腾讯混元发布的新一代语音识别模型
Hy ASR 3.0 Preview是腾讯混元发布的新一代语音识别(ASR)模型。它基于腾讯最新一代大语言模型 Hy3的语言理解能力,将高精度语音识别与深度语义理解深度融合,标志着语音识别从传统的"逐...
新4D高斯泼溅技术详解:如何实现高保真动态3D重建与自由视角浏览
4D高斯泼溅(4D Gaussian Splatting, 4DGS)是一种基于显式高斯点云表示的动态场景建模与实时渲染技术,通过在传统3D高斯泼溅(3DGS)基础上引入时间维度,实现对动态场景的高保...









