微信ClawBot – 一键连AI智能体,聊天就能办公微信ClawBot是微信官方于2026年3月22日正式推出的一款AI Agent(智能体)插件。 它的核心功能是让用户在微信聊天界面中,直接连接并操控部署在本地设备(如个人电脑、NAS、Mac min...AI最新项目5个月前01630
OpenMontage – 全球首个开源由AI智能体驱动的视频制作系统OpenMontage是全球首个开源的、由AI智能体(Agentic AI)驱动的视频制作系统。简单来说,它就像一个不知疲倦的“AI 视频副导演”。它不是一个简单的“一键生成视频”的玩具,而是一个结构...AI最新项目3个月前01620
混元3D世界模型 2.0 – 腾讯混元3D世界模型2.0发布腾讯混元团队正式发布并开源了混元3D世界模型 2.0 (HY-World 2.0)。这是一个多模态大模型,能够根据文字、图片、视频等输入,自动生成、重建和模拟可交互的3D世界。 它的核心突破在于,不再...AI最新项目# 大模型4周前01620
MiniMax Music 2.6 – MiniMax发布了新一代AI音乐生成模型MiniMax发布了其新一代AI音乐生成模型——Music 2.6. 这次更新被官方称为“全维度进化”,核心解决的是以往 AI 音乐“机械感强”、“不可控”和“生成慢”的三大痛点。简单来说,现在的Mu...AI最新项目# 大模型4周前01620
Xiaomi MiMo-Embodied – 小米自主研发的一款具身开源大模型Xiaomi MiMo-Embodied是由小米公司自主研发的一款具身大模型(Embodied AI Model),于2025年11月21日正式发布并全面开源。 它是业界首个成功打通自动驾驶与具身智能...AI最新项目# 大模型4周前01620
GLM-5.2 – 智谱AI发布的开源大语言模型,国产编程模型GLM-5.2是智谱AI发布的开源大语言模型,迄今能力比较强的国产编程模型,真正可用的100万token上下文窗口与MIT协议全开源,在代码生成、长程任务稳定性及工程化落地能力上达到全球顶尖水平,尤其...AI最新项目2个月前01610
Stable Audio3 – Stability AI正式发布的音频生成模型系列Stable Audio3.0是Stability AI正式发布的音频生成模型系列,最大突破是将专业级音乐生成时长提升至 6 分 20 秒,首次实现AI生成结构完整、旋律连贯的歌曲级内容,标志着 AI...AI最新项目3个月前01600
百度Qianfan-OCR端到端文档模型全面解析Qianfan-OCR 是百度智能云基于其“千帆”(Qianfan)大模型平台推出的新一代智能文字识别服务。 与传统的OCR(光学字符识别)工具不同,Qianfan-OCR不仅仅是把图片里的字“抠”出...AI最新项目5个月前01600
deepseek v4 flash – 深度求索发布的轻量化高效版大模型DeepSeek-V4-Flash是深度求索发布的轻量化高效版大模型,作为V4系列的“快速模式”版本,专为高频日常任务设计,在保持接近Pro版推理能力的同时,将响应速度和调用成本压缩至极致。以1/10...AI最新项目# 大模型5天前01590
GPT-5.5 – OpenAI正式发布的最新、最智能的AI模型GPT-5.5是OpenAI正式发布的最新、最智能的AI模型。它被定位为“为真实工作而生的一类新智能”,标志着 AI 从“能回答问题”向“能自主完成复杂任务”的重大转变。 GPT-5.5核心突破 GP...AI最新项目4个月前01590
Mega-ASR – NTU、NUS、上海AI Lab开源的语音识别基座模型Mega-ASR 是新加坡国立大学、南洋理工大学与上海人工智能实验室等团队于2026年5月联合开源的全场景鲁棒语音识别基座模型,基于Qwen3-ASR 1.7B架构,通过声学仿真规模化训练与强化学习优...AI最新项目3个月前01580
GPT-5.5 Instant – ChatGPT的全新一代默认模型OpenAI正式发布了GPT-5.5 Instant,并将其设为ChatGPT的默认模型,全面取代了此前的GPT-5.3Instant。这次更新被官方定义为“更准确、更简洁、更懂你”的进化。它不再仅仅...AI最新项目1个月前01580
Qwen3.5-Omni – 千问发布的端到端原生全模态大模型Qwen3.5-Omni是阿里巴巴通义千问正式发布的新一代端到端原生全模态大模型。 它打破了传统模型只能处理单一或特定组合模态的限制,实现了文本、图像、音频、视频四种模态的原生统一理解与生成,被誉为...AI最新项目4个月前01580
SciDraw AI – 基于自然语言描述生成科研级科学插图的平台SciDraw AI是一个基于自然语言描述生成科研级科学插图的AI平台,通过AI技术将传统需数小时的手工绘图流程压缩至几分钟,无需专业设计基础即可快速生成符合期刊投稿标准的矢量图表,尤其适合跨学科科研...AI最新项目2个月前01570
LongCat-Video-Avatar 1.5 – 美团开源的虚拟人视频生成模型LongCat-Video-Avatar 1.5是美团龙猫团队开源的商用级虚拟人视频生成模型升级版本,在动作拟真度、长视频稳定性与身份一致性三大核心维度实现突破性升级,首次在多项关键指标上全面超越主流...AI最新项目3个月前01570
Gemini Omni Flash – 面向视频创作的全模态对话式生成模型Gemini Omni Flash是谷歌于I/O开发者大会上发布的首款面向视频创作的全模态对话式生成模型,核心定位是通过自然语言实现多轮连贯的视频编辑,而非一次性生成。它并非单纯追求视频时长或画质,而...AI最新项目3个月前01570
Qwen3.6-Max-Preview – 阿里通义千问系列当前最强旗舰预览版Qwen3.6-Max-Preview(2026年4月20日发布)是阿里通义千问系列当前最强旗舰预览版,定位企业级与开发者高要求场景,在智能体编程、世界知识、指令遵循三大核心能力上全面超越Qwen3...AI最新项目4个月前01570
html-video – Open Design团队开源的HyperFramesOpen Design团队开源的HyperFrames(常被称作 "HTML 版剪映")是 一个基于 HTML/CSS/JavaScript 的动态视频生成框架,核心目标是让开发者用前端技术栈直接生成...AI最新项目2个月前01560
Xiaomi OneVL – 小米发布并全面开源的自动驾驶大模型Xiaomi OneVL是小米正式对外发布并全面开源的自动驾驶大模型。Xiaomi OneVL的核心定位是“一步式潜空间语言视觉推理框架”。OneVL并非简单的视觉模型,而是小米XLA(认知大模型架构...AI最新项目3个月前01560
Qwen-Scope – 阿里千问开源的一款大模型可解释性分析模块Qwen-Scope是阿里千问正式开源的一款大模型可解释性分析模块。简单来说,它就像是给黑盒般的大模型装上了一个“透视镜”或“仪表盘”,让我们能够看穿模型内部的运作机制,理解它为什么会产生某种回答,甚...AI最新项目3个月前01560
OpenHarness – 港大开源的一款轻量级AI智能体驾驭框架OpenHarness是由香港大学数据科学研究院(HKUDS)于2026年4月开源的一款轻量级AI智能体驾驭框架(Agent Harness)。 它的核心理念是“模型即智能体,代码即驾驭框架”,旨在为...AI最新项目4个月前01550
Qwen-AgentWorld – 阿里通义千问团队发布原生语言世界模型Qwen-AgentWorld是阿里巴巴通义千问团队于2026年6月24日发布的全球首个原生语言世界模型(Language World Model, LWM),从训练源头实现环境建模,而非依赖事后插件...AI最新项目# 大模型4周前01540
ZCube – 智谱联合清华大学开发的新型AI集群网络架构ZCube是由智谱联合清华大学、驭驯网络开发的新型AI集群网络架构,专为解决大模型推理场景中的结构性网络拥塞问题而设计。 其核心突破在于彻底重构网络拓扑,通过取消传统Clos架构的Spine层、采用扁...AI最新项目# 大模型4周前01520
FIPO – 阿里巴巴通义最新发布的大模型强化学习算法FIPO是阿里巴巴通义实验室(Qwen Team)最新发布的大模型强化学习算法。 它的全称是Future-KL Influenced Policy Optimization(未来KL散度影响策略优化...AI最新项目4个月前01520
Ideogram 4 – Ideogram公司发布的开源文生图模型Ideogram 4.0是Ideogram公司于2026年6月3日发布的93亿参数开源文生图模型,最大突破在于通过单流架构实现像素级排版控制能力,使AI生图从随机“抽卡”转向可精准指定文字位置、对象布...AI最新项目2个月前01510
9Router – 完全免费、开源的本地AI模型路由代理工具9Router是一款完全免费、开源的本地AI模型路由代理工具,你可以把它理解为你所有AI编程工具背后的“智能调度中心”。它的核心目标是让你用最低的成本,获得最稳定、不间断的AI编程体验。 9Route...AI最新项目3个月前01510
Realtime TTS-2 – Inworld AI发布的一款实时对话语音合成模型Realtime TTS-2是由Inworld AI发布的一款实时对话语音合成模型。它并非传统的“文本转语音”工具,而是通过闭环系统架构,能够实时感知对话中的音频上下文(如用户的语调、节奏和情感),从...AI最新项目3个月前01500
TuyaClaw – 涂鸦智能2026年推出的新一代AI助理TuyaClaw是涂鸦智能2026年推出的新一代AI助理。它基于OpenClaw架构,首创打通数字与物理世界,既能操作电脑办公,又能控制智能家居。支持一键部署、微信体验及多模型自由切换,内置3200...AI最新项目5个月前01500
文心大模型系列文心大模型(ERNIE)是百度自主研发的产业级知识增强大模型。截至2026年5月,其最新版本为文心大模型5.1.刚刚在近期正式发布。 文心大模型 5.1 这是百度在2026年5月Create开发者大会...AI最新项目3个月前01490
MemPrivacy – 荣耀联合同济发布端云协同AI隐私保护框架MemPrivacy是由记忆张量(MemTensor) 联合荣耀、同济大学开源的、面向端云协同AI智能体(Agent)的隐私保护框架与系列模型。 简单来说,MemPrivacy的核心作用是解决AI越来...AI最新项目3个月前01490