Qwen-Audio-3.0-ASR-Flash – 阿里巴巴发布的专业级语音识别大模型Qwen-Audio-3.0-ASR-Flash是阿里巴巴发布的专业级语音识别大模型,显著提升行业术语识别准确率(医疗场景达95.36%),并具备上下文一致性优化与语音润色能力,可直接输出结构化文本...AI最新项目# 大模型2个月前0730
MiniMax H3 – MiniMax发布的开源通用全模态生成模型MiniMax H3是MiniMax发布的首款开源通用全模态生成模型,将视频生成从单一任务工具升级为商业级生产力工具。它不再区分图片、视频、音频的独立生成任务,而是通过统一理解多模态上下文直接输出连贯...AI最新项目# 大模型2个月前01320
AngelSpec – 腾讯混元团队开源的覆盖投机解码全链路的端到端框架AngelSpec是腾讯混元团队开源的国内首个覆盖投机解码全链路的端到端框架,解决大模型推理中自回归解码效率低下的问题。提供从草稿模型训练、架构设计到线上部署的完整工具链,而非仅开源调度模块或推理代码...AI最新项目2个月前0730
Grok Voice Think Fast 2.0 – xAI公司发布的新一代语音智能体模型Grok Voice Think Fast 2.0是马斯克旗下xAI公司发布的新一代语音智能体模型,定位为端到端语音到语音(speech-to-speech)AI系统,无需依赖传统"语音识别-大模型推...AI最新项目# 大模型2个月前0780
MCP 2026-07-28 – Anthropic发布的模型上下文协议更新版本MCP 2026-07-28是Anthropic发布的模型上下文协议(Model Context Protocol)重大更新版本,从有状态协议全面转向无状态架构,彻底移除会话机制,使AI智能体与外部工...AI最新项目2个月前0780
Codex Security CLI – OpenAI开源的命令行工具Codex Security CLI是OpenAI开源的命令行工具,专为自动化代码安全漏洞扫描、验证与修复建议设计。基于代码上下文理解而非简单规则匹配,能精准识别真实可利用漏洞并过滤误报,显著降低安全...AI最新项目2个月前0620
Lyria 3.5 – 谷歌DeepMind发布的最新AI音乐生成模型Lyria 3.5是谷歌DeepMind发布的最新AI音乐生成模型,作为Lyria系列的迭代版本,将AI从"一次性生成工具"升级为"可交互的创作伙伴"。支持对已生成歌曲的局部段落进行自然语言修改(如仅...AI最新项目# 大模型2个月前0760
JiuwenSwarm – 面向鸿蒙PC的开源AI统一工作台JiuwenSwarm是华为openJiuwen社区推出的首个面向鸿蒙PC的开源AI统一工作台,将AI从“单智能体工具”升级为“人机协同的蜂群智能体团队”。它基于Coordination Engine...AI最新项目2个月前0950
Instella-MoE – AMD推出的全开源混合专家语言模型(MoE)Instella-MoE是AMD推出的全开源混合专家语言模型(MoE),总参数量达160亿,但推理时仅激活28亿参数,通过专家稀疏激活机制实现高性能与低计算成本的平衡。完全基于AMD自研硬件与软件栈训...AI最新项目# 大模型2个月前0960
QoderVoice – 阿里Qoder推出的国内首个实时语音交互智能体QoderVoice是阿里Qoder推出的国内首个实时语音交互智能体,专为编程场景设计,通过全双工语音技术实现开发者与AI的实时双向讨论式协作,用户可直接用语音下达指令、调整需求,AI同步执行任务并动...AI最新项目2个月前01060
Better Harness – 阿里云开源的面向编程Agent分析与持续改进工具Better Harness是由阿里云Qoder开源的面向编程Agent工作流的开源分析与持续改进工具,通过工程化手段验证Agent实际能力而非配置参数,确保AI生成代码的可靠性与可追溯性。其本质是一...AI最新项目2个月前0840
PerceptionBench – 月之暗面开源的多模态大模型视觉感知评测基准PerceptionBench是由月之暗面(Kimi)团队开源的多模态大模型视觉感知能力评测基准,剥离推理与背景知识干扰,专注评估模型最基础的“纯粹视觉感知”能力。将视觉任务拆解为10项原子级能力,通...AI最新项目2个月前0970
Midjourney V8.2 – Midjourney发布的图像生成模型重大更新版本Midjourney V8.2是Midjourney正式发布的图像生成模型重大更新版本,通过重构美学奖励模型与个性化系统,显著降低随机生成劣质图像的概率,并大幅提升对用户审美偏好的精准捕捉能力。相比此...AI最新项目# 大模型2个月前0970
AlphaEval – SII-GAIR等机构联合推出的生产级AI智能体评测框架AlphaEval是由SII-GAIR、上海交通大学、跨赴科技(KuaFuAI)等机构联合推出的生产级AI智能体评测框架,解决现有评测体系与真实商业环境脱节的问题。将评估焦点从“答案正确性”转向“端到...AI最新项目2个月前0840
SearchOS – 蚂蚁集团等开发的开源多智能体协作框架SearchOS是由中国人民大学与蚂蚁集团联合开发的开源多智能体协作框架,定位为搜索任务的“操作系统”。它通过统一状态管理、动态任务调度和证据追溯机制,解决复杂信息检索中多智能体协作的系统性难题,尤其...AI最新项目2个月前01270
UniWorld-View – 兔展智能联合北京大学团队研发的视觉世界模型UniWorld-View是兔展智能联合北京大学团队研发的视觉世界模型,专注于通过单张图像或视频生成高精度可控的新视角内容,解决"仅凭有限视角推断未拍摄空间"的难题。统一架构的视觉生成模型,能实现单图...AI最新项目2个月前01160
MAI-Cyber-1-Flash – 微软发布的首款网络安全专用生成式AI模型MAI-Cyber-1-Flash是微软发布的首款网络安全专用生成式AI模型,专为软件漏洞分析与自动化防御设计。通过分层混合架构实现高精度漏洞检测与成本优化,将传统需人工介入的安全任务自动化率提升至9...AI最新项目2个月前0670
美团AI小团 – 美团基于自研LongCat大模型打造的本地生活AI助手美团AI“小团”是美团基于自研LongCat大模型打造的本地生活场景专属AI助手,于2026年1月首次产品化上线,2026年7月27日完成2.0重大升级。从“信息推荐”升级为“任务执行闭环”,用户只需...AI最新项目2个月前03010
Agent Miora – 腾讯一款面向创意领域的多模态AI工作平台腾讯首个自研创意智能体 Miora(腾讯设计妙境) 是一款面向创意领域的多模态AI工作平台,将AI从单点生图工具升级为“任务拆解-多模态协同-风格统一交付”的全流程创意伙伴,用户只需输入一句话需求,即...AI最新项目2个月前01210
CatPaw – 美团推出的全场景AI Agent平台CatPaw是美团推出的全场景AI Agent平台,旨在为企业和商家提供开箱即用的AI工作台及企业级Agent开发托管能力,通过将美团本地生活领域的行业知识封装为可复用的智能体,实现业务流程的自动化执...AI最新项目2个月前01330
OpenWorker – 吴恩达团队开源的桌面级AI智能体OpenWorker是由吴恩达团队开源的桌面级AI智能体,直接交付工作成果而非仅提供聊天交互。与传统AI助手不同,它能跨办公工具自动执行任务(如生成报告并发送Slack、调整日程),且所有数据默认本地...AI最新项目2个月前0920
WorkBuddy Bench – 腾讯推出的多领域AI智能体能力评测基准套件WorkBuddy Bench是腾讯推出的多领域AI智能体能力评测基准套件,专为评估AI智能体在真实工作场景中的综合执行能力而设计。从真实业务场景逆向构造任务,彻底剥离公开题库依赖,实现抗"答案污染...AI最新项目2个月前0970
MineExplorer – 多模态大语言模型开放世界探索能力评测基准MineExplorer是由上海交通大学与美团 LongCat 团队联合开发的首个知识受控的多模态大语言模型(MLLM)开放世界探索能力评测基准。它通过构建“隐式多跳任务”,剥离游戏专属知识,专注于测...AI最新项目2个月前01540
OJO – 基于多Agent协作的设计工作台OJO是前字节跳动剪映产品负责人Kiki创立的AI设计智能体平台,定位为全球首个基于多Agent协作的设计工作台。通过自然语言驱动虚拟设计团队,将模糊创意需求自动转化为包含策略分析、原型设计到代码交付...AI最新项目2个月前01260
Anthropic Opus 5 – Anthropic公司发布的旗舰级AI模型Anthropic Opus 5是Anthropic公司发布的高性价比旗舰级AI模型,定位为性能逼近顶级模型Fable 5但价格仅为其一半的日常任务首选方案。通过动态调节"思考档位"(effort)机...AI最新项目# 大模型2个月前0760
OvisOCR2 – 阿里巴巴开源的0.8B参数文档解析模型OvisOCR2是阿里巴巴开源的0.8B参数文档解析模型,首次以端到端架构超越传统流水线方法,在权威基准OmniDocBench v1.6上以96.58分登顶。该模型仅需单次推理即可将文档图像直接转化...AI最新项目# 大模型2个月前01250
Cosmos 3 Edge – 英伟达推出的40亿参数开源世界模型Cosmos 3 Edge是英伟达在SIGGRAPH 2026大会上发布的40亿参数开源世界模型,专为边缘设备实时物理AI推理设计。通过双塔架构实现本地化物理世界理解与动作生成,可在Jetson Th...AI最新项目# 大模型2个月前01090
BigMac – 小红书开源的多模态大语言模型训练框架BigMac是小红书dots infra团队开源的多模态大语言模型训练框架,通过"准依赖安全嵌套流水线"设计,首次实现显存占用与训练速度的同步优化。传统方案中,多模态训练必须在"算力优先"(速度高但显...AI最新项目# 大模型2个月前0830
Ling 3.0 Flash – 蚂蚁百灵团队最新发布的高效推理大模型Ling 3.0 Flash是蚂蚁集团百灵团队最新发布的高效推理大模型,总参数量124B,激活参数仅5.1B,在保持高智能水平的同时显著优化Token消耗与推理速度。以1/10的Token消耗实现Ag...AI最新项目# 大模型2个月前01900
FLUX 3 – Black Forest Labs发布的多模态基础模型FLUX 3是德国人工智能公司Black Forest Labs发布的全球首个在统一架构下联合训练图像、视频、音频及机器人动作预测的多模态基础模型。通过Self-Flow技术将物理世界的因果逻辑融入生...AI最新项目# 大模型2个月前01480