AI深识站
  • AI软件
  • AI资讯
  • AI世界漫游指南
    • AI知识探索库
    • AI学习教程
  • AI最新项目
  • 排行榜
      • 未登录
        登录后即可体验更多功能
    • AI软件
    • AI资讯
    • AI世界漫游指南
      • AI知识探索库
      • AI学习教程
    • AI最新项目
    • 排行榜
    未登录
    登录后即可体验更多功能

    AI最新项目

    共 525 篇文章
    AI资讯AI世界漫游指南AI知识探索库AI学习教程AI最新项目
    排序
    发布更新浏览点赞
    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5 – Mistral AI推出的形式化验证与数学证明领域模型

    Leanstral 1.5是Mistral AI推出的专注于形式化验证与数学证明领域的专用AI模型,属于Leanstral系列的迭代版本。它并非通用编程助手,而是专为 Lean 4 证明语言设计的代码...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0760
    虎牙VAM 1.0 – 虎牙发布的实时多模态数字人基础模型

    虎牙VAM 1.0 – 虎牙发布的实时多模态数字人基础模型

    虎牙VAM 1.0是虎牙直播基于Diffusion Transformer(DiT)架构研发的实时多模态数字人基础模型,将AI数字人从单向内容输出工具升级为具备实时交互能力的直播主体,通过解决长时间稳...
    AI最新项目
    文明旁观者的头像1个月前
    0760
    MiniCPM-RobotTrack – 视觉-语言-动作(VLA)跟踪导航模型

    MiniCPM-RobotTrack – 视觉-语言-动作(VLA)跟踪导航模型

    MiniCPM-RobotTrack是面壁智能发布的具身智能系列模型中的轻量级端到端视觉-语言-动作(VLA)跟踪导航模型,专为机器人目标跟踪与自主导航设计。实现无网环境下的纯本地化实时跟踪能力,仅需...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0750
    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed – NVIDIA推出的开源嵌入向量模型系列

    Nemotron 3 Embed是NVIDIA推出的开源嵌入向量模型系列,专为检索增强生成(RAG)、智能体记忆及多语言检索场景设计。其8B参数版本在RTEB检索基准测试中以78.46分登顶榜首,成为...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0750
    灵犀专业版 – 金山办公发布的AI原生办公智能体

    灵犀专业版 – 金山办公发布的AI原生办公智能体

    灵犀专业版是金山办公发布的AI原生办公智能体,定位为个人专业办公助理,深度理解用户工作上下文,联动调用WPS文档内核与外部工具,将自然语言指令转化为可编辑、可追溯、支持多人协作的实体办公成果。与传统A...
    AI最新项目
    文明旁观者的头像3周前
    0750
    KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型

    KAT-Coder-Pro V2.5 – 快手发布的旗舰级Agentic Coding模型

    KAT-Coder-Pro V2.5是快手KwaiKAT团队发布的旗舰级Agentic Coding模型,首次实现国产AI从单点代码补全到端到端跑通完整软件工程任务的突破。该模型通过大规模智能体强化学...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0750
    Grok 4.5 – SpaceXAI发布的新一代闭源大语言模型

    Grok 4.5 – SpaceXAI发布的新一代闭源大语言模型

    Grok4.5是SpaceXAI(原xAI,2026年初并入SpaceX)发布的新一代闭源大语言模型,专为编程与智能体任务优化,以约80%的顶尖模型能力水平,实现仅25%左右的使用成本。其技术突破主要...
    AI最新项目
    文明旁观者的头像1个月前
    0750
    InternAgentS – 上海人工智能实验研发的开源科研智能体工作台

    InternAgentS – 上海人工智能实验研发的开源科研智能体工作台

    InternAgentS是一款由上海人工智能实验室智能体系统中心研发的开源科研智能体工作台。它旨在将科研项目转化为一个能够自主行动的智能工作平台,为科研人员提供类似 Claude Science 的一...
    AI最新项目
    文明旁观者的头像1个月前
    0750
    Sakana Fugu – Sakana AI发布的多智能体编排系统

    Sakana Fugu – Sakana AI发布的多智能体编排系统

    Sakana Fugu是由日本AI公司Sakana AI发布的多智能体编排系统,其本质并非基础大模型,而是能智能调度其他模型完成任务的“协调器”。它通过动态组合多个专家模型的优势,在复杂任务中实现接近...
    AI最新项目
    文明旁观者的头像2个月前
    0750
    DeepAgent 4.0 Pro – 深演智能推出的旗舰企业级智能体平台

    DeepAgent 4.0 Pro – 深演智能推出的旗舰企业级智能体平台

    DeepAgent 4.0 Pro是深演智能推出的旗舰级企业级AI智能体平台,将AI从孤立的“效率工具”重构为驱动业务增长的“价值引擎”。通过Agentic Software(智能体软件)与Agent...
    AI最新项目
    文明旁观者的头像1个月前
    0740
    OvisOCR2 – 阿里巴巴开源的0.8B参数文档解析模型

    OvisOCR2 – 阿里巴巴开源的0.8B参数文档解析模型

    OvisOCR2是阿里巴巴开源的0.8B参数文档解析模型,首次以端到端架构超越传统流水线方法,在权威基准OmniDocBench v1.6上以96.58分登顶。该模型仅需单次推理即可将文档图像直接转化...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0730
    ViiTorVoice – 云上曲率研发的支持片段级编辑的AI语音合成模型

    ViiTorVoice – 云上曲率研发的支持片段级编辑的AI语音合成模型

    ViiTorVoice是由中国公司北京云上曲率科技自主研发的全球首个支持片段级编辑的AI语音合成(TTS)模型,在权威评测Seed-TTS中以中文词错率0.99%、英文词错率1.32%的成绩登顶榜首...
    AI最新项目
    文明旁观者的头像1个月前
    0730
    FLUX 3 – Black Forest Labs发布的多模态基础模型

    FLUX 3 – Black Forest Labs发布的多模态基础模型

    FLUX 3是德国人工智能公司Black Forest Labs发布的全球首个在统一架构下联合训练图像、视频、音频及机器人动作预测的多模态基础模型。通过Self-Flow技术将物理世界的因果逻辑融入生...
    AI最新项目# 大模型
    文明旁观者的头像2周前
    0720
    MacWhisper 14 – macOS专业级本地语音转录工具

    MacWhisper 14 – macOS专业级本地语音转录工具

    MacWhisper 14是由独立开发者Jordi Bruin推出的macOS专业级本地语音转录工具,无需联网、保护隐私的离线 AI 转录解决方案。其最大突破在于深度整合英伟达 Parakeet 模型...
    AI最新项目
    文明旁观者的头像3周前
    0720
    Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型

    Fun-ASR-Realtime – 通义升级发布的流式实时语音识别大模型

    Fun-ASR-Realtime是阿里云通义实验室升级发布的流式实时语音识别大模型,首字延迟控制在百毫秒级别、识别准确率接近离线模型,同时支持16种方言与30种语言的无缝识别。该模型专为直播字幕、会议...
    AI最新项目# 大模型
    文明旁观者的头像4周前
    0720
    地平线HSD V2.0 – 地平线发布的全场景辅助驾驶OTA升级版本

    地平线HSD V2.0 – 地平线发布的全场景辅助驾驶OTA升级版本

    地平线HSD V2.0是地平线公司发布的全场景辅助驾驶系统重大OTA升级版本,通过“世界模型+端到端强化学习”双引擎架构重构系统底层逻辑,实现从被动响应到主动预判的能力跃迁。其无接管里程提升56%、博...
    AI最新项目
    文明旁观者的头像1个月前
    0720
    WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型

    WITT – 文远知行发布的聚焦物理世界认知的AI基础大模型

    文远知行发布的 WITT(WeRide World Intelligence Toward Truth) 是全球首个聚焦物理世界认知的AI基础大模型,目标是将真实道路数据转化为可验证、可追溯的物理事实...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0710
    Elements Claw – 阿里达摩院AI智能体自主发现全新超导材料

    Elements Claw – 阿里达摩院AI智能体自主发现全新超导材料

    Elements Claw是阿里达摩院联合中国人民大学、中国科学院大学等机构发布的全球首个超导材料发现专用AI智能体。首次实现AI自主完成从材料筛选、可行性评估到实验方案设计的全流程闭环,成功从240...
    AI最新项目
    文明旁观者的头像1个月前
    0710
    MiniCPM-Robot – 面壁智能发布的开源具身智能系列模型

    MiniCPM-Robot – 面壁智能发布的开源具身智能系列模型

    MiniCPM-Robot是面壁智能发布的开源具身智能系列模型,包含视觉-语言-动作模型(MiniCPM-RobotManip)和跟踪导航模型(MiniCPM-RobotTrack)两款核心产品。该系...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0690
    MiniMax Code – MiniMax推出的2.0桌面端AI Agent编程工具

    MiniMax Code – MiniMax推出的2.0桌面端AI Agent编程工具

    MiniMax Code是专为MiniMax M3大模型设计并与之协同训练的智能体(Agent)产品,于2026年6月1日随M3模型正式发布,7月16日升级至2.0桌面端版本。通过多Agent协作与长...
    AI最新项目
    文明旁观者的头像3周前
    0690
    Seedream 5.0 Pro – 字节跳动发布的多模态图像创作模型

    Seedream 5.0 Pro – 字节跳动发布的多模态图像创作模型

    Seedream 5.0 Pro是字节跳动Seed团队发布的多模态图像创作模型,作为Seedream 5.0预览版(2月上线)的重大升级版本,从“单次生成可用图像”转向“支持全流程设计生产”,重点强化...
    AI最新项目
    文明旁观者的头像1个月前
    0690
    Ego Lite – 专为AI智能体(Agent)设计的浏览器工具

    Ego Lite – 专为AI智能体(Agent)设计的浏览器工具

    Ego Lite是一款专为AI智能体(Agent)设计的浏览器工具,让Agent能高效、安全地操作网页,同时避免干扰人类用户的当前浏览任务。它通过隔离任务空间、复用用户登录态、优化数据传输等技术,解决...
    AI最新项目
    文明旁观者的头像1个月前
    0690
    OpenAI Presence – OpenAI推出的企业级AI智能体管理平台

    OpenAI Presence – OpenAI推出的企业级AI智能体管理平台

    OpenAI Presence是OpenAI推出的企业级AI智能体管理平台,帮助企业将AI智能体深度集成至核心业务流程,而非仅提供基础模型调用服务。解决企业“有模型但难落地”的痛点,通过预置业务场景适...
    AI最新项目
    文明旁观者的头像2周前
    0680
    Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型

    Audio-Visual Flamingo – NVIDIA等推出的全开源音视频大语言模型

    Audio-Visual Flamingo(简称 AVF)是 NVIDIA Nemotron Labs 联合马里兰大学推出的全开源音视频大语言模型(AV-LLM),专门实现音频、图像、长视频的联合感知...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0680
    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime – OpenMOSS团队开源视频理解模型

    MOSS-VL-Realtime是由复旦大学OpenMOSS团队开发的开源实时流式视频理解模型,专为处理动态视频流设计,突破传统模型需等待完整视频输入的限制,实现边接收画面边生成回答、信息不足时主动保...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0680
    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2 – 阿里通义发布的端到端全模态实时交互模型

    Wan-Streamer v0.2是阿里通义实验室发布的端到端全模态实时交互模型,将音视频感知、语言理解与内容生成统一至单个Transformer架构,实现550毫秒级端到端响应延迟(含网络传输)。其...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0670
    Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型

    Qwen-Audio-3.0-Realtime – 阿里巴巴发布的实时语音交互对话模型

    Qwen-Audio-3.0-Realtime是阿里巴巴于2026年7月15日发布的实时语音交互对话模型,通过同步提升推理能力、工具调用、情感表达与双工交互四项核心能力,在毫秒级响应速度下仍保持高精度...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0670
    TuringViT – 小鹏集团发布的高效视觉编码器

    TuringViT – 小鹏集团发布的高效视觉编码器

    TuringViT是小鹏集团发布的高效视觉编码器,作为面向VLM/VLA(视觉-语言-动作)时代的物理AI统一感知底座,通过线性注意力架构、精细化数据治理与原生动态分辨率训练,以仅10%的训练数据量实...
    AI最新项目
    文明旁观者的头像3周前
    0660
    MiniCPM5-2B – 面壁智能发布的20亿参数规模端侧大语言模型

    MiniCPM5-2B – 面壁智能发布的20亿参数规模端侧大语言模型

    MiniCPM5-2B是面壁智能联合OpenBMB发布的20亿参数规模端侧大语言模型,在Artificial Analysis(AA)权威榜单中以17分成绩登顶全球4B以下模型榜首,成为当前同级参数规...
    AI最新项目# 大模型
    文明旁观者的头像3周前
    0660
    SeFi-Image – 基于语义优先扩散开源文本到图像生成模型

    SeFi-Image – 基于语义优先扩散开源文本到图像生成模型

    SeFi-Image是基于"语义优先扩散"技术的开源文本到图像生成模型,通过分离语义与纹理生成流程,在仅需Z-Image约10%-20%训练成本(5B模型125K A800 GPU小时)的前提下,实现...
    AI最新项目
    文明旁观者的头像4周前
    0660
    加载更多
    AI深识站
    AI深识站——国内外优质AI工具导航平台,收录AI写作、绘画、办公、音视频等热门工具,配套AI资讯与教程,每日更新,助你高效工作、玩转AI生活!用AI,学AI,从这里开始。Ctrl + D 或 ⌘ + D 添加书签,随时探索AI新世界。

    关于我们广告合作免责声明

    Copyright © 2026 AI深识站 赣ICP备2026009722号-1 
    网址
    网址文章软件
    热门搜索
    元宝豆包DeepSeek千问翻译