文明旁观者的头像

文明旁观者

帅气的我简直无法用语言描述!
Iris – AllSpark推出的开源Search Agent模型

Iris – AllSpark推出的开源Search Agent模型

Iris 是小红书 AllSpark 团队开源的搜索智能体(Search Agent),包含 Iris-mini(35B)与 Iris-pro(397B)两个版本,基于通义千问 MoE 基座开发,代码...
文明旁观者的头像6天前
0200
Open‑RAIL – 打通VLA模型与实体机器人的开源工程底座

Open‑RAIL – 打通VLA模型与实体机器人的开源工程底座

Open‑RAIL 是中国移动具身智能产业创新中心推出的开源即插即用中间件,面向 VLA/WAM 视觉语言动作模型与异构人形机器人。它解决大模型推理帧率与机器人电机控制帧率不匹配带来的动作抖动问题,搭...
文明旁观者的头像5天前
0190
AI降低App开发门槛,vivo应用商店开放个人开发者上架通道

AI降低App开发门槛,vivo应用商店开放个人开发者上架通道

2026 vivo 开发者大会现场公布新的生态调整,vivo 应用商店正式开放个人开发者通道。个人创作者完成实名认证,就能提交指定类型应用到应用商店进行分发。 过往 vivo 应用商店仅面向企业主体开...
文明旁观者的头像6天前
0170
豆包大模型2.1 Pro 0915版本正式更新,多项能力迎来升级

豆包大模型2.1 Pro 0915版本正式更新,多项能力迎来升级

豆包大模型 2.1 Pro 推出 0915 新版本,在推理、长文本处理以及多模态交互层面完成迭代优化,面向开发者与普通用户开放全新模型能力。 本次版本更新重点强化复杂逻辑推理性能,处理数学推演、代码编...
文明旁观者的头像6天前
0210
中文互联网基础语料4.0 – 国内大模型训练基础数据集

中文互联网基础语料4.0 – 国内大模型训练基础数据集

中文互联网基础语料 4.0 是中国网络空间安全协会牵头推出的中文互联网数据集,在 2026 国家网络安全宣传周人工智能安全治理分论坛对外发布,整体数据规模 120GB。该版本在 1.0 至 3.0 版...
文明旁观者的头像7天前
0220
Gemini 3.8 Live Extended Thinking – 面向复杂任务的语音实时模型

Gemini 3.8 Live Extended Thinking – 面向复杂任务的语音实时模型

Gemini 3.8 Live Extended Thinking 是 Google DeepMind 推出的实时语音模型增强版本,在 Gemini 3.8 Live 基础上叠加深度推理链路,保留原生...
文明旁观者的头像7天前
0160
Gemini 3.8 Live – 支持边思考边对话的多模态语音模型

Gemini 3.8 Live – 支持边思考边对话的多模态语音模型

Gemini 3.8 Live 是 Google DeepMind 推出的原生音频到音频实时大模型,包含基础版与 Extended Thinking 增强版本,依托 WebSocket 流式接口交付服...
文明旁观者的头像7天前
0180
HiDream-O1-Video-1.0 – 智象原生全模态视频生成模型

HiDream-O1-Video-1.0 – 智象原生全模态视频生成模型

HiDream-O1-Video-1.0(简称 HD-V1)是智象未来 HiDream.ai 推出的原生全模态视频生成模型。依托自研 UiT 架构,支持文本、图片、视频多类型输入,输出 5 至 20 ...
文明旁观者的头像1周前
0210
StepAudio 3 – 阶跃星辰新一代音频基座

StepAudio 3 – 阶跃星辰新一代音频基座

StepAudio 3 是阶跃星辰推出的新一代全栈音频基础模型,整套系列拆分为 Realtime、ASR、TTS、Gen、Music 五个子模型,覆盖语音识别、语音合成、全双工实时对话、综合音频生成...
文明旁观者的头像1周前
0230
比尔・盖茨谈及人形机器人赛事,评价中国人形机器人运动会颇具看点

比尔・盖茨谈及人形机器人赛事,评价中国人形机器人运动会颇具看点

比尔・盖茨在公开交流中分享对全球 AI 行业的观察,针对当前大模型竞争格局给出判断,中美两地各有四家团队,能够持续产出处于最先进水平的大模型。他对中国人形机器人运动会表达兴趣,认为这项赛事展现出机器人...
文明旁观者的头像1周前
0210