MOSS-VL是一个将实时交互(边感知边说话)作为一等能力的开源视觉语言模型家族,通过门控交叉注意力让语言解码器在生成时同步处理视觉输入。MOSS-VL-Realtime在四个流式基准中平均成绩居开源模型之首(三项第一、一项第二),在OmniMMI Proactive Alerting上以66.0分大幅领先最佳基线(37.5分)。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsyhyrd60wg3roz03o05ne6l
AI HOT
MOSS-VL是一个将实时交互(边感知边说话)作为一等能力的开源视觉语言模型家族,通过门控交叉注意力让语言解码器在生成时同步处理视觉输入。MOSS-VL-Realtime在四个流式基准中平均成绩居开源模型之首(三项第一、一项第二),在OmniMMI Proactive Alerting上以66.0分大幅领先最佳基线(37.5分)。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmsyhyrd60wg3roz03o05ne6l
Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst9yj3c05utrodz443l0odv
Gemini 3.7 Flash 现已向 Gemini 聊天中的 Pro 和 Ultra 用户开放。该模型更新提升了多步骤任务的推理与准确性,如智能整合数十个文件和邮件为一份主文档。同时,Gemini Spark 也已运行于 3.7 Flash,通过改进对 Google Workspace 应用的工具调用,让个人 AI 智能体更精准。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst9yj3c05utrodz443l0odv
通义千问兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst3j53e03ncro068tgsr4xn
通义千问兑现承诺,开源 Qwen3.8 系列模型。其中 Qwen3.8-27B 为原生多模态稠密模型,仅 27B 参数即全面超越 Qwen3.7-Plus,原生支持 262K 上下文,可通过 YaRN 扩展至 1M tokens,采用 Apache 2.0 许可。Max 级 Qwen3.8-2.4T-A95B 的开放权重也已同步发布。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst3j53e03ncro068tgsr4xn
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst2gs6d02lmro06sb7as7av
🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst2gs6d02lmro06sb7as7av
Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst3joqo03pwro0658o4g1m3
Cursor 已被 SpaceX 正式收购,完成自 4 月启动的收购流程。合并后 Cursor 将获得全球最大 GPU 集群,以构建更强且运行成本更低的模型,从而以更低价格向客户提供更强大的模型。本周三发布的 Grok 4.6 是双方合作成果的早期体现。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmst3joqo03pwro0658o4g1m3