全部资讯

重置筛选
noreply@aihot.virxact.com (Hugging Face:Blog(RSS))
noreply@aihot.virxact.com (Hugging Face:Blog(RSS))
Hugging Face 发布 LFM2.5 系列 DSpark 草稿模型,推理速度最高提升 3.18 倍

Hugging Face 发布 LFM2.5 系列三款模型的 DSpark 草稿模型检查点,通过投机解码在不改变输出质量的前提下,GPU 吞吐最高提升 3.18 倍,端侧最高 2.87 倍。草稿模型约 300M 参数,LFM2.5-2.6B 函数调用延迟平均降低 57%,已开源支持 llama.cpp 和 SGLang。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1rv5n8066iroovaxgoej1b

noreply@aihot.virxact.com (Claude:Blog(网页))
noreply@aihot.virxact.com (Claude:Blog(网页))
Claude Mythos 5 网络安全能力扩展至更多防御者

Anthropic 宣布 Claude Mythos 5 现已集成至 Claude Security,并即将登陆合作伙伴的网络安全防御工具。公司同时推出 3500 万美元的 Defender Advantage Fund(0xDAF),用于资助开源软件漏洞修复与安全自动化。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt396dpw0kj0ro6tdktqkp8s

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))
noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))
Ling-3.0-flash 在 4 块 Blackwell GPU 上如何将批处理 1 解码延迟降低 54%

蚂蚁 Ling Infra 团队与 RadixArk SGLang 团队将 Ling-3.0-flash 混合线性注意力 MoE 模型的单请求解码速度从 288 tok/s 提升至 606 tok/s,平均 TPOT 从 3.33 ms 降至 1.53 ms。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt393qov0kfhro6tuwhxhubl

noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))
noreply@aihot.virxact.com (LMSYS:Blog(Chatbot Arena 团队))
Ling-3.0-flash 在 4 块 Blackwell GPU 上如何将批处理 1 解码延迟降低 54%

蚂蚁 Ling Infra 团队与 RadixArk SGLang 团队将 Ling-3.0-flash 混合线性注意力 MoE 模型的单请求解码速度从 288 tok/s 提升至 606 tok/s,平均 TPOT 从 3.33 ms 降至 1.53 ms。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt393qov0kfhro6tuwhxhubl

noreply@aihot.virxact.com (Claude:Blog(网页))
noreply@aihot.virxact.com (Claude:Blog(网页))
Claude Mythos 5 网络安全能力扩展至更多防御者

Anthropic 宣布 Claude Mythos 5 现已集成至 Claude Security,并即将登陆合作伙伴的网络安全防御工具。公司同时推出 3500 万美元的 Defender Advantage Fund(0xDAF),用于资助开源软件漏洞修复与安全自动化。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt396dpw0kj0ro6tdktqkp8s

noreply@aihot.virxact.com (Google Cloud:Databases(RSS))
noreply@aihot.virxact.com (Google Cloud:Databases(RSS))
AlloyDB ScaNN 如何将向量搜索扩展到 100 亿向量

AlloyDB 的 ScaNN 索引现已支持超过 100 亿向量的规模,通过全新的四层树架构(预览版)实现,将查询复杂度从 O(N^1/2) 降至 O(N^1/4)。内部测试中,该架构在 100 亿向量规模下可实现 p95 延迟不超过 51 毫秒、召回率达 95%。该功能可通过快速入门指南部署,新用户可享受 30 天免费试用。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1r7jjh05lgroovc4zwypj6

noreply@aihot.virxact.com (Google Cloud:Databases(RSS))
noreply@aihot.virxact.com (Google Cloud:Databases(RSS))
AlloyDB ScaNN 如何将向量搜索扩展到 100 亿向量

AlloyDB 的 ScaNN 索引现已支持超过 100 亿向量的规模,通过全新的四层树架构(预览版)实现,将查询复杂度从 O(N^1/2) 降至 O(N^1/4)。内部测试中,该架构在 100 亿向量规模下可实现 p95 延迟不超过 51 毫秒、召回率达 95%。该功能可通过快速入门指南部署,新用户可享受 30 天免费试用。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1r7jjh05lgroovc4zwypj6

noreply@aihot.virxact.com (Claude:Blog(网页))
noreply@aihot.virxact.com (Claude:Blog(网页))
Claude Code 初创公司指南:五大规则与创始人洞见

Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出"人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化"五大规则。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1k19bn06qgrokx1p75h1gv

noreply@aihot.virxact.com (Claude:Blog(网页))
noreply@aihot.virxact.com (Claude:Blog(网页))
Claude Code 初创公司指南:五大规则与创始人洞见

Anthropic 发布面向初创公司的 Claude Code 使用指南,基于对十余家高增长公司的调研,总结出"人人皆可交付、自动化繁琐工作、信任但验证、为重构而构建、原型-自用-产品化"五大规则。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1k19bn06qgrokx1p75h1gv

noreply@aihot.virxact.com (IT之家(RSS))
noreply@aihot.virxact.com (IT之家(RSS))
阿里发布 Qwen-UI-Agent,主打让模型真正"会用"每一块屏幕

阿里巴巴正式推出 Qwen-UI-Agent,一个以真实世界为中心的 GUI 智能体基座模型,覆盖移动端、电脑端、网页端及深度搜索(DeepSearch)环境。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt1di48c04vuro1q95i06dby

加载更多资讯