noreply@aihot.virxact.com (公众号:小红书技术(dots.llm))
noreply@aihot.virxact.com (公众号:小红书技术(dots.llm))
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssv94cg0h4mroffsb9e7a88

noreply@aihot.virxact.com (公众号:小红书技术(dots.llm))
noreply@aihot.virxact.com (公众号:小红书技术(dots.llm))
dots3-note Preview 开源:280B 参数轻量模型,主打长程智能体与多模态推理

小红书技术开源 dots3-note Preview,这是 dots3 系列最轻量模型,总参数 280B、激活参数 16B,支持 512K 上下文及文本、视觉、语音多模态理解,并针对复杂推理和长程 Agent 任务优化。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssv94cg0h4mroffsb9e7a88

noreply@aihot.virxact.com (智谱:研究(网页内嵌数据))
noreply@aihot.virxact.com (智谱:研究(网页内嵌数据))
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmswlcuwb0wcyrovmfccplna7

noreply@aihot.virxact.com (智谱:研究(网页内嵌数据))
noreply@aihot.virxact.com (智谱:研究(网页内嵌数据))
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一。模型在白盒代码审查等安全任务中表现持平Mythos 5,并在CyberGym测试中得分84.5%。GLM-5.3即日起上线ZCode、AutoClaw等工具,API很快上线,完整模型权重将在两周内开源。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmswlcuwb0wcyrovmfccplna7

noreply@aihot.virxact.com (公众号:智谱(GLM))
noreply@aihot.virxact.com (公众号:智谱(GLM))
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1

noreply@aihot.virxact.com (公众号:智谱(GLM))
noreply@aihot.virxact.com (公众号:智谱(GLM))
GLM-5.3 发布:编程能力开源第一,并涌现网络安全能力

智谱发布GLM-5.3,基于与GLM-5.2相同的基座,通过极致的后训练Scaling提升智能上界,编程能力较前代提升50%,在Terminal Bench 3.0等公开基准中取得开源第一,并接近Claude Fable 5。模型在白盒代码审查等安全任务中表现持平Mythos 5,在CyberGym测试中得分84.5%。模型权重将在两周后开源,即日起上线ZCode、AutoClaw等工具。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssir12d047oroffnpn5pcx1

noreply@aihot.virxact.com (X:硅基流动 SiliconFlow (@SiliconFlowAI))
noreply@aihot.virxact.com (X:硅基流动 SiliconFlow (@SiliconFlowAI))
DeepSeek V4 Pro 登陆硅基流动,1M 上下文

DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssi38vn03o9rofffr0z8lyb

noreply@aihot.virxact.com (X:硅基流动 SiliconFlow (@SiliconFlowAI))
noreply@aihot.virxact.com (X:硅基流动 SiliconFlow (@SiliconFlowAI))
DeepSeek V4 Pro 登陆硅基流动,1M 上下文

DeepSeek-V4-Pro-0813 正式上线硅基流动 SiliconFlow,提供 Day-0 支持,具备 1M 上下文窗口及低/高/最大三档推理强度,更侧重编码、工具调用与智能体工作流,仍保持 MIT 开源协议。定价为输入 $1.32/M、输出 $3.96/M、缓存命中 $0.44/M。同系列 DeepSeek-V4-Flash-0731 则面向追求速度与成本效益的日常生产场景。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssi38vn03o9rofffr0z8lyb

noreply@aihot.virxact.com (公众号:蚂蚁百灵(Ling))
noreply@aihot.virxact.com (公众号:蚂蚁百灵(Ling))
蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环

蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssf79uf05rwrod09r9ocb2w

noreply@aihot.virxact.com (公众号:蚂蚁百灵(Ling))
noreply@aihot.virxact.com (公众号:蚂蚁百灵(Ling))
蚂蚁百灵与 ASystem 团队打通单机 Agentic RL 后训练闭环

蚂蚁百灵与 ASystem 团队合作,用 Ling-3.0-tiny 和 AReno 在 DGX Spark 上跑通单机 Agentic RL 后训练闭环。以井字棋为最小验证任务,用 GSPO 算法训练 400 步后,rollout/rewards_mean 从约 -0.5 升至 0.4,response_len 降至约 850 tokens,工具调用与动作选择趋于稳定。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmssf79uf05rwrod09r9ocb2w

加载更多资讯