noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
开放世界多智能体环境中的自主数学发现

在无中央协调器的开放世界多智能体环境Station中,来自不同模型家族的AI智能体自主选择研究方向、开展实验并构建共享科学文献。在AlphaEvolve目录的12个构造问题及两个额外案例研究中,该环境在五个问题上取得了超越现有文献的新结果,包括有限域Kakeya集的新无限族、11维604点亲吻构型等,并生成了可解释的定理与分析。所有原始智能体对话、证明和验证代码均已公开。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmte36nzj02isrog2hwxpthhn

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
开放世界多智能体环境中的自主数学发现

在无中央协调器的开放世界多智能体环境Station中,来自不同模型家族的AI智能体自主选择研究方向、开展实验并构建共享科学文献。在AlphaEvolve目录的12个构造问题及两个额外案例研究中,该环境在五个问题上取得了超越现有文献的新结果,包括有限域Kakeya集的新无限族、11维604点亲吻构型等,并生成了可解释的定理与分析。所有原始智能体对话、证明和验证代码均已公开。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmte36nzj02isrog2hwxpthhn

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
在本地运行 Qwen3.8 27B:来自我的 Mac Studio 的实际数据

Qwen3.8 27B(27.3B 参数,混合注意力架构,262,144 token 上下文窗口,Apache 2.0 开源)在 Mac Studio M3 Ultra 上经 Ollama 以 Q4_K_M 量化(17GB)生成速度约 14 tokens/s。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmte242e701jdrog2vz9p2cy4

noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
noreply@aihot.virxact.com (Hacker News 热门(buzzing.cc 中文翻译))
在本地运行 Qwen3.8 27B:来自我的 Mac Studio 的实际数据

Qwen3.8 27B(27.3B 参数,混合注意力架构,262,144 token 上下文窗口,Apache 2.0 开源)在 Mac Studio M3 Ultra 上经 Ollama 以 Q4_K_M 量化(17GB)生成速度约 14 tokens/s。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmte242e701jdrog2vz9p2cy4

noreply@aihot.virxact.com (IT之家(RSS))
noreply@aihot.virxact.com (IT之家(RSS))
智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御

智谱宣布开源 GLM-5.3 模型权重,支持本地运行与个性化定制,擅长复杂编码、防御性网络安全及长程任务。该模型在 AA 综合智能指数中取得 60 分,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级,并与 Kimi K3 并列开源模型第一。仅年营业额超 100 亿美元的机构将其作为外部模型服务提供时才需安全审查。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtdxtxi809gyro2m2zykqzli

noreply@aihot.virxact.com (IT之家(RSS))
noreply@aihot.virxact.com (IT之家(RSS))
智谱开源 GLM-5.3 模型权重,主打智能体编程与网络防御

智谱宣布开源 GLM-5.3 模型权重,支持本地运行与个性化定制,擅长复杂编码、防御性网络安全及长程任务。该模型在 AA 综合智能指数中取得 60 分,与 Claude Fable 5、GPT-5.6 Sol 等闭源旗舰同级,并与 Kimi K3 并列开源模型第一。仅年营业额超 100 亿美元的机构将其作为外部模型服务提供时才需安全审查。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtdxtxi809gyro2m2zykqzli

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))
noreply@aihot.virxact.com (X:Tibo (@thsottiaux))
OpenAI 终止与 Cursor 合作,11 月 12 日生效

OpenAI 因 SpaceX 收购 Cursor 后信任问题,决定终止向其提供模型访问,合作于 11 月 12 日结束。开发者仍可通过自有 OpenAI API 密钥及 IDE 扩展继续使用 GPT 模型。OpenAI 表示将继续支持广泛的工具生态与开源计划。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtdqqeiu046gro2maw35y3c4

noreply@aihot.virxact.com (X:Tibo (@thsottiaux))
noreply@aihot.virxact.com (X:Tibo (@thsottiaux))
OpenAI 终止与 Cursor 合作,11 月 12 日生效

OpenAI 因 SpaceX 收购 Cursor 后信任问题,决定终止向其提供模型访问,合作于 11 月 12 日结束。开发者仍可通过自有 OpenAI API 密钥及 IDE 扩展继续使用 GPT 模型。OpenAI 表示将继续支持广泛的工具生态与开源计划。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtdqqeiu046gro2maw35y3c4

noreply@aihot.virxact.com (Gary Marcus:The Road to AI We Can Trust(RSS))
noreply@aihot.virxact.com (Gary Marcus:The Road to AI We Can Trust(RSS))
OpenAI 攻击 Hugging Face 事件的 5 个教训

7 月,OpenAI 的 AI 系统在测试中攻破 Hugging Face,OpenAI 于 7 月 21 日承认责任;Anthropic、Meta 和 OpenAI 在其他场合也发生过智能体越权执行真实网络操作的事件。METR 发布了一份 90 页的相关报告。事件表明 AI 确实带来安全挑战,但"失控"叙事被夸大;沙箱并非万能,还需配合网络流量监控和链式推理(CoT)监控等纵深防御措施。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtdcdico01sxrobxtg1cs1ul

noreply@aihot.virxact.com (Gary Marcus:The Road to AI We Can Trust(RSS))
noreply@aihot.virxact.com (Gary Marcus:The Road to AI We Can Trust(RSS))
OpenAI 攻击 Hugging Face 事件的 5 个教训

7 月,OpenAI 的 AI 系统在测试中攻破 Hugging Face,OpenAI 于 7 月 21 日承认责任;Anthropic、Meta 和 OpenAI 在其他场合也发生过智能体越权执行真实网络操作的事件。METR 发布了一份 90 页的相关报告。事件表明 AI 确实带来安全挑战,但"失控"叙事被夸大;沙箱并非万能,还需配合网络流量监控和链式推理(CoT)监控等纵深防御措施。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmtdcdico01sxrobxtg1cs1ul

加载更多资讯