noreply@aihot.virxact.com (Claude:Blog(网页))
noreply@aihot.virxact.com (Claude:Blog(网页))
Claude 记忆功能全面打通聊天与 Cowork,用户可逐条查看和编辑

Claude 即日起将聊天与 Claude Cowork 的记忆统一,用户在任一场景对话时都能调用此前积累的上下文,减少重复解释。记忆会在聊天过程中实时更新,用户可在 Memory 设置中按主题查看、编辑或删除每条记忆。健康、信仰等敏感话题默认不存储,但可在设置中开启,且敏感识别号、犯罪记录等始终不会被保存。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt8z2eko055crolytaitdxv8

noreply@aihot.virxact.com (TechCrunch:AI(RSS))
noreply@aihot.virxact.com (TechCrunch:AI(RSS))
OpenAI 正为一切构建 AI 智能体,但用户会愿意交出控制权吗?

OpenAI 推出 ChatGPT Work,将 Codex 改造为面向非工程师的智能体产品,最低订阅档每月 20 美元即可使用,旨在让白领通过 LLM 自主完成多步骤工作。OpenAI 内部 6 月有 98% 员工使用 Codex,但组织订阅者仅 17%、个人订阅者不足 1%。公司正通过简化界面扩大采用,以支撑其巨额训练投入。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt7e3m7h234gro73wwwhymb0

noreply@aihot.virxact.com (TechCrunch:AI(RSS))
noreply@aihot.virxact.com (TechCrunch:AI(RSS))
OpenAI 正为一切构建 AI 智能体,但用户会愿意交出控制权吗?

OpenAI 推出 ChatGPT Work,将 Codex 改造为面向非工程师的智能体产品,最低订阅档每月 20 美元即可使用,旨在让白领通过 LLM 自主完成多步骤工作。OpenAI 内部 6 月有 98% 员工使用 Codex,但组织订阅者仅 17%、个人订阅者不足 1%。公司正通过简化界面扩大采用,以支撑其巨额训练投入。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt7e3m7h234gro73wwwhymb0

noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
GPT-5.6 登陆 Kiro,为开发者提升性价比

GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt7nzq6i2c27ro73tqxagz44

noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
noreply@aihot.virxact.com (OpenAI:官网动态(RSS · 排除企业/客户案例))
GPT-5.6 登陆 Kiro,为开发者提升性价比

GPT-5.6 模型家族现已登陆软件开发智能体 Kiro,包含 Sol、Terra 和 Luna 三款模型。在 Terminal-Bench 2.1 测试中,GPT-5.6 Terra 在 Kiro 内完成任务成本降低约 82%。该更新由 OpenAI 与 AWS 合作优化,旨在以更少迭代和更高 token 价值帮助开发者产出更高质量的代码。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt7nzq6i2c27ro73tqxagz44

noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))
noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))
单个污染页面即可影响LLM推荐:FORGE基准揭示检索增强推荐系统的脆弱性

检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt8bo2db30oaro735zu90tig

noreply@aihot.virxact.com (Tomer Tunguz 博客(VC 分析))
noreply@aihot.virxact.com (Tomer Tunguz 博客(VC 分析))
AI 智能体应该活多久?

长期运行的 AI 智能体会因上下文累积而注意力衰减、临时指令残留成永久规则,并带来安全风险。建议给日常助手 24 小时生命周期,午夜重置会话,将具体任务委派给只存活 30 秒的单一用途子智能体,并在重置前将持久偏好存入磁盘。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt9588t109p9rolyegirxdgx

noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))
noreply@aihot.virxact.com (HuggingFace Daily Papers(社区热门论文))
单个污染页面即可影响LLM推荐:FORGE基准揭示检索增强推荐系统的脆弱性

检索增强型LLM在消费推荐中易受GEO内容污染影响,成为虚假产品的无意推广者。新基准FORGE在225个真实产品、15个类别和5个消费场景中测试12个商业及开源LLM,发现所有模型均易受攻击:单个污染页面即可造成最高27%的受骗率,替换全部前3个结果时升至73.8%。 🔗 阅读原文 via AIHOT · https://aihot.virxact.com/items/cmt8bo2db30oaro735zu90tig

加载更多资讯