「开放域RL」共找到 866 篇相关文章
李飞飞刚发Atlas,中国开源“同款”已抢跑半年?
9月2日,李飞飞团队发布多模态世界模型Atlas,引发好评。而国内影溯3月就开源InSpatio - World模型,有类似能力。影溯登顶权威榜单,还联合启动大规模空间智能3D数据开放计划。
OpenAI Astra发布在即,全自动网络攻防能力已突破天际!
OpenAI即将发布的模型Astra,在内部评测中获ExploitBench满分,还发现两个零日漏洞。它能力远超上一代GPT - 5.6 Sol且更听话。不过为安全考虑,OpenAI部署监控,还放慢其研究速度。
全公司禁用Claude Code,CEO放狠话逼宫A社!
Shopify CEO Tobi Lütke考虑禁止公司使用Claude Code,除非其支持读取AGENTS.md和.agents/skills。Claude Code团队称正在改进,但坚持自有体系。AGENTS.md获众多工具支持,A社是相关基金会创始方,Claude Code却未原生支持。
Python逆天改命!开源Hermes首次击败OpenAI Codex
纯Python写的开源项目Hermes Agent,在11项基准测试中以6:5战绩击败OpenAI用Rust写的Codex。它通过三大工程优化,将启动时间从701ms降至258ms。这表明在AI Agent领域,架构比语言性能更重要。
会挖0-day漏洞!凶残版Claude官宣却不让用,微软苹果齐下场“看守”,Anthropic到底在图什么?
Anthropic官宣Mythos Preview,却未将其放给普通人用,而是塞进防御联盟Glasswing。Mythos在漏洞发现和利用上能力超多数人类,Anthropic怕其引发风险,先将它组织进防守体系,还试图占据‘负责任的frontier lab’位置。
生成式推理再排序,可能会是LLM4RecSys的新突破口吗?
Meta AI研究者尝试把推理模型引入推荐系统再排序阶段。论文通过监督微调等赋予模型推理能力,超LLM4Recsys标杆。中期内化物品语意ID,生成推理路径,推理赋能再排序,披露重排序提升空间。
闭门小局:OpenClaw之后,有哪些创业机会真正值得去做?
OpenClaw带起Agent热潮,创业者不应只关注用其做产品,更要关注背后新生态位。3月21日下午,Founder Park搭建线下闭门交流场域,探讨支付、协议等方面创业机会。
告别大模型“失忆”!人大开源MemSifter:轻量代理先思考再回忆,搞定长时记忆
当前大语言模型在长周期任务中,长时持久记忆管理陷入“精度不够”和“成本太高”的两难困境。中国人民大学团队提出MemSifter框架,将记忆检索工作外包给轻量级代理模型,在8个权威测试中超越现有方案,且已开源。
Kimi推出Kimi Claw,原生集成OpenClaw
Kimi.com原生支持OpenClaw,推出新功能Kimi Claw,可在浏览器标签页运行且全天候在线。有ClawHub访问权限、40GB云存储空间等特性,现开启Beta测试,对特定等级会员开放。
Open Responses 规范实现智能体式 LLM 工作流的统一
OpenAI发布Open Responses开放规范,获Hugging Face等支持,为智能体式AI工作流制定统一标准,减少API碎片化,支持多模态输入等,引发行业对厂商锁定和生态成熟度的讨论。