PDDL规划器」共找到 576 篇相关文章

开源动态8

OpenAI深夜开源HealthBench,60个国家合力开发5000段真实对话

今天凌晨1点30,OpenAI开源医疗大模型测试评估集HealthBench。其5000段核心测试对话由60个国家/地区的262名医生打造,采用多轮对话测试。测试显示大模型在医疗保健领域表现显著提升,还介绍了其构建及评估等情况。

AIGC开放社区
开源动态7

又一安全圈爆火的开源项目,已经1.66万Star!

现在大家爱用代码AI客户端干活,但碰到安全和逆向任务时,AI易懵圈,因工具散落、经验没沉淀。开源项目`reverse-skill`可给AI装“安全研究导航仪”,支持多种AI编码客户端,有诸多功能特性。

开源先锋
推荐文章8

Lilian Weng:Harness才是模型自我迭代的现实起点和关键,而不是直接重写权重

Thinking Machines Lab联合创始人Lilian Weng发文指出,实现AI递归式自我改进(RSI),设计围绕模型的执行系统“Harness”才是现实起点。文中详述Harness设计模式、优化路径,也指出自我改进面临的瓶颈。

AI寒武纪
新闻资讯7

Fable 5回归全网抓紧测!发现GLM-5.2更香了,价格只有1/39

Claude Fable 5消失19天后全球再上线,7月1 - 7日Pro等订阅用户可用,但额度受限。它实力强但贵,与多模型对比表现优,远程工作能力突出。不过使用限制变多,安全分类易误伤。

量子位
算法论文8

“这个怎么组装?”一句无害的问题,如何让AI产生危险输出

Amazon团队发现全新威胁模型“视觉排他性”,提出MM - Plan框架,通过强化学习训练智能体自动发现攻击策略。实验显示其对Claude 4.5 Sonnet和GPT - 5攻击成功率可观,代码和数据集已开源。

深度学习自然语言处理
开源动态8

7300 人收藏的 PraisonAI,5 行代码即可部署 24 小时 AI 智能体团队!

PraisonAI是开发者Mervin Praison开源的全功能多智能体运行框架,有7.3K+ GitHub星标。它开发门槛低,支持100+大模型,具备完整智能体能力,还能可视化编排、一键接入聊天平台。

开源星探
算法论文7

世界模型开始做减法?LeCun团队和清华团队给出两种思路

近期,Yann LeCun团队的LeWorldModel用简洁JEPA实现从像素端到端训练世界模型,降复杂度且验证潜在空间物理刻画能力;清华团队的Fast - WAM探讨推理阶段显式生成未来必要性,给出高效替代路径。

机器之心
算法论文8

将注意力旋转 90 度!今天,Kimi 的「注意力残差」火了

Kimi团队发布技术报告Attention Residuals,用依赖输入的注意力机制取代标准深度递归,解决传统残差连接的信息稀释和隐藏状态爆炸问题。实验显示其有计算优势,下游任务表现佳。

机器之心
算法论文8

华为发布业界首个扩散语言模型Agent,部分场景提速8倍!

华为等团队研究发现,把Agent“底座”换成扩散式大模型(DLLM),执行速度提升30%以上,部分复杂任务效率达传统AR模型8倍。其优势源于生成范式,可重塑Agent设计。

量子位
新闻资讯7

中国AI芯片如何破局?这家公司重注推理芯片

2月3日,云天励飞董事长陈宁在战略前瞻会表示要All in AI大算力推理芯片,打造“中国版TPU”。他认为2025 - 2035年是推理芯片高光时刻,还介绍了公司技术壁垒、差异、战略及生态等内容。

芯师爷