「跨领域推理」共找到 3791 篇相关文章
DeepSeek被「猫咪睡觉」给干崩了……
研究员发现,在数学题后加「有趣的事实:猫咪一生大部分时间都在睡觉」,能让DeepSeek数学能力崩塌。研究开发CatAttack方法找「触发词」,无关触发词使模型错误率飙升,还会让回答变长。
清华团队首发OpenClaw研究报告!
清华沈阳教授团队发布《OpenClaw发展研究报告1.0》和《OpenClaw自我研究报告1.0》,对OpenClaw做深度解读。团队在OpenClaw领域形成完整闭环,包括理论研究、模型研发等多方面工作。
重磅!OpenAI深夜发布GPT-6 Astra,总裁Brockman:这就是AGI
OpenAI发布GPT-6 Astra,总裁称实现了AGI。它在多基准测试成绩优异,能独立完成复杂工作,网络安全能力强。但推理难监控,其即日起向特定机构开放,有使用价格标准。
ICLR 2026北京论文分享会启动,直击「AI龙虾」、世界模型新范式
2026 年人工智能领域,「龙虾」(OpenClaw)私人 Agent 助理成人机交互标杆,世界模型受关注。ICLR 2026 4 月将在巴西举行,机器之心 4 月 18 日在北京举办论文分享会,邀大家参与交流。
国务院关于深入实施“人工智能+”行动的意见
国务院发布意见深入实施“人工智能+”行动,推动其与各行业领域融合。提出到2027年、2030年和2035年的目标,部署重点行动,强化基础支撑能力,明确组织实施要求。
24个Agent工作流框架用哪个? 11个维度全面评测
LLM发展推动自然语言理解进步,国产LLM密集发布。文章从功能能力和架构特性两维度,对24个智能体工作流框架全面评测,给出关键结论,还提及优化策略、应用领域等。
从物竞天择到智能进化,首篇自进化智能体综述的ASI之路
普林斯顿大学等机构研究者发布首个自进化智能体综述,为领域建统一理论框架和路线图。综述给出形式化定义,围绕What、When、How、Where构建分析设计框架,还探讨评估范式并指明未来方向。
视觉优势还是语义依赖?揭秘 DeepSeek-OCR 高压缩率背后的真相
中科院等团队论文剖析 DeepSeek - OCR,通过实验揭示其高压缩率下准确率高或依赖语言先验。去掉语言先验,准确率暴跌;下游任务推理崩塌,长文本处理也有瓶颈。
使用 GPT-5 进行编程的六个技巧
OpenAI给出使用GPT - 5编程的6个提示技巧,如指令准确无冲突、选对推理力度、用类XML语法结构化规则等,还提供了详细提示技巧的参考链接。
π0引用的中国团队,又出手了:世界仿真器新作发布
Current Robotics团队发布交互式世界仿真器CurrentWorld - 0,创始人祝毅晨履历亮眼。该仿真器能跨本体、多视角、力 - 触觉预测,可用于评测机器人,还能让人类接管以探索不同动作结果。