「进化计算」共找到 1269 篇相关文章
DeepSeek Harness和V4 Pro正式版同时重磅上线,一手实测:DSH更像是AI操作系统
DeepSeek V4 Pro正式版0813上线,升级Agent能力,网页、API、app皆可用。DeepSeek Harness亮相并开源,基于“一切皆插件”理念。V4 Pro跑分部分能力突出但价格将涨,其实际表现待更多测试。
清华发布智能体社会AgentSociety第二代:让社会科学研究真正「跑起来」
AgentSociety²是清华团队推出的社会科学研究新工具,让AI扮演研究助手和实验参与者角色。它打通研究断点,实现从「社会模拟」到「可执行社会科学」的转变,还构建工作流、创新实验环境和智能体设计。
王云鹤眼中的Harness:复杂优化问题,AGI灵魂争夺之战
王云鹤在知乎文章中探讨Harness Engineering,指出Agent=Model+Harness,多模型配合能提升Agent能力。还分析Harness存在的必要性,认为它是复杂优化问题,关乎AI“灵魂”之争。
超越VLA与世界模型,银河通用发布LDA,全谱系数据跑通Scaling Law
近期具身智能领域竞争激烈,银河通用联合多机构发布 LDA-1B 模型,能统一利用各类具身数据。它在基准测试中表现出色,代码已开源,还解决了数据格式、质量等问题,实战效果也很突出。
OpenClaw代码越改越崩?新研究EvoClaw揭示:Agents持续开发成功率仅13.37%
USC邓港大等联合发布评估基准EvoClaw,揭示AI在持续开发场景下表现不佳,成功率仅13.37%。研究还指出当前评测易高估AI能力,提出DeepCommit重构演进历史,分析各模型在持续演进中的局限与问题。
感知、控制与数据:ICRA 2026 中国企业报告的三个交汇点
ICRA 2026期间,速腾聚创等六家中国企业分享机器人领域进展。他们关注感知底层基础、接触‘最后一毫米’问题、数据与模型关系,且技术路径和产品侧重有差异,具身智能注重工程落地和系统能力建设。
Markdown要凉…卡帕西也站HTML了
Anthropic工程师Thariq发文呼吁抛弃Markdown,力推HTML,认为其在信息密度、可读性等方面优于MD。卡帕西也认可此观点。不过HTML存在费token、版本控制难等问题,文中也给出了应对建议。
叫板华尔街之神!诺奖得主在谷歌眼皮底下组队炒股,CEO亲自叫停
AlphaGo之父Hassabis曾在谷歌眼皮底下拉20个顶尖研究员训练高频交易AI,想挑战华尔街量化之神,与贝莱德探讨合作。后因谷歌CEO叫停,项目停摆。不过如今AI+金融正加速发展。
已证实!清华姚班陈立杰全职加入OpenAI,保留伯克利教职
据机器之心求证,清华「姚班」校友、伯克利助理教授陈立杰已全职加入 OpenAI 开展研究,同时保留伯克利教职。他是理论计算机科学顶尖青年学者,学术成就卓越。
告别盲选LLM!ICML 2025新研究解释大模型选择的「玄学」
弗吉尼亚理工大学研究团队提出 LensLLM 框架,基于 PAC - 贝叶斯泛化界限揭示 LLM 微调性能“双相演进”,可精准预测微调性能、大幅降低计算成本,为 LLM 选型提供新工具。