实验研究」共找到 2885 篇相关文章

开源动态8

准确率92.7%逼近Claude 3.5、成本降低86%,开源代码定位新神器LocAgent来了

OpenHands 等团队发布 LocAgent,这是用于代码定位的图索引 LLM Agent 框架,准确率达 92.7%。它把代码库解析成图,提供工具接口,经实验效果出色,开源微调模型降本增效,还能提升问题解决率。

机器之心
算法论文8

比Sora更疯狂!英伟达AI让机器人「做梦」修炼,无师自通直接上岗

英伟达新研究项目DreamGen用视频生成模型让机器人在神经网络生成的「梦境世界」自主探索学习。它能让机器人掌握新动作、泛化到新环境,合成数据暴涨333倍,还引入DreamGen Bench用于视频生成基准。

新智元
推荐文章8

刚刚!北大校友Lilian Weng最新博客来了:Why We Think

北大校友Lilian Weng更新博客《Why We Think》,回顾利用测试时计算的研究进展,探讨让模型“思考更久”的方法。文中介绍了思维链、潜变量建模等策略,还提及多种提升生成质量的策略,如并行采样与序列修订,以及强化学习提升推理能力等内容。

机器之心
产品应用8

OpenAI推出云端编程智能体Codex,进一步推动软件工程领域变革

OpenAI昨夜发布研究预览版Codex,一款集成在ChatGPT中的高级编码智能助理。它基于codex - 1模型,支持多种编程语言,有深度代码分析等核心功能,还有codex - mini - latest API版本,或重构软件开发行业。

AI工程化
推荐文章9

更聪明的AI就能随心所欲控制人类?OpenAI科学家笑了:你比猴子聪明,能让猴子听话吗?

本文是科技媒体The Information对OpenAI研究科学家Noam Brown的深度访谈,围绕AI Agent、推理模型、AI安全、OpenAI研发战略展开,披露了Hugging Face多Agent事件细节,分享了诸多反直觉的前沿技术观点,信息密度极高。

AI科技大本营
算法论文8

答对了却没看图?EASE给多模态RLVR装上「视线校正器」

强化学习与可验证奖励提升视觉语言模型推理能力,但存在答案奖励只知对错、不知证据区域问题。哈工大等团队提出EASE,把标注证据区转为目标分布,监督空间注意力,推理无额外标注,实验成绩优异。

机器之心
产品应用7

基于Agent的SGLang Diffusion Kernel优化实践:Qwen-Image、FLUX.2和视频模型

本文记录基于Agent完成Qwen-Image、FLUX.2、Wan和SANA Video优化的过程,包括定位问题、写Kernel及遇到的坑。介绍SGLang Diffusion Kernel结构,分析数值敏感原因,展示各模型优化实践、无收益实验及验证流程。

GiantPandaLLM
开源动态7

完全复刻火爆全网的机器鸭

这是对Pollen Robotics Microduck的第三方复刻研究,从官方公开的MJCF仿真模型反推出装配图、爆炸图和可直接导入CAD的装配体。该机器鸭软件开源、硬件不开源,但已有信息足以还原装配关系。

GitHubStore
算法论文8

ACL 2026 | 腾讯混元Agents工具学习新范式

腾讯混元团队在 ACL 2026 Findings 发布的 ToolCPT 指出,Agent 用不好工具病根在预训练。它从真实代码挖工具,写说明书,融入预训练,实验显示能有效提升工具运用能力,但也有局限和成本。

PaperAgent
新闻资讯7

全球首例!科学家将腿部肌肉线粒体注入盲人眼球,瞳孔光反射短暂恢复

对于视神经严重受损致盲,临床缺有效修复手段。美国研究人员从失明女性腿部肌肉提取线粒体注入其双眼,初步验证了自体线粒体眼内移植的安全性,患者眼部有生理变化,但未恢复视力,实验疑问多。

DeepTech深科技