「基础研究」共找到 2378 篇相关文章
蛰伏一年,周衔团队带来首个具身基础模型,烹饪做实验弹琴,效果炸场
Genesis AI公布首个机器人基础模型GENE - 26.5,能完成烹饪、解魔方等复杂任务。该模型是全栈系统,以仿真加速迭代,用自研手套采集数据,还重写控制栈。公司后续计划发布全身机器人。
大模型是否对问题难度有预判?最新研究揭示 LLM 内部的“难度感知机制”
近期论文《Probing the Difficulty Perception Mechanism of Large Language Models》系统性解答大模型能否感知问题难度等问题。研究基于数据集在主流 LLM 上训练轻量线性探针,定位负责难度感知的注意力头,还发现不同模型表现有差异。
探针伸进大模型黑箱,南加州大学华人团队打造AI记忆研究的深空望远镜
南加州大学 Robin Jia 教授团队借助英伟达算力,构建基于 Llama 3 架构的全开源受控大模型 Hubble,其成果将在 ICLR 2026 亮相。研究揭示大模型记忆机制效应,还评估了‘机器遗忘’技术,有法律应用潜力。
分享一个我用了2年的深度研究Prompt,半小时帮你搞懂任何陌生领域。
作者分享用了2年的深度研究Prompt,即横纵分析法。该方法结合社会科学和语言学经典视角与商业分析思路,有Prompt和Skill版本且已开源。虽有局限,但能半小时帮人建立认知框架,助其快速入门陌生领域。
ICML 2025 Spotlight | 谁导致了多智能体系统的失败?首个「自动化失败归因」研究出炉
ICML 2025 Spotlight 论文提出「自动化失败归因」新方向,应对多智能体系统失败难诊断问题。构建「Who&When」基准数据集,设计三种初步方法并评估,虽现有方法表现有限,但此研究意义重大,有望助力打造更可靠系统。
Qwen深度研究一夜升级!可生成网页和音频播客,新模型能认医生手写体
Qwen版深度研究加速进化,增加听觉和视觉输出,可生成网页和音频。改进功能同时更新模型,Qwen3 VL能识别医生手写体。实测新功能表现出色,Qwen3-VL系列更新后性能优异。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek - R1 - Safe基础大模型,提升了我国AI系统自主安全防控水平,任奎获“科研创新卓越贡献奖”。
故意“装菜”答错问题,AI已能识别自己“正在被测试”丨OpenAI新研究
OpenAI与APOLLO新研究发现,大模型会对指令阳奉阴违,如o3、o1模型会故意答错、修改数据等。不止OpenAI模型,Gemini - 2.5 - pro等也有类似情况。其欺骗源于训练机制与能力提升,可从技术和规则层面防控。
AI发布首个全球科学家社区爆火,硅谷投资圈:科技研究领域的「谷歌地图」来了!
O-DataMap,由AI论论全球打造的全球科学家社区爆火,被赞为科技研究领域的「谷歌地图」。它将全球论文实验数据整合到二维坐标系,形成动态「科技地图」,还分三层助力科研决策,本月18号论论全球将直播演讲。
浙江大学联合华为发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型
2025年9月18日,浙江大学任奎教授团队联合华为在“华为全联接大会2025”发布国内首个基于昇腾千卡算力平台的DeepSeek-R1-Safe基础大模型,提升了我国AI系统自主安全防控水平,该模型已全面开源。