「蒙特卡洛搜索算法」共找到 955 篇相关文章
清华突破「光毒性」难题,活体显微进入无扰观测时代
清华大学团队研发出LF-denoising自监督去噪算法,可在超低光毒性下实现长时间高保真三维亚细胞成像,突破了长时间活体成像的光毒性限制,为多领域研究提供新工具。
强化学习没作用?人大DelTA精准识别关键token,推理正确率大幅上升
人大高瓴研究团队提出DelTA算法,不依赖经验为强化学习目标中每个token算最优权重。实验显示它适配主流强化框架,在多任务上提升base模型效果,还能让训练更稳定。
让两个大模型「在线吵架」,他们跑通了全网95%科研代码|深势发布Deploy-Master
科学计算领域开源软件多,但多数无法直接运行,制约可用性。Deploy - Master 针对此开发,通过搜索筛选工具、双模型博弈构建,将部署成功率提至 95%以上,为 Agentic Science 提供行动基座。
你聊得很开心的AI女友,背后却是被当做耗材的肯尼亚小伙们。
肯尼亚小伙迈克尔应聘工作后,成了伪装AI的陪聊员。工作严苛,还得忍受不适内容。公司借此收集数据训练算法,他越努力就越快被替代,成了AI时代的‘耗材’。
Google推出 AI 科学家:自动编写专家级代码,40个新方法碾压人类 SOTA
Google新发布的AI系统能编写科学软件、发明新方法,结合大语言模型与树搜索技术。在生物信息学、流行病学等多领域超人类最优水平,引发网友对科研影响的讨论。
复旦提出自适应Reasoning方法ARM,“能屈能伸”
复旦提出自适应Reasoning方法ARM,解决LLM‘过思考’问题。ARM内置四种解题策略和三种决策模式,还搭配Ada - GRPO算法,在23个数据集测试中表现出色,省token、提速度且准确率高。
爆冷!字节Seed 在CCPC 决赛只做出一道签到题,而DeepSeek R1 直接挂零?
第十届 CCPC 举行,字节 Seed 携 Seed - Thinking 参赛,结果意外,仅做出一题,DeepSeek R1 挂零。不同模型架构表现差异不大,暴露出大模型做算法题短板,推理模式表现更好。
曝苹果拟收购Perplexity AI,人才一并拿走
据彭博社消息,苹果并购负责人等最高决策层讨论过收购Perplexity AI,目的是招揽人才及为AI搜索引擎做准备。目前处于早期阶段,双方未回应。苹果也考虑合作,还在与Meta竞争招揽人才。
内存减6倍、精度0损失,推理提速8倍!谷歌新技术震撼了AI圈
Google Research团队推出TurboQuant技术,能将KV缓存6倍压缩、无精度损失,推理速度提升8倍,解决内存瓶颈问题,为大语言模型应用扫清障碍,引发业界关注,还致存储芯片巨头股价大跌。
刚刚,Gemini攻克「宇宙弦」终极难题!AI科学家最优雅解法震撼物理学
Google Research团队用Gemini Deep Think + 树搜索框架,攻克理论物理领域宇宙弦引力辐射功率谱精确解析解难题。AI探索600条候选路径,找出6种解法,最优雅的格根鲍尔方法让物理学家拍案叫绝。