「科学任务」共找到 2206 篇相关文章
AI能否独立开展科研?ASI-Bench为科学自主性建立评测标尺
ASI-Bench是衡量AI系统科学自主性的基准测试,由多机构联合开发。它能测试AI通用智能、创新性和执行力,通过信息梯度设计,让模型在不同指导量下完成科研任务,结果显示当前AI离自主科研有明显距离。
斩获6.1 star,再见Crontab!这款开源定时任务管理系统让运维更高效
Gocron是基于Go语言的轻量级定时任务管理系统,可替代Linux Crontab。它有可视化界面、秒级调度等功能,适用于自动化运维等场景,通过Docker一键部署,比同类项目更具优势。
Demis Hassabis:AGI 还缺什么,智能体到底行不行,下一个科学突破长什么样
Google DeepMind CEO Demis Hassabis 做客直播,探讨当前 AI 范式距 AGI 差距、智能体水平、科学突破模式等话题。指出当前范式或需关键突破,记忆方案待优化,AlphaGo 技术复活,还给出创业建议。
拆解、对比与优化:LLM工具智能体的五种任务规划与执行模式
文章探讨了大语言模型驱动的AI智能体的五种任务规划与执行模式,包括ReAct、Plan-and-Execute、静态Workflow、Workflow+局部智能、模块化的分层规划,分析其优缺点、适用场景,还给出优化方法。
斯坦福宣布重磅AI战略重组:将HAI与数据科学合体,李飞飞升任校长顾问
斯坦福大学宣布将HAI与数据科学计划合并,新机构仍称HAI。李飞飞卸任联席院长,任校长AI特别顾问。新机构将围绕跨学科发现、教育变革、社会影响研究开展工作,强调开放原则并拓展国际合作。
CAIR开源发布超声基座大模型EchoCare“聆音”,10余项医学任务性能登顶
2025年9月17日,CAIR开源发布超声基座大模型EchoCare“聆音”。它基于超450万张影像数据集训练,在10余项医学任务测试中表现卓越。首创结构化对比自监督学习框架,为AI医疗应用提供创新路径。
Nature | 清华&芝大团队:AI让个体科学家“加速”,却让科学边界“收缩”
2026年1月14日,清华与芝大团队在《Nature》发表研究,通过分析4100余万篇论文,揭示AI融入科研的“双重效应”:它是个人科研“加速器”,让使用者产出和职业发展提升;也是科学整体“收缩器”,使集体知识疆域收窄。
OpenAI 直播摘要:AI 将推动科学进步,个人 AGI 即将到来,未来将非常光明
OpenAI 直播中,Sam Altman 和 Jakub Pachocki 透露重磅信息,称个人 AGI 即将到来,未来光明。公布通向超级智能时间表,对深度学习有信心,谈及基础设施扩张、公司架构变化等,还预测科学发现进程。
让GUI Agent不再「边做边忘」:快手、浙大提出MemGUI-Agent,攻克长程GUI任务
手机GUI Agent在长程任务中易遗忘关键信息,浙江大学APRIL实验室和快手主站技术部提出MemGUI - Agent,核心是ConAct,将上下文管理变为Agent动作,还开源MemGUI - 3K数据集,模型在评测基准取得佳绩。
1052篇文献!上海AI Lab发布科学LLM综述:从数据基础到Agent前沿
上海AI Lab主导,25家研究机构共同梳理270+训练集、190+评测集,提出科学数据分层框架与智能体闭环科研新范式。还介绍了模型演进、数据情况、评估基准等,指出数据缺陷并展望走向科学家智能体的三步。