「物理定律发现」共找到 1519 篇相关文章
AI点外卖哪家强,美团LongCat团队做了个全面评测
美团LongCat团队发布贴近生活场景的大模型智能体评测基准VitaBench,以三大高频生活场景为载体,构建含66个工具的评测环境。评测显示现有智能体与应用需求差距大,该基准已全面开源。
具身智能算法哪家强?RoboChallenge见真章!全球首个大规模真机算法评测平台来了
Dexmal原力灵机联合Hugging Face推出RoboChallenge项目,它是全球首个大规模、多任务的真实物理机器人基准评测平台。该平台创新采用‘远程机器人’架构,有30项真实任务基准集等,已验证多种算法表现。
OpenAI奥特曼:能被ChatGPT消灭的工作不是真正的工作
OpenAI奥特曼在访谈中分享对AI与工作的思考,还谈及GPT - 6进展、ChatGPT发展、AGI设想等。他认为能被ChatGPT消灭的工作不是真正的工作,还探讨了AI带来的变革和挑战。
一篇大模型Agentic框架到应用最新综述
这是首篇系统拆解“大模型Agentic推理框架”的综述,不聊训练,只聚焦如何把LLM组织成会思考、协作、调工具的Agent,横跨科学发现、医疗、软件工程、社会经济模拟四大战场,给出统一语言、视角和评测。
逆势降本:云上数据平台年复削减30%的治理实践
本文是朴朴科技对云上大数据平台成本治理的阶段性总结。其开展成本治理已三年,分“降本增效”三部曲:成本发现与分析、成本优化与控制、体系化治理构建,分享经验,助力同行开展相关工作。
从社区数据出发,再看大模型开源开发生态全景与趋势
蚂蚁开源先后在527蚂蚁技术日和外滩大会发布大模型开发生态开源项目全景图1.0和2.0版本。2.0版更新评估方法,呈现生态新变化,还分析技术趋势、开发者分布,提及项目进出情况及TensorFlow衰落等。
北大数学家终结50年猜想!一只蝴蝶翅膀,竟难倒菲尔兹奖得主
历时50年的「十杯马提尼猜想」被北大Lingrui Ge等学者证明。该猜想连接量子物理和数学,为解「霍夫施塔特蝴蝶」之谜。他们基于「全局理论」找到对偶方程,成果发表在arXiv,还攻克另外两个关键问题。
ACL 2025杰出论文!用能力显著向量让大模型下游任务性能预测更精准
上海人工智能实验室与复旦大学联合研究成果《Capability Salience Vector》获ACL 2025杰出论文奖。提出能力显著向量(CSV)解决验证损失与下游任务能力脱节问题,实验验证其提升了下游任务表现可预测性。
实测Perplexity Pro平替模型,免费开源仅4B
一款仅4B大小的开源模型Jan-v1,声称能平替Perplexity Pro,且完全免费、支持本地部署。实测发现,它在检索增强生成、上下文深度分析等能力上表现不错,入门级显卡即可带动本地部署。
别焦虑!不会用AI也不会被淘汰,工程师老哥实测各类工具:10倍生产力神话太夸张了
工程师科尔顿·沃奇实测Claude Code等AI开发工具后发现诸多问题,如难以理解大型代码库上下文、跟不上标准等。他认为‘10倍生产力’是神话,AI需工程师引导,大家不必因AI而焦虑。