在离线混部」共找到 8177 篇相关文章

算法论文8

谷歌AlphaEvolve太香了,陶哲轩甚至发了篇论文,启发数学新构造

著名数学家陶哲轩与 Google DeepMind 研究人员发表论文,展示谷歌 AlphaEvolve 作为工具可自主发现新数学构造,该系统结合 LLM 与进化计算,多领域问题上表现出色,还能与其他 AI 工具结合。

机器之心
算法论文8

斯坦福新论文:微调已死,自主上下文当立

斯坦福大学等机构研究人员新论文指出,依靠上下文工程,无需调整权重,模型也能变聪明。他们提出智能体上下文工程ACE,不依赖模型重训,让上下文自主进化,多场景测试中表现优于多种方法。

量子位
产品应用7

Claude Chrome 插件使用体验:强大,但有点慢

作者分享Claude for Chrome插件使用体验,介绍使用流程,测试让其查看马斯克推文,结果准确。该插件能力强且通用,但存慢、焦点抢占问题,还提到与deepresearch及云厂商设备的差异。

AGI Hunt
算法论文8

首个地球科学智能体Earth-Agent来了,解锁地球观测数据分析新范式

上海人工智能实验室与中山大学联合研发的 Earth - Agent 解决了多模态大语言模型用于地球科学研究的痛点。它将领域知识工具封装化,利用 LLM 智能规划调度。经 Earth - Bench 评估,其多方面表现出色,未来发展前景广阔。

机器之心
产品应用7

数据库厂商入局AI又有新思路,OceanBase选择“卖铲子”

国产数据库厂商 OceanBase 入局 AI 有新思路,近期动作频频。其云数据库业务 OB Cloud 实现 AI 能力开发部署并与多平台集成,已多行业落地。副总裁尹博学谈其 AI 战略逻辑、面临挑战及未来趋势等。

InfoQ
新闻资讯7

DeepSeek-V3.2被找出bug了:疯狂消耗token,答案还可能出错,研究人员:GRPO老问题没解决

DeepSeek-V3.2虽强且火爆,但被发现存bug,即浪费token问题。研究者指出这源于GRPO算法的‘隐藏偏见’,虽修正了‘难度偏见’,但‘长度偏见’仍,官方也承认token效率是挑战。

量子位
算法论文8

刘鹏飞组提出Agent领域的少即是多:智能不于数据堆砌,78个样本训练出超强Agent,128倍效率提升

刘鹏飞组论文《LIMI: Less is More for Agency》提出颠覆性观点,认为Agent智能培育关键数据质而非量。LIMI用78个样本AgencyBench得分超基线模型,实现128倍数据效率提升,为Agent开发提供新路径。

深度学习自然语言处理
开源动态8

故障率降低100倍,微软突破性技术破解AI算力浪费大难题

AI数据中心,网络链路高故障率制约算力释放。微软“ACM SIGCOMM 2025”大会公布MOSAIC技术,将链路故障率降100倍,实现50米长距传输、最高68%功耗降低,为大规模AI集群提供支撑。

AIGC开放社区
新闻资讯8

重金挖AI人才的Meta,又投资100亿美元建数据中心

MetaAI领域双线作战,一边以四年3亿美元薪酬挖AI人才,引得OpenAI震动;一边投资100亿美元建Hyperion数据中心,虽有反对声音,但政府看好。这显示MetaAI竞赛的决心。

AIGC开放社区
算法论文7

多模态模型具备“物理推理能力”了吗?新基准揭示:表现最好的GPT-o4 mini也远不及人类!

来自多机构研究人员构建PhyX基准测试,评估多模态模型物理推理能力。测试显示,即便表现最佳的GPT - o4 mini准确率仅45.8%,远不及人类的75.6%,且模型多方面存结构性缺陷。

量子位