超参数调优」共找到 2664 篇相关文章

算法论文8

DeepSeek-V4蓄势待发!梁文锋署名论文或开启第二个DeepSeek时刻

据报道,DeepSeek将于2月发布新一代旗舰模型DeepSeek V4,其编程能力或Claude和GPT系列。最新论文提出Engram条件记忆机制,分离死记硬背与逻辑推理,揭示新稀疏性分配定律。

AIGC开放社区
开源动态7

15.1k,谷歌Notebook LM本地开源替代!

Open Notebook是开源、本地化且重隐私的Google Notebook LM替代方案。它支持16家供应商,能整理多模态内容、生成专业播客,在多方面比Google Notebook LM更具优势。

PaperAgent
新闻资讯8

深扒ICLR「泄露门」:AI学术历史上最魔幻的61分钟,或许没有之一

2025年11月27日,ICLR 2026发生严重安全事故,1万篇论文评审信息泄露。攻击者利用OpenReview API漏洞获取信息,引发轩然大波。此外,Pangram Labs报告显示21%审稿意见为AI生成,暴露出学术评审诸多问题。

新智元
开源动态8

又一个Kimi K3下周开源!Qwen3.8-Max编程、办公、科研都能自己干了

Qwen3.8-Max是Qwen家族迄今最强模型,2.4万亿参数,下周将开源权重。它在多项基准测试中表现出色,能连续自主工作数天,在编程、办公、科研、长周期任务、多模态等方面全面提升。

AIGC开放社区
算法论文8

这家公司,“杀死”了他们的 AI 应用

脸谱心智(FaceMind)虽未关停「叠叠社」AI 应用,但开始押注底层世界模型研究。其论文提出 Looped World Models,带来 100× 参数效率提升,强调 AI 可靠更深内部推演获得能力,指出只做应用不够。

特工宇宙
新闻资讯7

The Batch:926|AI 数据中心“脱离电网”

Meta和OpenAI等科技公司正建私有发电厂,为AI数据中心供电,绕过电网监管。项目推进快,有的用非传统发电设备。此举反映AI算力扩张能源供应速度,有稳定电价作用,但也带来排放问题。

DeeplearningAI
新闻资讯7

郎园 Station Pet&Me|园区宠物友好再升级,以爱筑就人宠共生小天地

首创•郎园Station位于朝阳区东坝,是北京国际化潮流文化地标,2025年园区年度客流量450万人次。产业上,它运营AIGC视听产业创新中心,携手多家企业构建全产业链生态,影视后期制作企业占国内60%份额。

郎园Station
新闻资讯7

算力不再稀缺?中国AI芯片供给出现反转

过去中国AI产业常焦虑算力不足,如今国产AI芯片进入集中交付阶段,自给率提升。伯恩斯坦测算,国产化率有望从2023年约17%提至2027年约55%。产业进入新阶段,竞争从“拼参数”转向“拼体系”。

芯师爷
新闻资讯7

李飞飞之后,何恺明弟子再拿AI大奖!清华校友等28位Fellow上榜

「AI2050」奖学金入选名单公布,目标是确保AI普惠、向善,获奖总额1800万美元。28位学者聚焦三大方向获资助,包括构建AI科学家系统等。7位高级Fellow和21位早期职业Fellow各有研究项目。

新智元
新闻资讯7

全球DRAM第一,换人了

据多家市场调研公司报告,今年第一季度SK海力士登顶全球DRAM市场,市占率36%三星、美光。其登顶早有预期,借AI浪潮HBM需求火热。美光、三星也在HBM领域奋起直追。

芯师爷