「算法与神经网络」共找到 6864 篇相关文章
Nature子刊:太空中建数据中心,无限能源,浙大首次证实可行!
浙江大学和新加坡南洋理工大学新研究探索太空碳中和数据中心可行性。太空有太阳能与散热优势,提出轨道边缘和轨道云数据中心方案,还建立全生命周期碳效率评估体系,虽有挑战但前景好。
刚刚,奥特曼亲赴,韩国「举国」投靠!
奥特曼飞赴首尔与韩国总统、两大财阀巨头会晤,三星、SK与OpenAI达成战略合作伙伴关系,将增加先进存储芯片供应、扩大数据中心容量,助力韩国AI发展,也加速Stargate计划落地。
马斯克删除xAI「研究员」职位引爆网络!LeCun怒批:如此暴力将扼杀创新
马斯克宣布取消xAI「研究员」头衔,强调「工程师」重要性,引发与LeCun的激烈争论。LeCun认为研究与工程在多方面有区别,混淆会扼杀创新,争论也反映出AI企业不同组织架构模式。
LLM 长文本处理的“不可能三角”?我们用 E2LLM 把它破解了!
长文本理解与推理是LLM的难题,存在效果、速度、兼容性的“不可能三角”。蚂蚁集团和华东师范大学提出E2LLM新范式,实现三者平衡,在效果和效率上表现出色,开启长文本处理新篇章。
一篇LLM × DATA技术最新系统性综述
上交大、清华等联合发表综述,探讨LLM与数据管理双向关系,分析LLM不同阶段数据管理技术与挑战并给出方案,还讨论了LLM在数据管理任务中的应用进展,为研究和实践提供指导。
超长 Agent 任务如何不崩盘:Claude Code 上下文管理机制深度拆解。
文章深度拆解Claude Code上下文管理机制,包括七类上下文、预算与告警、加载、卸载机制等。指出其是分层缓存与多级预算管理系统,还为长任务Agent开发者提供了管理启示。
劝人退学、庆幸没读博浪费5年,26岁DeepMind“传奇人物”:大厂内部分散,AI研究很低效
26岁的Neel Nanda是DeepMind“传奇人物”,他涉足机械可解释性研究四年成果丰硕。在与主持人对话中,他分享经验,认为大厂内部分散、AI研究低效,还谈及读博、AI安全研究、公司决策等看法。
Hermes Agent 发布更新 Herald:实时语音 + Agent 之间可以互相通信了
Hermes Agent 更新到 v0.20.0 代号 Herald,增加实时语音对话与唤醒词,可验证引用来源可信度,集成签名Webhook,支持代理到代理协议,还有性能与安全方面更新,顺应新 Agent 发展趋势。
没想到,又一个Code Agents瓶颈,被美团&上交大彻底撕开了~
AI写代码能力提升,但打分方法僵化且成本高。上交大与美团论文提出新基准PRDBench,让AI出题人审核,还训练裁判PRDJudge,提升打分准确率与稳定性,促使AI学会‘看懂需求’。
京东广告大模型实战:GRAM 架构如何在 50ms 内完成生成式推荐?
流量红利见顶,广告营销转型遇挑战。京东张泽华在大会公开应对方案,介绍 GRAM 架构,实现意图与商品语义对齐,控制推理时延,解决冷启动等问题,还分享算法与知识工程实践。