全栈式方法」共找到 1961 篇相关文章

算法论文8

模型遗忘不代表记忆抹除!首次系统发现「可逆性遗忘」背后规律

研究人员发现大语言模型遗忘并非简单信息删除,可能藏于内部。他们构建表示空间诊断工具,区分可逆与不可逆遗忘,揭示真正遗忘是结构抹除。还在多种法、数据集和模型上实证,得出系列结论。

新智元
新闻资讯7

马斯克的xAI以1130亿美元估值,出售3亿美元股权

金融时报消息,马斯克旗下xAI正以1130亿美元估值出售3亿美元股权,细节未披露。若融资成功,其估值将跻身球前列。xAI成立于2023年,获巨额融资,与X合并,产品Grok AI功能丰富。

AIGC开放社区
算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)法虽降低成本,但性能不及量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
新闻资讯8

OpenAI狂砸65亿,挖走苹果设计教父!GPT豪赌下个iPhone时刻

OpenAI斥资65亿美元股权收购前苹果传奇设计师Jony Ive的AI设备初创io,想定义下一代AI计算机。首款产品预计2026年亮相,奥特曼称其会很酷炫。这对苹果威胁大,AI硬件竞争也白热化。

新智元
算法论文7

【CIKM'2026】CQ-SID:LLM生成式检索在手猫搜索召回中的探索与应用

文章围绕LLM生成式检索在手猫搜索召回的应用展开。先点明当前搜索召回机制问题及生成式检索挑战,提出CQ - SID等法,经实验验证其效果佳,还介绍了线上实验成果,最后展望未来探索向。

阿里云开发者
产品应用8

突破遥操瓶颈!新无本体数据世界动作模型Noe-0发布

穹彻智能发布世界动作模型 Noe - 0,链路采用无本体采集数据。其数据来自真实环境,配合 World Action Model 架构和 AI - Native 数据基础设施,跑通从真实世界经验到机器人能力转化的完整链路,是具身智能的里程碑。

机器之心
新闻资讯8

深度|开源大战面开打:老黄+小扎 vs 奥特曼+达里奥

黄仁勋注册X账号分享公开信《Open Weights and American AI Leadership》,25家联署支持开放权重模型,OpenAI、Anthropic、谷歌三家闭源前沿实验室未签署。信中核心论点是开放权重模型让AI成行业基础设施,还涉及蒸馏等敏感政策争论。

新智元
新闻资讯7

前后端一起消失:AI Coding正在改写大厂工程师分工

大厂研发组织出现调整,美团前后端团队合并,蚂蚁网商让测试岗转研发岗。AI Coding普及使技术岗位划分重塑,前后端边界成“栈能力”。AI编程工具虽有后端执行能力,但仍需资深工程师兜底。

InfoQ
新闻资讯7

米哈游一夜烧掉200万元Token,大厂高管也开始质疑:Token烧不出价值,但养肥了谁?

Uber运营负责人质疑AI tokenmaxxing成本合理性,米哈游员工一晚烧200万Token。部分公司开始调整,如多邻国取消AI使用绩效评估,Shopify阻止失控消耗。Tokenmaxxing让模型厂商、编程工具和算力相关受益,盲目跟风企业或成输家。

AI前线
开源动态8

解码加速15倍!EdgeRazor助推大模型在PC/移动端“狂飙”

大语言模型参数膨胀,端侧部署难,量化成主流轻量化案。开源工具库EdgeRazor由南京大学和微软联合推出,采用MPQAD打破极低比特大语言模型“能力塌陷”,在性能、效率、易用性等面表现出色,打通AI生态链路。

机器之心