「顶会论文」共找到 2334 篇相关文章
爱思唯尔把Meta告了:拿Sci-Hub盗版论文训练大模型
学术出版巨头爱思唯尔等多方原告起诉Meta,指控其未经授权获取、复制受版权保护的学术论文训练Llama大模型,数据源于Common Crawl和盗版平台。Meta以‘合理使用’抗辩,AI版权合法性尚无明确判例。
现在对开发者的定义,就像会写字的都叫书法家一样
作者对开发者定义感到困惑,如用扣子搭工作流、用秒哒产出网站也算开发者。AI 产品宣传覆盖大量开发者,造成泡沫,伤害真正开发者。还指出开发者痛点,给出做产品和发展的建议。
西湖大学王东林团队论文:机器人需要“通古今,知未来”丨CVPR 2026
西湖大学王东林团队提出论文《HiF-VLA:Hindsight, Insight and Foresight for Vision-Language-Action Models》,介绍HiF-VLA模型,它以“运动”表达时间信息,实现稳定连续决策,性能提升且计算成本低,推动机器人从“看到就做”到“边想边做”。
谷歌TurboQuant会绕过“内存墙”?这个判断有点过了|甲子光年
谷歌发布的TurboQuant论文引发市场震动,其算法可将大语言模型推理的KV缓存大幅压缩并加速。但将其视为绕过‘内存墙’判断过度,它提升单位字节信息密度,改变边际需求曲线,代表范式转移。
AI 会取代人类思考吗?我们为什么仍要亲手写作和编程
文章探讨AI是否会取代人类思考,指出不能过度依赖AI,如写作和编程应亲力亲为。还给出使用AI的指南,引用多方观点说明人类在创作、决策等方面的价值,以及学习编程和掌控AI的重要性。
DeepSeek的GRPO会导致模型崩溃?看下Qwen3新范式GSPO
文章围绕大语言模型后训练阶段的强化学习算法展开。介绍了OpenAI的RLHF、DeepSeek的GRPO,重点指出Qwen团队发现GRPO有稳定性问题,会致模型崩溃,进而提出新算法GSPO,实验显示其效率和可扩展性更佳。
Ben Thompson:Agent会下单之后,Amazon 和 Shopify 活得更好了
大家以为AI会重构电商,可ChatGPT的checkout功能未成功,Shopify、Amazon等电商平台仍活得好。分析师Michael Morton指出,AI改变产品发现入口,但难抹平支付等环节,品牌官网因AI获更多流量。
WAIC抢先爆料:金融“黑马”大模型超DeepSeek刷新SOTA,论文已上线
WAIC期间,蚂蚁数科金融推理大模型发布会未开,论文已上线。其新模型Agentar - Fin - R1有8B和32B版,在金融测评集超DeepSeek等,还兼顾专业与通用,蚂蚁数科还提出评测基准Finova。
刚刚开源的学术论文阅读神器,AI 驱动的个性化“暴躁教授”助你攻克论文!
学术论文阅读常因晦涩内容和语言壁垒让人望而却步。Mad-Professor是开源的AI驱动学术论文阅读工具,集成多种功能,通过AI问答和语音交互解答疑惑,赋予个性化角色,让阅读体验高效且生动。
DeepSeek开源大模型记忆模块!梁文锋署名新论文,下一代稀疏模型提前剧透
DeepSeek最新论文给Transformer加上“条件记忆”,补上原生知识查找机制。梁文锋署名,与北大团队合作。提出全新范式及Engram模块,解决传统N - gram问题,研究稀疏性分配,验证推理能力提升,兼顾工程优化。