「M2.7」共找到 2440 篇相关文章
大模型能复刻这些系统吗?ProgramBench给出了残酷答案
斯坦福NLP组发布ProgramBench,用200个完整代码库重建任务测试主流大模型,要求模型仅根据可执行文件还原如SQLite等项目完整代码,结果所有模型实际解决率为0%,说明模型更擅模仿代码表面结构。
The Batch:927|极速扩散学习
研究表明扩散图像生成器学习重建预训练编码器嵌入可加快训练,Apple团队提出的FAE,通过缩小嵌入再重建解决了因嵌入尺寸大导致的训练受阻问题,性能与先进模型相当且训练更快。
ICML暴力清场,497篇论文一夜作废!审稿人偷用AI惨遭全拒
ICML 2026爆出大消息,497篇论文因审稿人动用AI未标注被“桌拒”,占总投稿量2%。ICML祭出“连坐”惩罚,引发争议,有人质疑检测不靠谱,也有人支持维护学术规则。
限时14天!Claude推「错峰双倍」特权,国内用户天降「时差红利」
北京时间3月14号到28号,Claude搞「错峰双倍配额」活动,避开美东8:00 AM—2:00 PM,五小时额度翻倍,覆盖多端及插件,Free等用户可享,赠送额度不计上限,国内开发者有「时差红利」。
YC总裁转发、登顶Hacker News:SkillsBench揭开Agent技能扩展的残酷真相
近日论文《SkillsBench: Benchmarking How Well Agent Skills Work Across Diverse Tasks》引发海外AI社区关注。研究聚合47150个Skills,经严格筛选评估,揭示人工构建Skills效果好、AI自生成无效等核心发现,为AI研发指明路径。
谷歌AI的“心脏”长什么样?读懂TPU就够了
文章介绍了谷歌TPU的发展历程,从2015年为解决AI计算效率瓶颈自研,发展到如今成为谷歌“经济支柱”。还对比了谷歌、英伟达、亚马逊的芯片路线,强调谷歌全栈垂直整合策略使TPU在推理时代优势明显。
像Vibe Coding一样写论文!OpenAI发布免费科研写作平台
OpenAI发布免费科研写作平台Prism,将GPT - 5.2集成到在线LaTeX编辑器,功能强大。其背后是OpenAI进军AI4S领域战略,副总裁Kevin Weil称2026年将成科学界‘AI变革年’。
创业7年干出一个全球第一,这家深圳芯片公司冲刺港股IPO
曦华科技冲刺港股IPO,其2024年scaler芯片出货量全球第二,ASIC架构scaler产品市场份额达55%排第一。不过,公司仍亏损,且面临激烈竞争。它靠产品创新和高研发投入提升估值,后续有应对竞争的规划。
我的AI OS搭建思路
作者黄益贺分享AI OS搭建思路。其系统以Claude Code为框架、Kimi K2 Thinking为模型,通过Skill和自定义命令满足工作需求,设计三层文件夹体系处理信息,供大家参考搭建。
打破数据质量鸿沟!清华腾讯Bee项目发布1500万高质量数据集,刷新MLLM全栈开源SOTA
全开源多模态大模型性能被闭源和半开源模型“卡脖子”,根源在于数据质量。清华与腾讯混元团队推出Bee项目,有三大核心贡献,产出的Bee - 8B模型表现领先,证明保证数据质量比堆量更有效。