「国科大」共找到 5137 篇相关文章
内存涨价,千元机的天塌了
去年下半年起存储芯片涨价,因AI基础设施需求爆发,三大存储芯片厂产能被榨干。消费级产品供应受挤压,中低端手机成最大受害者,各厂商搁置低价产品线,中低端市场持续萎缩。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
“千问奶茶”在二手平台6元转售;追觅俞浩:年终奖最高20个月奖金,总量会达到10亿级;京东001号快递员:退休金4000多,存款百万|AI周报
这是一份AI周报,涵盖行业热点、大模型发布等多方面信息。有追觅俞浩高额年终奖计划,马云现身阿里千问项目组引发‘千问奶茶’活动热潮,还有域名交易、企业收购、模型发布及应用等动态。
智普入局OCR! GLM-OCR 0.9B 也杀进来了~
OCR是上古任务,如今大模型纷纷入局,用1B以下小参数模型搅动解析市场。GLM-OCR能做文本识别等,采用三级架构,有两阶段流水线及训练机制创新,在多场景表现出色。
像开发软件一样造世界,Agent2World来了,把世界模型做成可运行的符号环境
为让模型真正“能行动”,需可执行、可验证的符号世界模型,但现有自动生成路线有困局。研究团队提出 Agent2World,经实验验证有显著效果,能稳定产出高质量符号世界模型,开辟 AI 理解现实环境新可能。
揭秘!RLVR/GRPO中那些长期被忽略的关键缺陷
近年来大模型任务突破离不开RLVR关键技术,许多RLVR方法会进行组内优势估计,北航等最新工作揭示其存在系统性偏差,困难题优势被低估,简单题被高估。这会影响训练,论文提出校正算法。
超越Skill?又一新技术让AI编码准确率从53%跃升至100%
Jude Gao主导的新研究带来上下文工程新发现,仅改动8KB的AGENTS.md文件,就让AI编码智能体表现从53%跃升至100%。对比Skills和AGENTS.md两种方案,后者完胜,还解决了上下文膨胀问题。
Science重磅:AI编程新手与资深开发者之间的差距巨大
《科学》杂志发表的AI编程全球调查研究显示,美国程序员提交的Python代码中29%由AI代笔,资深开发者借此拉大与新手差距。研究团队用GraphCodeBert模型分类器扫描代码,揭示技术扩散差异与隐忧。
RunAnywhere:简单几步让AI应用跑在手机上
介绍能在手机本地运行的大模型项目RunAnywhere,它让开发者在iPhone 16 Pro Max部署Llama 3.2 3B模型。AI处理本地化,用React Native和RunAnywhere SDK,支持多模型,有多种功能,优势明显。
从平面几何出发:形式化验证如何驱动MLLM的推理能力跃迁
多模态大语言模型在复杂数学与几何推理中有缺陷,现有训练方式让模型难有鲁棒推理能力。上海交大等团队提出“以形式化增强非形式化推理”方案,构建完整闭环,提升模型推理及泛化能力。