国科大」共找到 5098 篇相关文章

算法论文8

ICLR 2026|UIUC:一行代码彻底解决LLM推理的过度思考!

2025年DeepSeek发布推理模型,引发RLVR研究热潮,但该方法有“过度思考”问题。伊利诺伊学香槟分校等研究者提出Self - Aligned Reward(SAR),能提升推理准确度和效率,有望推动模型推理系统发展。

机器之心
新闻资讯7

阶跃星辰豪揽超50亿融资,“天才创始人”印奇重掌帅印

通用人工智能公司阶跃星辰完成超50亿元B+轮融资,刷新中国模型领域单笔融资纪录。同时,印奇出任董事长。该公司坚持“基础模型”与“AI+终端”战略,商业化探索也在多方向推进。

AI前线
新闻资讯7

谁是2025年度最好的编程语言?

在2025年IEEE Spectrum编程语言排行榜上,Python十连冠且成三冠王,与第二名差距,还借AI放优势。JavaScript排名波动,SQL宝座被冲击。同时,编程社区文化衰落,AI或终结编程语言多样性。

量子位
算法论文8

超越免训练剪枝:LightVLA引入可微分token剪枝,首次实现VLA模型性能和效率的双重突破

文章介绍LightVLA框架,它是用于提升VLA推理效率和性能的视觉token剪枝框架。针对VLA模型计算开销、推理延迟高问题,提出两创新,在LIBERO实验中性能超经典模型,还实现推理加速。

机器之心
产品应用7

加拿丛林迷路五小时,ChatGPT救命神技,比地图还靠谱!

一群人在加拿森林迷路5小时,手机电量低、Google Maps失灵,靠向ChatGPT发实时坐标获导航指引脱险。此外,上海交团队推出PathGPT,用模型让导航可自然对话,虽有不足但潜力

新智元
算法论文8

盘一盘,2017年Transformer之后,LLM领域的重要论文

本文梳理2017年Transformer后LLM领域重要论文。如提出Transformer架构的论文成现代AI基石;介绍GPT - 3的论文确立‘模型 + 数据’缩放定律,引领LLM军备竞赛等。还列举各论文内容与影响。

机器之心
算法论文8

ICML 2025 | 千倍长度泛化!蚂蚁新注意力机制GCA实现16M长上下文精准理解

语言模型发展中,长文本建模挑战。蚂蚁研究团队提出注意力机制GCA,可端到端学习检索相关片段,实现超长序列处理与泛化,其Triton kernel实现已开源,论文被ICML 2025接收。

机器之心
推荐文章7

YC最新总结顶尖的提示词应该怎么写?

提示工程在模型时代愈发重要,其核心在于提示词设计。近日,YC在播客分享从与模型创业公司学到的提示工程实践,涵盖核心原则、进阶技巧、企业级实践、创业者模式等内容。

AI工程化
开源动态8

一文看懂 TritonNext 2026:FlagOS 亮点详解、语言扩展新趋势、AI 生成更加“底层”、芯片软件生态或迎“新拐点”!

1月9日,「2026 TritonNext技术会」召开,专家探讨AI编译器等最新解法。如林咏华介绍FlagOS v1.6应对生态难题;崔慧敏用“AI for Compiler”破芯片演进难题;上海人工智能实验室推出DLCompiler打破算子开发困境等。

AI科技大本营
新闻资讯7

Google全链路赋能出海:3人团队调度千个智能体,可成独角兽|MEET2026

在量子位MEET2026会上,Google Cloud中华区负责人Dennis Yue称智能体为初创出海注入新内涵。谷歌推一体化方案全链路赋能,还谈到Gemini 3突破、A2A协议及商业模式转变等。

量子位