大模型Yan 2.0」共找到 8738 篇相关文章

产品应用7

Google 推出超小杯 AI:Gemma 3 270M!可进手机和浏览器

Google发布Gemma 3家族最小版本Gemma 3 270M,2.7亿参数,能耗低,在同规模模型中表现突出。设计理念是“够用就行”,适合特定任务,已在多平台发布,开源策略效果好。

AI工程化
算法论文8

ACL 2026 | 中科大&上海AILab揭示强化学习后训练的Scaling Law

中国科学技术大学和上海人工智能实验室等团队,在Qwen2.5和Llama 3模型开展研究,揭示强化学习后训练的Scaling Law,提出幂律公式预测模型学习效率与训练轨迹,成果被ACL 2026接收。

机器之心
算法论文7

The Batch: 939 |在推理阶段学习长上下文

大型语言模型处理长上下文时通常准确性降低、速度变慢,研究人员提出TTT - E2E方法,通过推理时训练模型将上下文压缩到transformer权重中,还展示了其运作方式、测试结果等。

DeeplearningAI
产品应用7

避免Claude Code 降智的一小招

Claude Code近期表现变差,简单代码逻辑会搞混,调试建议也不对。作者分享小妙招,切回Opus 4.0能让其恢复智商,还介绍三种切换模型方式,并分析了其降智原因。

AGI Hunt
新闻资讯8

最全面人类细胞图谱发布:110万个细胞看清调控与衰老

本文是对最新发表的Tabula Sapiens 2.0人类细胞图谱的专业解读,该图谱相比1.0细胞量翻倍至110余万个,覆盖28种组织,解析了细胞调控机制与细胞衰老特征,且完全开放供研究使用。

DeepTech深科技
算法论文7

姚顺雨入职腾讯50天后,发布了首篇署名论文:CL-Bench

2月3日姚顺雨加入腾讯50天后发布首篇署名论文《CL-bench: A Benchmark for Context Learning》。该论文做了新的benchmark,测试显示前沿模型平均分仅17.2%,指出模型在上下文学习尤其是归纳能力上的短板。

花叔
算法论文8

一个标点就能迷惑LLM-as-a-Judge!

论文揭露惊人漏洞,一个标点或通用推理开场白就能欺骗最先进的LLM裁判,导致强化学习训练崩溃。研究通过实验验证漏洞,提出Master - RM模型,其FPR近乎0%且保持通用裁判能力。

深度学习自然语言处理
推荐文章7

我的空白页恐惧症,被AI治好了

作者分享摆脱空白文档恐惧的经验,认为可让AI先写初稿,人与AI协同创作。以百度文库Genflow 2.0为例,展示其在资料导入、任务执行等方面优势,鼓励大家尝试与AI协作。

花叔
开源动态8

离GPT-5最近的一次!中国1万亿参数开源巨兽突然爆火

月之暗面发布全新模型Kimi K2 Thinking,自称开源「思考Agent模型」。它参数约1万亿,性能亮眼,碾压GPT - 5等,能连续调200 - 300次工具,已上线并开源API和权重,开发者可试用。

新智元
产品应用8

Manus高溢价收购背后,是Agent开发落地困境

近期Meta 20亿美元收购Manus引发关注,暴露Agent开发落地难题。阿里云百炼升级“1+2+N”体系,“N”组件解决数据、安全等问题,“2”提供新开发范式,“1”深挖模型服务工程,还发布企业版助力落地。

InfoQ