语言学习平台」共找到 3551 篇相关文章

算法论文8

拒绝计算“一视同仁”!Elastic Attention:让大模型学会“看人下菜碟”

现代大语言模型用全注意力机制计算复杂度高,现有混合注意力策略是静态的。为此提出Elastic Attention,引入轻量级Attention Router,具备动态路由等亮点,在主流模型测试中效果好。

深度学习自然语言处理
开源动态7

AgentIF-OneDay 发布,评估全场景长时复杂任务

红杉中国 xbench 发布 AgentIF - OneDay 评测体系,用于评估大模型解决复杂任务的能力。该体系从任务复杂度新视角出发,沿 Scaling Context 和 Scaling Domain 推进,构造了三类典型任务进行测评,揭示了主流 Agent 的能力边界。

特工宇宙
算法论文7

DeepSeek-OCR是「长文本理解」未来方向?中科院新基准VTCBench给出答案

DeepSeek - OCR的VTC技术可实现高压缩率,降低长文本处理成本。但视觉语言模型能否理解压缩信息存疑,中科院等推出VTCBench评估,测试模型认知极限,还推出VTCBench - Wild检测鲁棒性。

机器之心
新闻资讯8

Gemini 3预训练负责人警告:模型战已从算法转向工程化!合成数据成代际跃迁核心,谷歌碾压OpenAI、Meta的秘密武器曝光

2025年底大模型“年终决战”,Gemini 3强势突围。其预训练负责人Sebastian Borgeaud指出,谷歌转向“做系统”,AI进入“数据有限”阶段,合成数据等构成未来进化路径,还分享了预训练热点与挑战。

InfoQ
产品应用7

没错,马斯克的二次元「女友」被雷蛇装到外设里了

CES 2026 展上,雷蛇推出 Project Ava,以 5.5 英寸 3D 全息动画呈现二次元少女等形象。它基于 AI 驱动,能感知情境、交互友好。不过其由 Grok 驱动,有“调情”风格,还存在隐私侵入争议。

机器之心
开源动态8

QwenLong-L1.5发布:一套配方,三大法宝,让30B MoE模型长文本推理能力媲美GPT-5

通义文档智能团队推出QwenLong - L1.5,提供长文本推理后训练“配方”,含数据合成管线、强化学习方法和智能体架构。通过三大“法宝”重塑模型能力,效果显著,相关代码已开源。

AINLPer
推荐文章8

2025年度盘点·值得一看的50件文化遗产创新作品

文章对MANA网站优秀创作者2025年上传作品做年度盘点,精选50件文化遗产创新作品。这些作品用当代语言和技术,让文化遗产不再是陈列品,而是可被感知的文化现场,探索文化当下生长与未来延展。

MANA新媒体艺术站
算法论文8

NeurIPS 2025 | 告别全量扫描!浙大提出COIDO:破解多模态数据选择「高耗」难题

浙大提出 COIDO 框架解决多模态数据选择「高耗」难题。它摒弃全量扫描,用轻量级评分器和小样本采样,将重要性和多样性的优化统一。实验显示,它性能与效率双优且有强泛化性。

机器之心
开源动态8

Google 开源 InkSight,把手写笔记直接变成可编辑数字笔记!

Google 开源 InkSight,能将手写照片转为数字墨迹,与传统 OCR 不同,它可「还原书写方式」。具备离线转在线、多语言支持等功能,核心是「阅读 + 书写」双重训练,有两种使用模式。

开源星探
新闻资讯8

当云计算开始在硅谷“造星”,一场自我革命开始了

亚马逊云科技在2025 re:Invent大会尽显号召力,新锐Decart AI、TwelveLabs等借其技术蹿红,苹果也分享成果。它还进行自我革命,优化性能,构建生态,其中国行也即将开启。

InfoQ