零样本预测」共找到 899 篇相关文章

算法论文8

仅需152个样本,性能提升48%:Memory-R1如何重塑Agent记忆能力?

这篇文章解读论文Memory - R1,其由多所高校研究团队完成,旨在解决LLM在长对话和多轮任务中的‘记忆难题’。通过强化学习让LLM学会管理记忆,用152个问答对训练,大幅超越现有基线模型。

深度学习自然语言处理
新闻资讯8

中国科协重磅回击,NeurIPS含金量一夜归!AI顶会已死?

NeurIPS以「合规」为由出台歧视性政策,引发强烈不满。其官方回应遭群嘲,中国科协出手将其2026年在中国学术评价体系中「含金量」归,顶尖学者集体退审,顶会审稿制度也在坍塌。

新智元
产品应用7

一手实测!不用研究小龙虾了:腾讯搬出QClaw,直连微信,门槛

腾讯基于OpenClaw开源生态推出QClaw,主打简单、门槛部署,可直连主流大语言模型,集成微信能远程操控电脑。还推出SkillHub技能社区,腾讯电脑管家有安全防护功能,但权限问题待解决。

机器之心
新闻资讯8

Nature重磅:智能的尽头是算力!谷歌大佬承认「预测下一个词即智能」

芯片速度触顶,摩尔定律失效,但AI却在疯狂跃迁。Nature文章指出,智能的增长不靠芯片加速,而是结构重组与协作。其核心是预测和并行协作,AI正以类似生命演化的方式发展,与人类相互依存。

新智元
算法论文8

苹果新作:内化视觉思考,推理提速 5 倍

Apple研究团队提出Internalized Visual Thinking(IVT),一种将预测性世界建模能力内化到模型表征中的后训练框架。它在训练时预测未来,推理时直接回答,相比Visual CoT推理提速超5倍。

机器之心
开源动态7

DeepSeek|从构建轻量级vLLM:Nano-vLLM,吞吐量逼近原版,代码仅需1200行

开源的vLLM能提升LLM推理速度和资源利用率。近日,DeepSeek AI俞星凯从构建轻量级Nano - vLLM,代码仅1200行。它有离线推理等功能,基准测试显示吞吐量逼近原版。

AINLPer
新闻资讯7

分化、新范式、Agent 与全球 AI 竞赛,中国模型主力选手们的 2026 预测

AGI-Next 2026活动聚集众多国内大模型核心人物,「海外独角兽」总结出40条重要判断。涉及模型分化、新范式(自主学习、原生多模态)、Agent、全球AI竞赛等方面内容,对AI未来发展趋势做出探讨。

Founder Park
产品应用7

实战指南:从构建 MCP 架构下的 Agentic RAG 系统,无第三方MCP Server

五一期间作者用MCP架构从实现Agentic RAG系统,分享MCP与Agentic RAG融合思考、架构设计,介绍MCP服务端和客户端实现,还做了端到端效果演示,指出架构优势及待优化处。

AI大模型应用实践
新闻资讯8

5000次风暴,谷歌训出AI预言家!天气预报ChatGPT时刻?

谷歌DeepMind与谷歌研究团队推出交互式气象平台Weather Lab,共享人工智能天气模型。其新模型在热带气旋路径预测上刷新SOTA,是首个超越主流物理模型的AI预测模型,有望拯救数万生命。

新智元
新闻资讯7

OpenAI开除内鬼!拿着改变世界的机密去赌博,一夜狂赚几十万

OpenAI开除一名利用公司核心机密在预测市场下注牟利的员工。调查发现过去一年多,60个神秘钱包做出77次精准押注。不止OpenAI,其他预测市场平台也出现内幕交易案件,平台陷入尴尬处境。

新智元