多语言推理」共找到 6057 篇相关文章

新闻资讯7

Devin CEO:别搞智能体!Anthropic:我们性能提升90%!

最近,开发Devin的Cognition CEO发文称不要构建智能体系统,而Anthropic分享构建智能体研究系统,性能提升90%。Cognition认为智能体协同难,坚持单线程线性Agent;Anthropic用工程设计绕开瓶颈。二者因任务类型不同观点有别。

探索AGI
开源动态8

轻量级开源AI智能体框架!智能路由+上下文管理,前后端接口支持!

随着智能体系统成对话式AI新趋势,GitHub现轻量级高灵活性AI智能体协调框架Agent - Squad,它能实现智能体协作、路由和上下文共享,支持双语言,部署灵活,功能强大且安装友好。

开源星探
算法论文8

VLA模型为何忽视语言?破解指令跟随幻觉,分布外场景泛化新突破

当前VLA模型常依赖视觉线索而非语言指令,导致新场景表现不佳。论文提出LangForce方法,引入对数似然比损失,强化模型对语言的依赖,提升分布外泛化能力,还保留语言核心功能。

新智元
算法论文8

LLM 仅靠自身就能增强推理?SePT 给出简洁在线自训练范式

推理后训练方法依赖外部信号,SePT仅用模型自身生成的答案自训练,能提升推理能力,数学推理任务准确率升10个点。它核心简洁,设计关键是温度解耦等,不损模型通用能力,代码易迁移复现。

机器之心
开源动态8

微软发布智能体 Web 操作系统!让 AI 成为真正“可控、协同、透明”的网页执行助手!

微软推出新一代智能体 Web 操作系统 Magentic - UI,它能自动浏览网页、处理数据等,具备智能体协同能力。其界面透明可控,功能丰富,安装使用友好,适用于种复杂场景。

开源星探
开源动态8

Andrej Karpathy 盛赞!斯坦福团队新作,让Llama-1B 实现毫秒级推理

斯坦福Hazy Research团队将开源模型Llama - 3.2 - 1B前向推理整合为“Megakernel”,把推理延迟大幅降低,显存带宽利用率显著提升。团队指出当前主流LLM推理系统在小batch、极低延迟场景下低效,提出Megakernel以重构执行方式。

AI科技评论
开源动态8

妈妈再也不用担心延迟了!斯坦福手搓Llama超级内核,推理仅需0.00068秒

斯坦福Hazy实验室推出低延迟推理引擎「Megakernel」,将Llama - 1B前向传播融入单一GPU内核,H100上提速1.5倍,B200上每次推理仅0.00068秒,比vLLM快3.5倍。文章分析传统引擎问题并介绍Megakernel设计。

新智元
开源动态8

近5w颗星!一个能同时指挥个AI写代码的开源工具来了

现在写代码,很人想开个AI助手。Orca是支持AI Agent的编程开发环境,各Agent在独立git worktree里运行,互不干扰。它功能丰富,还支持系统安装。

GitHubStore
推荐文章7

AICon上海演讲精华回顾:《GMI Cloud 全球化高性能分布式推理服务构建实践》

AICon2025上海站,GMI Cloud资深架构师Frank Lee分享《GMI Cloud全球化高性能分布式推理服务构建实践》,介绍其推理平台,拆解扩缩容等能力,分享架构设计、部署及优化实践,揭秘推理提效关键路径。

InfoQ
算法论文8

测试时Scaling或是最大错觉,Google:R1/O1强推理另有原因

Google 112 页论文实证,OpenAI 的 o 系列等模型推理能力提升并非仅因计算时间延长,而是源于对复杂互动的隐式模拟。通过三重验证表明推理能力跃迁或因‘吵得更凶’,而非‘算得更久’。

PaperAgent