「推理系统」共找到 3567 篇相关文章
Pony Alpha新模型炸场!全球「猜爹大赛」开启
2月7日深夜,OpenRouter悄悄上线匿名模型Pony Alpha,其编程、推理等体验出色,外网瞬间疯传。全球开启‘猜爹大赛’,Claude、DeepSeek、Grok、GLM各派开吵,还凸显了‘匿名盲测式发布’新打法。
AI五小时发现MoE新算法,比人类算法快5倍,成本狂降26%
加州大学伯克利分校团队提出ADRS系统研究方法,基于OpenEvolve框架优化算法。以EPLB算法为例,新算法比人类算法快5倍,成本降26%,且Nature也报道过AI创造新算法新闻。
免训练加速61倍!陈怡然团队新作DPad:仅关注「彩票token」
杜克大学陈怡然团队新作DPad,发现扩散大语言模型关注少量「中奖」token,推理速度可提61 - 97倍,还增强模型语境学习能力。DPad免训练零成本挑关键信息,实现「少算多准」。
实时语音翻译
Sokuji 是跨平台桌面应用,用 OpenAI、Google Gemini 等 API 提供实时语音翻译。支持多系统,有桌面版和浏览器插件,适配会议场景,还具备音频可视化、虚拟音频设备等特色功能。
AI Agent 总翻车?这篇综述戳破了 3 个关键误区
很多团队做AI Agent停留在‘LLM+工具’表面拼接,运行易出问题。该综述指出AI Agent是‘系统’,介绍其架构,还给出常见误区的应对方法、落地检查清单,展望应用前景。
刚刚,苹果WWDC掀AI重构风暴!端侧模型全开放、AI版Siri却成最大「鸽」王
北京时间今天凌晨,苹果全球开发者大会 WWDC 召开。苹果宣布系列系统更新,展示 AI 融入产品计划,开放端侧大模型,推 Xcode 26。但增强版 Siri 跳票,股价下跌,网友不满。
HarnessEval 来了!开启 RSI 时代的新评测范式!
过去一年AI进入RSI时代,但评测方式仍停留在过去。MirroS联合多方发布HarnessEval,将Harness引入评测领域,使评测成为具备自我进化能力的智能系统,还率先应用于交互式世界模型评测。
瘾
作者分享自己沉迷与AI交流,读书难以集中,经调研发现这是一种“瘾”。AI回复符合预测间隙机制,还启用依恋系统,让大脑失去与人沟通的耐心,同时世界因AI产生割裂。
Claude Sonnet 4.5发布,多领域性能超越GPT-5和Gemini 2.5 Pro
Anthropic发布Claude Sonnet 4.5,是目前最强编程模型,在多领域性能超GPT - 5和Gemini 2.5 Pro。操作电脑、数学推理能力提升,产品更新功能丰富,安全性增强,价格不变,获多家公司认可。
叶子豪、陈天奇等人开源项目FlashInfer入选,MLSys2025最佳论文奖公布
近日,MLSys 2025公布最佳论文奖,FlashInfer等入选。FlashInfer由多机构合作发起,是灵活的LLM推理内核库,优化内存访问、有可定制模板和调度机制,性能提升显著。另一获奖论文提出Negativa - ML可消除ML框架臃肿。