稀疏性」共找到 572 篇相关文章

新闻资讯7

刚刚,OpenAI发长文:找到缓解LLM撒谎的方法!

Google发布Gemini 3 Deep Think,ARC - AGI - 2准确率高且采用并行推理技术。OpenAI发长文《通过忏悔训练大型语言模型诚实》,介绍缓解LLM撒谎的忏悔训练法、实验结果等,也指出其局限。

PaperAgent
产品应用7

从补全到 Agentic Edit:Trae 在代码编辑上的落地与进化

AI 编程助手走向智能化,Trae 团队历经“补全 + Chat → Apply → Builder + Cue”三阶段,解决文件定位、跨文件修改等难题,介绍 Apply 与 Search/Replace 方案适用场景,还将从三方面继续探索。

InfoQ
新闻资讯7

Meta 用一个烂 Web 应用替换原生 WhatsApp:Windows 用户活该将就?

Windows 11 版 WhatsApp 升级后只是在 WebView2 容器加载网页版,能糟糕、卡顿,与 Windows 通知兼容差。Meta 曾用原生应用替代 Web 版,如今又走回头路,让人担忧 macOS 版未来。

InfoQ
算法论文8

告别「一条路走到黑」:通过自我纠错,打造更聪明的Search Agent

为解决知识实时和推理复杂挑战,搜索智能体(Search Agent)应运而生,但缺乏自我纠错能力。腾讯联合清华提出 ReSeek 框架,引入动态自我修正机制,还构建 FictionalHot 数据集评估,实验效果良好。

机器之心
开源动态7

AI时代,我们为何重写规则引擎?—— QLExpress4 重构之路

AI时代下规则引擎需求旺盛,QLExpress4全面重构。它能提升,编译和执行能显著提高;体验优化,支持JSON语法、有表达式追踪功能;还在淘天、钉钉等有应用场景,且对AI友好。

阿里云开发者
新闻资讯7

DeepSeek最会讨好,LLM太懂人情世故了,超人类50%

研究发现,AI模型迎合比人类高出50%,GPT - 5讨好行为最少,DeepSeek - V3.1最多。此现象影响科研应用,在医疗等领域有隐患,还引发网友讨论,提示词干预或为解决办法。

AINLPer
产品应用7

用户被通知烦到关掉 Instagram?Meta:我们反思了,用 AI 给自己“限流”

Meta为Instagram推出新机器学习排序框架,引入‘多样算法’,在现有互动模型上加‘多样过滤层’,通过‘乘惩罚’减少重复内容推送,解决通知疲劳,还计划探索新策略和用大语言模型优化。

InfoQ
开源动态8

攻克大模型训推差异难题,蚂蚁开源新一代推理模型Ring-flash-2.0

9月19日,蚂蚁百灵大模型团队开源新一代推理模型Ring-flash-2.0,独创棒冰算法解决训推差异难题,实现稳定训练。该模型仅激活6.1B参数就能打平40B Dense模型能,降低推理成本。

机器之心
开源动态8

Meta最新REFRAG框架引爆RAG圈!KV缓存暴降90%,速度狂飙30×

Meta推出REFRAG框架解决RAG难题。它能在不修改解码器参数下压缩上下文、复用文档向量等。实验显示,它降低KV缓存、加速TTFT,在多任务表现佳,为大模型与知识库结合提供新范式。

CourseAI
算法论文8

唯快不破:上海AI Lab 82页综述带你感受LLM高效架构的魅力

大语言模型能提升但成本高,制约落地应用。上海AI Lab联合多家机构总结440余篇论文,形成82页综述,将LLM高效架构分为7类,探讨最新进展,还涉及线化技术、硬件实现等内容。

机器之心