善意的混乱」共找到 10580 篇相关文章

算法论文7

模型宣称“百万字处理能力”是真本事,还是营销噱头?LongCodeBench揭露真相

近年来大模型号称有百万字处理能力,但这是真本事还是噱头存疑。论文用LongCodeBench测评工具揭开长上下文模型真实表现,测试顶尖模型发现长文本能力‘翻车’,还分析了长上下文难原因及面临瓶颈。

深度学习自然语言处理
产品应用7

训练世界模型,开始从人类肌肉和脑子里偷师了

具身智能数据竞争进入新阶段,第一视角视频虽缓解数据量问题,但未记录人行动原因及大脑身体实时修正。FaceMind提出Ego - NeuroLoop数据范式,配套NeuroMatrix和NeuroBooster,将训练数据从“行为库”推向“闭环库”。

量子位
算法论文7

拆解大模型几项核心操作背后数学与 Infra 优化逻辑

文章拆解大模型核心操作(RMSNorm、Softmax、Causal Mask、Sampling)背后数学与Infra优化逻辑。指出Infra优化是用数学等价变换或精度妥协换硬件利用率和推理速度,还介绍各操作原理、问题及优化方法。

腾讯技术工程
产品应用7

从聊天窗口到多 Agent 控制台:一次 AI 编程协作范式转移

作者分享了从单 Agent 协作到多 Agent 协作编程范式转变。当前主流 AI 开发多为单 Agent 协作,效率低,作者设计了 Mexus 工具,解决多 Agent 协作、观测、Review 等问题,重塑人与 AI 协作关系。

阿里云开发者
算法论文8

警惕!大模型成本倒挂:你正在为模型多余「思考」买单

一项来自多所高校和微软研究院研究揭示AI模型价格倒挂现象,低定价模型可能产生更高实际开销。研究聚焦8个前沿推理模型和9个主流数据集,指出推理token是成本倒挂主因,且实际开销难以预测。

机器之心
新闻资讯8

我们真变成巫师了:OpenAI API 负责人谈 AI 如何重塑软件工程

OpenAI API 负责人 Sherwin Wu 在 Lenny's Podcast 上分享,OpenAI 内部 95% 工程师用 Codex,100% PR 由其审查。他谈了 AI 重塑软件工程现状、未来趋势,提及管理变化、创业效应、部署问题等,也为创业者给出建议。

宝玉AI
推荐文章8

AI 医疗全景更新:为什么硅谷 healthcare 领域出现了最多 AI 独角兽?

本文基于对全美700余位医疗行业高管调研及关键人物访谈,梳理AI医疗落地路径与商业化逻辑。指出医疗行业正推动AI商业化,投资增长催生独角兽,落地呈现“非线性加速”,还介绍了投资格局、应用场景等情况。

海外独角兽
开源动态8

LeRobot v0.4.0 正式发布:全面提升开源机器人学习能力

LeRobot v0.4.0 正式发布,带来多方面重大升级。有可扩展 Datasets v3.0、新 VLA 模型、全新插件系统;支持 LIBERO 和 Meta - World 仿真;还有数据处理 Pipeline、多 GPU 训练简化等特性,上线了机器人学习课程。

Hugging Face
推荐文章7

“被投资人怒怼30分钟后,我更确定中国To B答案” | 甲子光年

文章讲述百融云创在AI To B领域探索。它突破传统“卖工具”模式,采用“结果计价”,共担结果、承包KPI。技术上提前押注语音对话技术栈,“硅基员工”概念落地多场景,有望推动中国To B行业进入新秩序。

甲子光年
算法论文8

Think in Games:做一个在王者荣耀中会玩和思考Agent

文章介绍论文《Think in Games: Learning to Reason in Games via Reinforcement Learning with Large Language Models》,指出当前AI在游戏领域面临困境,提出TiG框架结合大语言模型与强化学习,打造既会做又会说AI,实验验证其高效性。

深度学习自然语言处理