任务自动化」共找到 2352 篇相关文章

算法论文7

苹果港大终结自回归时代?7B扩散模型发布,AI写代码逻辑彻底颠覆!

苹果联合港大开源扩散大语言模型DiffuCoder,用扩散模型+强化学习策略,性能提升4.4%。研究还提出耦合梯度奖励策略优化方法,建立原生RL训练框架,探究了dLLM的生成机制等问题。

新智元
算法论文8

告别微调时代:拖拽式LLMs实现12000倍加速适配,输入描述,秒级定制LLM,效果、速度全面超越

传统高效微调技术成大规模部署瓶颈,论文提出Drag-and-Drop LLMs (DnD),仅需输入目标任务未标注提示,即可秒级生成适配的LoRA权重,实现LLM秒级免训练适配,效率、性能和泛化性上均有突破。

深度学习自然语言处理
产品应用7

纳米 AI 梁志辉:超级搜索智能体是 AI 时代的真正入口

纳米AI梁志辉认为超级搜索智能体是AI时代真正入口。纳米AI推出的「超级搜索智能体」结合多Agent协作等能力,是新解决方案。演讲分享了360对AI搜索、智能体搭建及浏览器的看法与探索。

Founder Park
推荐文章8

Anthropic:我们如何构建多智能体研究系统

Anthropic分享构建多智能体研究系统的经验,该系统用多个Claude智能体探索复杂主题。介绍了多智能体系统优势、架构、提示工程、评估方法,也提及生产环境的挑战,此系统处理开放式研究任务价值大。

宝玉AI
新闻资讯7

陶哲轩联手AI挑战经典ε-δ极限!加法秒杀、乘法翻车

数学大师陶哲轩第三支Lean 4自动化数学证明视频,携手GitHub Copilot挑战「ε - δ」极限问题。Copilot处理加法较顺,减法卡壳,乘法失控。复杂证明时它短板尽显,陶哲轩认为复杂证明还得靠人脑。

新智元
8

专业医生远不如AI模型?OpenAI推出医疗开源测试基准HealthBench,o3表现最强

OpenAI推出医疗开源测试基准HealthBench,由262位多国医生合作打造,含5000段真实健康对话。评估显示o3综合表现最佳,顶尖AI处理任务能力超无辅助医生,HealthBench更真实专业有区分度,但也有局限。

AI寒武纪
算法论文8

清华&通院推出"绝对零"训练法,零外部数据大模型自我博弈解锁推理能力

清华、北通院和宾州州立大学研究人员提出“绝对零”训练法,让大模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
产品应用9

破除人形崇拜!京东用“狼族”军团重做物理AI

当行业狂热追捧人形机器人时,京东物流针对物流仓储非标环节自动化渗透率低的痛点,推出「狼族」异构机器人集群搭配超脑3.0智能中枢的全链路物理AI方案,已实现规模化落地,兼顾效率与经济性。

InfoQ
算法论文7

代码榜刷满分,AI科研却撞墙?140道真实研究题撕开「自进化」真相

新工作MLS - Bench覆盖12领域、140个研究任务,评测前沿模型科研能力。虽模型工程执行强,但科学发现能力弱,当前仍难提出有效算法创新。其评测已纳入Kimi K3和Qwen3.8 - Max官方发版表。

新智元
算法论文8

李飞飞第一篇「触觉」论文:机器人会盲摸麻将了

李飞飞等全明星阵容关注灵巧手研究,提出T-Rex模型。其通过给触觉单独开通路等方式解决触觉加入难题,在真实任务中表现出色,还为灵巧手领域带来从机身分化、启发专用场景应用等变化。

量子位