「长程任务能力」共找到 4626 篇相关文章
Python新版本去GIL刷屏,Karpathy 点赞敢死队,Python 之父:冷静,别神话并发
Python 3.14 正式发布,将“去 GIL”写进官方发行版,一整套能力同步上线,官方预估可带来约 3% - 5% 的性能提升。开发人员反馈速度明显提高,但 Python 之父认为去除 GIL 的重要性被高估。
LLM工业级自进化:北邮与腾讯AI Lab提出MoE-CL架构,解决大模型持续学习核心痛点
北邮百家AI团队与腾讯AILab提出MoE - CL架构用于LLM自进化持续指令微调。其结合‘解耦LoRA专家’与‘GAN对抗降噪’,在腾讯业务及基准测试中效果佳,降低人工成本,准确率优于主流方法。
让大模型合成检查器:UIUC团队挖出Linux内核90余个长期潜伏漏洞
伊利诺伊大学香槟分校张令明老师团队的论文提出KNighter,它让大模型生成静态分析检查器,在Linux内核挖出92个长期潜伏漏洞,将LLM归纳能力沉淀为规则,带来可落地等好处。
你的AI助手更万能了!天禧合作字节扣子,解锁无限新功能
天禧个人超级智能体和字节跳动扣子官宣生态合作。天禧是联想新一代AI助手平台,扣子开发成本低、功能完善。合作解决开发者痛点,让用户体验多元AI能力,彰显联想构建AI生态决心。
390亿美元,全球具身智能第一估值来了!英伟达持续加注中
与OpenAI分道扬镳后,Figure C轮融资获超10亿美元承诺资本,投后估值达390亿美元。资金将用于扩大人形机器人大批量制造与部署、搭建GPU基础设施、启动数据采集项目,助力具身智能发展。
腾讯悄悄上线了“Claude Code”,居然还支持微信登录。
腾讯悄悄上线CodeBuddy Code(Claude Code),定位为AI CLI,能在命令行完成编程任务。作者测试用其开发MCP服务,速度快且功能全,还介绍使用方法,不过产品有稳定性问题,仍有潜力。
从数据分布视角,重新认识下CoT
本文从数据分布视角重新审视大语言模型的思维链(CoT)推理。指出CoT并非真正推理,而是模仿,其效果受训练与测试分布差异影响。通过实验揭示CoT在分布偏移时性能退化,提醒勿过度依赖。
沉寂一个月,openPangu性能飙升8%!华为1B开源模型来了
华为发布专为昇腾端侧硬件打造的openPangu Embedded - 1B模型,仅10亿参数却性能卓越。它运用多阶段训练和优化,在权威基准表现亮眼,V1.1平均分较上月跃升超8%,还介绍了背后技术。
对话心资本吴炳见:我不问AI创业的“终局”|甲子光年
本文是对心资本合伙人吴炳见的访谈。他2022年底All in AI,分享投资理念,如共鸣时投资、关注当下问题;分析AI发展阶段、应用情况,认为Agent是核心应用形态;还谈及投资案例、学习方式及经验复用与摒弃等。
全面拥抱AI Agent,从0到1动手用GPTBots搭建企业数字助理智能体,办公效率翻倍~
文章指出当下Agent/Agentic AI是热门风口,企业级智能体受资本追捧。重点分享运用GPTBots平台从0到1搭建企业数字助理智能体,涵盖架构、流程、设计、测试等内容,介绍选择该平台的原因及实践成功关键。