「中控技术」共找到 5186 篇相关文章
LLM记忆管理终于不用“手把手教”了,新框架让智能体自主管理记忆系统
加州大学圣地亚哥分校和斯坦福大学研究人员提出强化学习框架Mem-α,用于训练LLM智能体自主管理记忆系统。它将记忆构建转为序列决策问题,采用多维度奖励函数,实验显示其全面超越现有方法。
谷歌 DeepMind 推出 CodeMender:自动修复代码的智能代理
谷歌DeepMind推出CodeMender,这一AI驱动的智能代理能自动检测、修复并加固软件漏洞。它结合多种技术推理程序行为,生成修复方案经自动测试和人工审核后提交。社区反响积极,长期影响待察。
寒武纪,成为“寒王”之后
寒武纪由天才兄弟创立,曾给华为提供NPU技术,后转型推出思元系列芯片。2024年四季度首盈,2025年业绩起飞、股价超茅台。但它依赖单一客户、内外竞争大、开发者生态不完善,问题交织难短时间解决。
OpenAI算力账单曝光:70亿美元支出,大部分钱花在了“看不见的实验”
据Epoch AI统计,去年OpenAI计算资源支出70亿美元,多以租微软云算力支付。其中50亿研发算力,大多用于幕后研究和实验,非爆款模型的最终训练,也解释了其2024年亏损原因。
Vision-Zero:零数据VLM自我进化!陈怡然团队提出零监督训练新范式
陈怡然团队提出零监督训练新范式Vision-Zero,在多模态任务表现突出。它借鉴自博弈技术,设计自博弈框架,解决数据稀缺和知识天花板问题,还缓解跨能力负迁移,开源代码与模型可供研究。
国产手机正从底层重构安卓!vivo版AI OS亮相了
在vivo开发者大会上,OriginOS 6正式亮相,AI功能全面更新,还首次上线Live Photo的AI消除。它用自研技术重构安卓底层核心,首发蓝河流畅引擎,从计算、显示、存储三大模块优化。
华人主导谷歌SLED,论文登顶会!一键让模型学会自救
大模型常「瞎编」,传统修复代价高。谷歌在NeurIPS 2024提出SLED方法,不依赖外部知识和额外微调,将各层预测纳入考量,减少模型幻觉。实验显示,SLED能显著提升模型准确率。
Claude Sonnet 4.5被炸出来了,依旧最强编程,连续30小时自主运行写代码
新发布的Claude Sonnet 4.5在SWE - bench等多项测试中成绩提升,能连续30小时自主写代码,还改善了对齐和安全性指标,且提质不加价。此外,Anthropic官宣Claude Agent SDK,发布Imagine with Claude功能。
LLM工业级自进化:北邮与腾讯AI Lab提出MoE-CL架构,解决大模型持续学习核心痛点
北邮百家AI团队与腾讯AILab提出MoE - CL架构用于LLM自进化持续指令微调。其结合‘解耦LoRA专家’与‘GAN对抗降噪’,在腾讯业务及基准测试中效果佳,降低人工成本,准确率优于主流方法。
超10万亿Tokens的高质量数据集是怎么炼成的?专访中国电信天翼AI阮宜龙
中国电信天翼AI打造超10万亿Tokens高质量数据集,依托星辰MaaS平台构建“数据—模型—服务”闭环。其与研究院推进技术研发并落地产品,建“三全”星辰大模型体系,还在多行业展现应用价值。