法则领域」共找到 1772 篇相关文章

算法论文7

做过十遍还要从头摸索?Agent 的记忆终于开始长成技能

MemTensor 等机构提出无需训练基础模型的 MSCE 框架,为 Agent 外部经验建‘晋升制度’,让经验成技能。该论文在 EvoAgentBench 与 LoCoMo 测试中结果更好,但在因果证明、模型依赖等方面有不足。

深度学习自然语言处理
新闻资讯8

OpenAI挖到最新菲尔兹奖得主,字节刚出炉的科学家计划在瞄准谁?

今年菲尔兹奖得主之一Jacob Tsimerman将入职OpenAI安全部门。当下顶尖科学家流向头部大模型公司,AI与前沿科学融合成趋势。字节发布Seed STEM科学家计划。大模型下半场比拼基础研究,构建评测基准很重要。

机器之心
开源动态8

单次训练横扫9个基准,遥感检测最大数据集与基础模型框架问世

北京航空航天大学团队发布面向通用遥感目标检测的大规模数据集与基础模型框架 LEVIRDet,构建了 LEVIRDet - 159 数据集,提出 LEVIRDetNet 模型。前者为训练泛化能力强的模型提供新数据基础,后者在多基准测试中表现出色。

机器之心
算法论文8

用LoRA微调VLM做乳腺癌病理分类,实战对比CNN

哈萨克斯坦团队论文对比CNN和用LoRA微调的VLM在乳腺癌病理分类上的表现。指出VLM微调后接近CNN水平,但CNN仍是王者。还介绍LoRA原理、实验设计、结果,给出实战代码及对从业者和研究者的启示。

机器学习AI算法工程
开源动态8

小模型推理极限在哪里?微博开源3B小模型,比肩顶级闭源

微博新开源的VibeThinker - 3B小模型,将特定能力维度性能推向极限。它在数学竞赛、编程等可验证推理基准上表现优异,成绩直逼顶尖大模型。其训练流程层层叠加,还提出参数压缩 - 覆盖假说。

AIGC开放社区
新闻资讯8

中国九章4.0量子计算机再破世界纪录,比超算快10的54次方倍

中国科学技术大学潘建伟院士团队在Nature发表论文,展示九章4.0量子计算机,它用光子计算,在解决高斯玻色取样问题时比超算快10的54次方倍,还攻克两大核心技术,有重要应用潜力。

DeepTech深科技
产品应用8

香蕉和GPT Image之外的第3条路:华人15人团队造出AI生图黑马

一支不到15人的华人团队推出AI生图模型Uni-1.1,在Arena.ai榜单冲进全球前三。它将推理和生成融入同一模型,创意可控,价格低,已获阿迪等企业认可,未来将拓展到多模态系统。

量子位
推荐文章8

Karpathy的软件3.0:Agent的原生世界

OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位从写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。

AIGC开放社区
新闻资讯8

Anthropic 公布 Claude Code 黑客松六强作品,来自医生、老师、木匠的儿子……

Anthropic公布Claude Code黑客松六强作品,包括虚拟诊室、电路板维修工具、编程教学平台等。这些项目来自不同职业背景的人,用Opus 4.7 + Claude Code完成,将专业知识转化为工具,传承人类经验。

AGI Hunt
新闻资讯7

微软痛失OpenAI 「独家」,七年绑定关系开始松动

微软与OpenAI达成新合作协议,微软对OpenAI模型和产品的知识产权许可变为非独占,有效期到2032年。这一调整为OpenAI将模型部署到其他云平台打开通道,双方合作关系更加灵活。

机器之心