验证循环」共找到 960 篇相关文章

算法论文8

单卡即可微调大模型!内存占用仅1/8,性能依然拉满 | ICML 2025

基础大模型应用于下游任务时微调成本高,低秩适应(LoRA)方法虽降低成本,但性能不及全量微调。华中科技大学和香港中文大学团队提出GOAT框架,在25个多领域任务验证效果好,内存占用仅1/8。

量子位
算法论文8

LLM 竟然会内省!Anthropic 整了个大活:首次揭开 AI 意识

Anthropic最新研究《大语言模型中涌现的内省意识》,首次通过直接操控模型内部状态验证AI能否觉察自己思想。研究采用概念注入技术,发现AI有内省能力,且不同模型表现有差异。

PaperAgent
7

编程“学废”了?普渡毕业却只获烤肉店面试!美国IT失业创新高:AI面试成最大屈辱,网友怒称宁愿失业!

随着AI编程工具普及和科技大厂裁员,美国计算机领域黯淡,应届生求职梦碎。2025年美国IT就业疲软,失业率创新高。毕业生陷入AI“恶性循环”,AI面试也让求职者体验糟糕,有人担忧信息泄露。

AI前线
产品应用7

6个Agent组团Vibe Gaming:自己生成、试玩、修Bug

过去大模型生成的游戏虽代码能跑,但常陷入“可玩性黑洞”。Spellcaster让多个专用Agent协同处理,形成“生成—运行—检查—修复”循环。目前能快速生成多种游戏原型,未来将用世界模型直接生成画面。

量子位
推荐文章8

76%的性能提升与模型无关?Karpathy 700次 Loop 实验揭开 Agent 最大误区

前OpenAI联合创始人Andrej Karpathy警示业界重视模型框架。Hugging Face实验表明优化模型外层执行机制可大幅提升Agent性能,Karpathy开源项目揭示AI价值在循环迭代。还介绍了搭建持续进化Agent的方法及注意事项。

InfoQ
推荐文章7

什么时候不该微调:比“怎么微调”更重要的一件事

文章指出微调失败常因一开始就不该调。强调微调解决行为问题而非能力问题,还列举了不该微调的五种场景,如知识接入问题、Prompt没写好等,建议先验证思路,明确目标再行动。

机器学习AI算法工程
新闻资讯7

AI泡沫后只剩这两类公司杀出重围!昆仑万维CEO方汉:明年唯一技术赛点在Agent

昆仑万维CEO方汉认为,AI泡沫是必经阶段,产品价值落地成主线,生态是系统工程。今年两类公司突围,四类公司落后。2026年技术赛点是Agent自动化‘可验证过程’。

InfoQ
推荐文章7

对科技圈,小红书是个「新绿洲」

作者认为小红书正成为科技圈的「新绿洲」,这里有独特的「人间视角」。科技内容消费模式似「人间夜市」,博主和开发者圈点翻译技术概念。创业者可低成本验证想法,与用户形成「养成系」共生关系。

量子位
算法论文8

端到端智驾新SOTA | KnowVal:懂法律道德、有价值观的智能驾驶系统

北京大学王勇涛团队提出新型自动驾驶系统 KnowVal,通过感知与知识检索模块协同实现视觉 - 语言推理。它构建驾驶知识图谱,有价值模型用于轨迹规划,实验在多基准测试表现佳,还通过定性分析验证效果。

机器之心
新闻资讯8

AI时代UI已死?Karpathy称产品要给AI开后门,还分享了自己的AI编程心法

Andrej Karpathy指出,只有复杂UI、无脚本支持、基于不透明二进制格式的软件产品,在AI时代会被淘汰。他给出风险评估清单,还分享AI编程心法,探讨编程中‘验证鸿沟’问题。

AGI Hunt