「后训练策略」共找到 4353 篇相关文章
Karpathy的软件3.0:Agent的原生世界
OpenAI联合创始人Andrej Karpathy在Sequoia Ascent大会上表示,AI Agent正改变软件与工作模式。编程基本单位从写代码变为给Agent下达指令,软件3.0以上下文窗口为程序,LLM为解释器。他还提出理解AI能力分布的框架,给出创业建议。
大型挂机现场:马斯克的55万英伟达GPU,利用率才11%
《The Information》报道,马斯克旗下xAI有55万英伟达GPU,利用率仅11%。原因包括大规模部署协调难、数据传输瓶颈和训练间歇性。这是行业普遍问题,xAI着手解决,设定50%利用率目标。
Codex 推出 /goal 功能,不达目标,不罢休
OpenAI 为 Codex CLI 新增 `/goal` 功能,目标跨轮次保持活跃,在同一个会话持续循环。它有防护机制,防止在无意义事上空转。虽然是实验性功能有局限,但改变了人和 AI 的协作界面。
数学的上帝粒子!一个运算符能导出所有基本函数
波兰雅盖隆大学的Andrzej Odrzywołek在论文中指出,仅用一个叫EML的二元运算符加常数1,就能推导科学计算器上所有基本函数,还可能为机器学习符号回归提供新思路。
1M 参数干翻 200M!时序预测选模型,你可能一直都选错了
近期时序预测领域新模型频出,作者开源的 QuitoBench 显示,参数量仅 1M 的 CrossFormer 击败大模型夺冠。它还揭示模型选择与历史数据长度有关,且数据边际收益高于参数。
武大文科教授硬核跨界AI:半年项目量猛涨4000%,重构AI图表生产力
武汉大学王琼教授团队推出全球首个AI图表智能体“爱图表”,解决AI做图表的行业痛点。它不止生成,更可深度编辑,实现从“模板驱动”到“内容驱动”转变,秉持“白盒”理念,商业价值爆发。
NeurIPS滑跪认错!一切都是误会,已纠正
NeurIPS 2026年征稿规则以遵守美制裁规定为由,禁止美清单上的中科研机构等参与学术活动。CCF强硬发声、中国科协给出反制措施后,NeurIPS公开道歉,称是沟通误解。
当数据库的主要用户不再是人类:我们在 AI Agent 场景下的架构实践与思考
文章分享了服务 AI 公司时在 Agent 场景下数据库架构的实践与思考。介绍 Agent 工作负载特征,通过三个案例说明数据库面临的挑战及解法,还提到新需求催生开源项目 mem9,并给出实践教训,指出 AI 时代数据基建重要性。
OpenClaw 引爆 AI 安全焦虑,Armadin 的 Agent 攻防闭环会成为新范式吗?
OpenClaw走红使agent自主执行任务能力受关注,也带来网络安全风险。传统安全体系难应对,Google高价收购云安全公司释放信号。Armadin构建agent swarm系统形成自主防御闭环,介绍其理念、产品、案例及面临的技术挑战。
谨慎用OpenClaw:上海科技大学发布其全面安全体检报告
上海科技大学联合上海人工智能实验室对爆火的智能体OpenClaw做安全审计,在34个测试场景中,整体安全通过率58.9%,暴露出多方面问题,研究据此给出纵深防御策略。