训练导向问题」共找到 4941 篇相关文章

算法论文8

CVPR 2026 | 1000万段驾驶视频,教会模型如何估计相机位姿

Wayve的LA - Pose研究,不依赖百万级3D标注,从约1000万段未标注驾驶视频自监督学习‘潜在动作’,再用少量3D标注微调,转化为相机位姿估计能力,在多基准上提升精度且泛化能力强。

机器之心
新闻资讯7

所有人在让Agent更强,YC却投了一家靠Agent翻车赚钱的公司。

YC孵化的新公司Mount给AI Agent卖保险。如今企业大量使用Agent,但翻车规模也在扩大。Agent频繁出事或因引入新型债务,工程手段只能降低风险,剩余风险可被保险覆盖。YC CEO有独特比喻。

探索AGI
新闻资讯8

人类56年解不出,谷歌AI一夜连破9道世纪难题!

Google DeepMind发布全新AI数学智能体AlphaProof Nexus,一次性攻克9道悬而未决几十年的Erdős开放问题,最老的已悬置56年。证明经Lean编译器验证,无错误可能。此外,还在多数学分支取得突破。

新智元
新闻资讯7

H100去哪儿了?

X 用户疑问引发关注,H100 供应下降成算力危机。超大规模云厂商和前沿实验室提前锁定产能,核心短缺在于内存与封装工艺。算力危机冲击 AI 生态,产业界有应对方法,但短缺问题短期内难解决。

机器之心
新闻资讯7

北大光华院长最新对谈:未来奖学金可以用 Token 发

5月12日晚,北大光华管理学院院长田轩与Kimi总裁张予彤就‘AI时代的边界探索与人才机遇’展开对谈,探讨了AI带来的新工作、学生培养、企业管理、人才招聘等问题,张予彤提出诸多独到见解。

特工宇宙
新闻资讯7

干掉 .md?兜里 Token 不够,没法和 Karpathy 共情

近日,围绕‘Markdown 是否已过时’讨论升温。Theo Browne 视频阐述‘HTML 优于 Markdown’五大理由并分享实操技巧,虽指出 HTML 有费 Token、版本控制差问题,但仍倾向用 HTML,不过也有开发者质疑。

InfoQ
推荐文章7

深度解析LLM Wiki / Obsidian-Wiki / GBrain:Agent时代知识的“自组织”与“自进化”

文章深度解析LLM Wiki、Obsidian - Wiki和GBrain项目,探讨Agent时代知识的“自组织”与“自进化”。指出传统知识管理有短板,而这些项目通过不同方式解决知识结构化、沉淀和更新问题,各有优劣。

阿里云开发者
新闻资讯8

AI能改10万行代码,却让你走路去洗车!Karpathy戳破「锯齿状智能」

Karpathy在Sequoia AI Ascent 2026炉边谈话指出,AI能力呈锯齿状,背后是经济学问题。他还提及软件新地平线,认为Vibe Coding抬高编程地板,专业开发需智能体工程,人类在智能体时代是工程导演。

新智元
算法论文8

重新审视SFT的泛化能力:优化动态、数据与模型能力的条件性分析

上海人工智能实验室等联合研究质疑了‘SFT倾向于记忆,RL实现泛化’观点,指出SFT泛化是条件性现象,受优化动态、训练数据、基模型能力影响,还揭示长思维链SFT会带来安全性能退化。

AI科技评论
算法论文8

让方程发现走向超大规模系统——《Predicting Dynamics of Ultra-Large Complex Systems by Inferring Governing Equations》精读笔记

论文《Predicting Dynamics of Ultra-Large Complex Systems by Inferring Governing Equations》提出Sparse Identification Graph Neural Network(SIGN),将方程发现工作流重新安排,在多类系统实验中展现可扩展性与长期预测能力,还在海表温度数据中恢复出共享动力学表达。

力学与人工智能