「Agent 3」共找到 4413 篇相关文章
Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本
大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。
罗福莉携小米MiMo-V2-Flash首次亮相:一次在推理与Agent上的下注|甲子光年
大模型进入新阶段,效率成能力一部分。小米MiMo团队12月16日晚发布并开源MiMo - V2 - Flash,负责人罗福莉首亮相。该模型在推理、编程和智能体场景表现出色,在架构、训练方法等有创新。
用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架
张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。
英伟达推出下一代计算平台Rubin:可用45°C的热水进行冷却,训练速度提高3.5倍
英伟达黄仁勋在CES演讲,宣布进入自动驾驶领域、推出Alpamo模型与下一代计算平台Rubin。他指出计算行业正经历平台性转变,还介绍AI进展、应用架构,Rubin平台性能强且能效高。
刚开源仅3天狂揽4.9K star,轻量超高效版OpenClaw,10美元硬件就能跑!
OpenClaw火遍全网但硬件要求高、成本不菲。新开源的PicoClaw是其轻量替代方案,由Sipeed开发,内存占用少、启动快、成本低、便携性强,安装简单,功能多样,刚开源就成热议新星。
从MiniMax到DeepSeek:为何头部大模型都在押注「交错思维」?
昨日推特博主公布国内几大开源模型在 mini - SWE - agent 测试成绩,MiniMax 新一代大模型 M2 表现最佳。其采用的「交错思维」技术成亮点,解决了状态漂移问题,正成高性能 Agent 模型标配。M2 既强又省,还给出使用最佳实践。
曝GPT-5.5用上「全球最快芯片」,Claude慌了!
新智元报道,OpenAI的GPT - 5.3 - Codex - Spark用Cerebras的WSE - 3芯片达2000 token/秒。Cerebras CFO称在跑GPT - 5.4和GPT - 5.5,但SemiAnalysis报告指出其跑大模型有短板,且公开云模型小、上下文短。
陶哲轩DeepMind梦幻联动,最强通用科学Agent来了!一口气解决芯片设计、矩阵乘法和300年几何难题
谷歌DeepMind与陶哲轩等打造的AlphaEvolve是LLM驱动的进化编码Agent。它能优化计算生态、调度数据中心等,还解决了数学难题,已在谷歌内部使用,现开启早期邀测试用。
硅谷大厂开始AI-first换血:先裁3万人、再招8000个新人,传统产品经理正在被Builder淘汰!
随着AI浪潮席卷,产品经理职业正经历“角色重定义”,需成为“builder”。Nikhyl Singhal指出,未来12 - 24个月会“先大规模裁员,再大规模重招”,builder将迎来好时代,产品管理将更重构建与创造。
回归C++: 在GGUF上构建高效的向量模型
Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链的优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。