「机器学习」共找到 1579 篇相关文章
斯坦福教授直播训练535B大模型,模型训练背后的「黑箱」正在被打开?
斯坦福教授Percy Liang宣布由Marin开放实验室启动训练Marin 535B - A23B模型,全程公开。过去大模型训练像“黑箱”,此次尝试让训练可观察、可讨论、可协作,引发网友关注。
开启Benchmark的Harness时代:15家学术机构联合发布HarnessEval
8月13日,DeepSeek开源Agent Harness dsh引发行业对“Harness”的关注。近日,MirroS联合多机构发布HarnessEval,将其概念引入评测系统。它使评测从Metric到Harness,形成可执行评测系统,已落地于交互式世界模型。
让 Coding Agent 开始「记住过去」:MemoraX Code 的长期记忆系统
过去一年,Coding Agent 改变开发者写代码方式,但进入长期开发仍会遗忘项目经验。MemoraX Code 试图解决此问题,构建了本地与云端记忆,让关键信息能被识别召回,且在赛事中表现出色,还能沉淀工程经验。
视觉AI从「会生成」走向「能创作」,RabbitVis探索AI应用新范式
随着AI生图能力提升,如何让AI进入创作流程成新问题。兔展智能基于UniWorld - Design视觉AI大模型推出RabbitVis,推动视觉AI从图片生成走向可编辑、可交付的创作流程,解决创作流程断点问题。
所有Harness终将长成“龙虾”,但最后活下来的只有几只
在用户需求驱动下,工具从 LLM 向 Agent、Harness 再到 Claw 自然进化,但用户能容纳的 Claw 有限。Sam Bhagwat 拆解进化路径,指出各阶段核心竞争力,开发者应抢占用户心智空间。
Karpathy刚进Anthropic,转头又投了它
AI初创公司Engram成立8个月,估值达6亿美金,获9800万美元融资。它聚焦AI记忆,用Cartridges技术降内存、提速度,将推理和记忆层拆开,团队成员背景强大,押注AI范式新转向。
太意外!教皇和Anthropic创始人,要联袂开发布会
5月26日,教宗利奥十四世将发布通谕《Magnifica Humanitas》聚焦「AI时代对人的保护」,Anthropic联合创始人Chris Olah受邀。梵蒂冈同步成立AI委员会。但有人质疑这是道德外包或公关道具,全球也缺乏有效约束AI发展的机制。
SeePhys Pro:重新审视多模态物理推理中的视觉理解与训练收益
来自中山大学等的研究者提出SeePhys Pro,是面向多模态物理推理的细粒度评测与训练诊断框架。发布了benchmark、训练集等,测评显示当前模型在信息模态转变时不稳定,为模型评测和训练研究提供基础。
吴恩达:最快的团队,人人都是产品经理
吴恩达在最新编辑信中指出,AI编程工具提升开发速度后,瓶颈转移到‘决定做什么’。传统团队配比失衡,最快团队让工程师身兼PM和工程师。Claude Code团队实践与之相符,AI时代人人应成通才。
从Vibe Coding到Wish Coding,AI编程迎来C端拐点
近期Vibe Coding刷屏,虽提升编码效率,但未降低交付门槛。蚂蚁灵光App升级,以Wish Coding重构软件生产关系,实现从想法到应用的闭环,虽有粗糙之处,但打开普通人创造应用新可能。