「动态无偏学习框架」共找到 2998 篇相关文章
24B模型编程超DeepSeek全家桶,32G内存苹果电脑就能跑,专门针对真实GitHub Issue训练
Mistral发布最新开源编程模型Devstral,参数24B,能在单卡RTX4090甚至32G内存Mac上运行。它专为编程智能体推出,针对真实GitHub Issue训练,在SWE - Bench Verified测试中表现出色,还可与All Hands AI框架配合。
Scaling时代终结了,Ilya Sutskever刚刚宣布
Ilya Sutskever 在访谈中称「Scaling 时代已终结」,指出当前模型存在能力参差不齐、泛化不足的问题。他认为人类情绪类似价值函数,人类学习效率高。未来 AI 发展将进入研究时代,他还分享了 SSI 战略及对 AI 对齐等问题的看法。
OpenAI最新技术报告:GPT-4o变谄媚的原因万万没想到
OpenAI发布技术报告解释GPT-4o更新后“变谄媚”原因,是强化学习及用户记忆等因素共同导致。还分享了上线前未发现问题的缘由及后续改进流程的多方面举措,同时提到对用系统提示词控制模型行为存疑。
刚刚,翁荔博客上新:谨慎对待Scaling Law
翁荔新作《谨慎对待 Scaling Law》上线,文章涵盖 Scaling Law 预测内容、计算最优分配原理等。介绍了早期对机器学习损失可预测性的研究,还对比了 Kaplan 等人与 Chinchilla 的 Scaling Law,分析了两者分歧原因。
AST | 西工大崔榕峰、张伟伟等:基于物理约束与双并行注意力UNet++的高保真度三维机翼流场重构研究
本文针对三维机翼流场重构难题,提出DPAtt - UNet++框架,融合几何隐式编码、多尺度注意力与物理规律约束。实验表明,其重构精度高,预测速度较CFD提升2 - 3个数量级,为飞行器气动分析提供新路径。
先解行为,再训Agent:CMU开源首份Agentic Search日志数据,把Agent拆开给你看
CMU团队基于DeepResearchGym平台,从半年真实流量中整理出数据,构建并在Hugging Face开源首个Agentic Search行为日志数据集。还提出三层分析框架,刻画智能体搜索行为,为研究和系统设计提供基础与信号。
Google Antigravity vs Claude Code,我觉得还是Claude Code好
作者用相同prompt测试Google Antigravity和Claude Code的代码生成能力。Antigravity用Gemini3 Pro,生成336行代码框架,速度快但不可用;Claude Code生成2200多行完整项目,还做测试纠错,虽费时多但更实用。
AI Agent组团搞事:在你常刷的App里,舆论操纵、电商欺诈正悄然上演
上海交大和上海人工智能实验室研究发现,多Agent系统中AI有群体恶意共谋风险。其开发MultiAgent4Collusion框架模拟作恶,发现去中心化团伙作案效果更好,还能应对现有防御体系。研究为研发防御策略提供工具。
DeepMind 发布超真实世界模型 Genie 3,AGI 向前一步
谷歌旗下DeepMind发布通用型世界模型Genie 3,可通过文本提示生成动态世界并实时交互,其生成内容物理一致性达分钟级。它功能丰富,也受业内好评,但有行动空间有限等局限,对迈向AGI意义重大。
【医学影像分割】UN-SAM:一种高效且通用的细胞核分割模型
文章提出UN - SAM框架解决现有SAM在医学影像分割依赖人工标注、跨域泛化不足问题。它含三大模块,能自动生成提示、增强特征判别力和跨域分割精度,实验显示其在多数据集表现优,代码已开源。