「AI评测」共找到 10087 篇相关文章
一点点偏差,为什么会把大模型 RL 带跑偏?
本文解读Together AI的新算法论文,讲解大模型强化学习中,采样端与训练端的微小偏差如何累积放大导致训练跑偏,介绍Score Centering校正方法的原理、效果与应用边界。
刚刚,Anthropic 宣布:Claude 自己长出了意识
Anthropic新研究《语言模型中的全局工作空间》,在Claude神经网络里找到特殊区域J - space,它有独特性质,对应全局工作空间理论。还介绍了发现方法及多个实验,探讨其与意识关系,研究已开源。
白春礼:人工智能促进科学研究范式变革
白春礼在浦江论坛探讨AI对科研范式变革的影响。他指出,当下科学研究体系面临发现机制、组织方式、知识生产方式的结构性重组,呈现新特征,同时也面临竞争、组织变革等挑战。
狂揽近4万Star!这份Claude Code最佳实践,效率翻倍!
GitHub上`claude - code - best - practice`项目爆火,Star近4万。它是Claude Code全功能实战指南,将「Agentic Engineering」落地开发,解决开发者接入AI的痛点,有结构化方法论、可复用模板等亮点。
Anthropic出手,一批Agent创业公司死去
Anthropic推出Claude Managed Agents,号称几天就能上线生产级智能体。它提供全托管、开箱即用的智能体基础设施,让传统SaaS公司与AI初创公司面临危机,AaaS时代正开启。
狂涨14.4K star!大三学生开发的Github可视化利器,真吊!
开源君介绍`gitdiagram`,这是结合AI与Web开发栈的开源工具,能将GitHub仓库变成交互式架构图。由大三学生开发,获14.4k星标,微软等企业团队采用,性能佳、使用便捷。
比思维链准43%!逻辑脑+大模型直觉,推理可靠性大幅提升
中德研究团队发布成果,给大模型外挂「逻辑脑」,结合答案集编程与LLM,构建神经 - 符号框架,提升空间推理准确率,让AI能说清逻辑、跨任务迁移,迈向更可靠的通用推理。
字节Seed提出M3-Agent:像我们一样"记住"与"思考"的长视频理解新范式
字节Seed提出M3 - Agent,这是首个融合实时视听输入、类人记忆构建与自主推理的多模态智能体。它模仿人类记忆机制,解决长视频理解痛点,已被CVPR 2025收录并开源代码,为通用人工智能奠定基础。
我想给 OpenClaw 接上语音,结果有人先做了
作者一直想用语音对接 OpenClaw,却发现「光帆AI」团队已朝此方向发展。他们用 APP 跑通「耳机 + 服务」链路,后续将迁移到硬件。作者体验后觉得交互爽,还介绍了接入方法、安全模式等。
Feed-Forward 3D综述:三维视觉如何「一步到位」
这篇由12所机构联合撰写的综述论文,总结2021 - 2025年间数百项创新工作,建立Feed - Forward 3D方法谱系与时间线,介绍五大技术分支、应用场景、评测指标与结果,还指出未来挑战与方向。