「AI研究智能体」共找到 11929 篇相关文章
Thinking Machines曝LoRA终极指南:10倍学习率,媲美全参微调
Thinking Machines推出论文《LoRA Without Regret》,研究LoRA与FullFT达到相近表现的条件。通过实验发现,把握关键细节,LoRA可与FullFT性能相当,还探讨了关键因素、批大小效应等内容。
Gemini灵魂人物加盟xAI,马斯克亲自夹道欢迎!
前谷歌DeepMind资深研究员Dustin Tran加盟xAI,他是Gemini共同创造者,助谷歌追回AI风口。Tran介绍跳槽原因,涉及算力、数据和认同马斯克理念,还补刀OpenAI点子库存见底。
蚂蚁开源MedResearcher-R1医学知识图谱+多跳推理
医学领域需处理复杂关系,现有医学AI系统缺乏对罕见实体和复杂关系的推理能力。MedResearcher - R1通过专门图谱和检索工具,结合两阶段训练范式解决问题,在医学基准测试取得新成果。
直播预约 | Transformer 模型能否通过连接训练数据中的离散知识进行推理?
为研究Transformer是否具备组合式推理能力,提出FTCT合成任务。实验发现Few - shot CoT提示可激发推理能力,训练与测试相似度、模型复杂度影响推理能力。还分析了其内在机制,展示其泛化推理潜力。
智谱发布GLM 4.5,不仅开源模型还把训练框架也开源了
智谱AI发布GLM 4.5,不仅开源模型,还开源整套后训练基础设施。模型规格亮眼,性能也超越qwen 235b。其开源的训练框架slime专为强化学习扩展设计,完整工具链支持多种模型。
XBOW 发现Wordpress 任意文件读取漏洞的过程
XBOW用AI系统做全自动化渗透,在HackerOne排名第一。其博客文章分享发现WordPress Ninja Tables插件任意文件读取漏洞的过程,从侦察端点到编写脚本攻击,最终确认漏洞并进行了负责任披露。
Meta离职大牛千字「血书」,怒揭黑幕!内斗、抢功、末位裁员,全是毒瘤
Meta前研究员Blankevoort发2000字「血书」,控诉公司文化崩坏、末位淘汰如毒瘤、团队抢功无下限。他指出AI业务深陷泥潭,各部门内斗,合作缺失。Meta领导层重视此事,天价挖人能否带来改变存疑。
印裔1号位删 Karpathy 团队90%代码、算力暴涨 50 倍!马斯克 Robotaxi 10年终上线,30 元乘车体验刷屏
当地时间6月22日,特斯拉在奥斯汀启动Robotaxi试点服务,仅受邀用户参与。其技术基于FSD 13.2.9微调,团队精简90%代码,算力强大。虽面临竞争,但马斯克看好其发展,认为2026年或现超级智能。
最全面人类细胞图谱发布:110万个细胞看清调控与衰老
本文是对最新发表的Tabula Sapiens 2.0人类细胞图谱的专业解读,该图谱相比1.0细胞量翻倍至110余万个,覆盖28种组织,解析了细胞调控机制与细胞衰老特征,且完全开放供研究使用。
Claude和GPT思维链竟被两步蒸馏!116页论文曝光API致命漏洞
2026年AI蒸馏成悬案,一篇116页论文砸穿巨头「黑盒」。研究人员用低价小模型恢复Claude、GPT和Gemini原始推理,还发现API漏洞存在跨会话、用户和模型互通情况,收集公开轨迹泄露诸多敏感信息。