「今天学点啥App」共找到 818 篇相关文章
李国杰院士:AI4S里程碑式重大成果综述
本文由李国杰院士撰写,对AI for Science近年里程碑式突破做全面综述,涵盖数学、物理、化学等多领域成果,如李雅普诺夫函数构造、AI辅助核聚变等,还探讨了AI4S潜力与挑战。
专治智能体盲跑!微软发布AI Agent 5大可观测性,打通任督二脉
今天凌晨微软官网发布AI Agent 5大可观测性最佳实践,解决智能体盲跑等难题。介绍了智能体可观测性概念和好处,展示5个应用案例,还阐述5大实践,如选模型、持续评估、集成CI/CD等。
刚刚,马斯克发布Grok-4,在各大基准测试上表现太猛了。
马斯克的 xAI 发布 Grok - 4,在各大基准测试表现出色,如 AIME25 拿满分、GPQA 领先等。第三方测评显示其登顶,编码和数学指数居首。价格与 Grok 3 相同,今日上线但价格高,甚至有已售罄情况。
最低仅需2G显存,谷歌开源端侧模型刷新竞技场纪录,原生支持图像视频
今天凌晨,谷歌官宣Gemma 3n,原生支持多模态。它在大模型竞技场超1300分,是首个超此分数的10B以下模型。其VRAM占用低,最低2GB,已在谷歌AI Studio等可用,还公开了技术细节。
对谈 DeepSeek-Prover 核心作者辛华剑:Multi Agent 天然适合形式化数学 |Best Minds
文章是对 DeepSeek-Prover 核心作者辛华剑的访谈。他认为强化学习是 AGI 关键解法,Multi Agent 适合形式化数学。还探讨了 DeepSeek Prover 进展、数学与 AGI 关系、评测基准等,指出未来有全才模型和自主 Agent 出现。
社区供稿丨Ring-2.5-1T,思更深,行更远
今天发布并开源万亿参数思考模型 Ring-2.5-1T,在生成效率、思考深度、长程执行上大幅提升。与其他模型对比,在高难推理和长程任务执行达开源领先。介绍架构优势、手搓案例,也提及不足与未来计划。
比人类专家快2倍,斯坦福联合英伟达发布TTT-Discover:用「测试时强化学习」攻克科学难题
斯坦福与英伟达等机构联合提出 TTT - Discover 方法,让 LLM 在测试时强化学习。它在多任务上成绩出色,如在数学、GPU 内核等领域超越人类和其他 AI,计算成本低,或为持续学习打开新空间。
关于我用ChatGPT模拟撒旦并支付了订阅费这件事
新智元报道,硅谷科技巨头将AI注入基督教领域,出现如「Text with Jesus」等App。信仰交互变即时亲切,神成算法打造的伴侣。但也有争议,如算法妥协、恶魔付费解锁等,这像数字巴别塔,挑战传统信仰。
吴恩达年终总结:2025是AI工业时代的黎明
吴恩达发表2025人工智能年度总结与公开信。总结指出,今年推理模型性能提升但有成本,AI人才争夺激烈、薪酬高,数据中心建设投入大,智能体让编程更高效。信中建议通过学课程、动手实践和读论文构建AI系统。
GPT-5.2果然反超谷歌Gemini 3 Pro!北大数院校友核心贡献
OpenAI在成立十周年推出GPT - 5.2,相比GPT - 5.1在多实用领域更强,视觉理解等能力提升。ARC - AGI测试中得分超谷歌Gemini 3 Pro。拆解其多方面能力,还介绍核心团队多为数学专业新面孔。