「大语言模型(LLM)」共找到 8349 篇相关文章
“光顾赚钱不搞研究”,OpenAI元老级高管出现离职潮,Mark Chen紧急回应
OpenAI现元老级高管离职潮,如研究副总裁Jerry Tworek等。《金融时报》称与战略转向有关,Mark Chen反驳。内部因专注LLM撕裂,缺算力致资源集中ChatGPT,OpenAI危机四伏。
北大校友、华人学者金驰新身份——普林斯顿大学终身副教授
华人学者金驰宣布在普林斯顿晋升为终身副教授,任命2026年1月16日生效。他在机器学习理论领域贡献大,为LLM崛起提供数学基石,解决非凸优化和强化学习样本效率等问题。
新的 Rust 客户端致力于实现基于 Aerospike 的安全、高性能应用
Aerospike正式发布Rust客户端,用于与其实时NoSQL数据库交互。采用异步优先并发模型,支持批命令等。还将支持分区查询等功能,Aerospike也提供其他客户端库助开发者构建应用。
3.8K星爆款!Google「langextract」可视化溯源,信息抽取神器
Google的「langextract」在GitHub获3.8K星,是信息抽取神器。它有精准源定位、可靠结构化输出等特点,支持多种LLM,适用于各领域,文章还给出实战代码示例。
开源TTS语音新标杆!Kyutai TTS:350ms延迟碾压全场,词级时间戳重构!
法国AI实验室Kyutai开源高性能TTS语音模型Kyutai TTS,基于DSM框架,支持流式输入、超低延迟与高保真语音生成,有多项亮点,还给出不同使用方式及应用场景。
一篇双引擎进化的长程Agents系统性综述
人大、北大、清华等联合发表149页长时程Agent综述,给出首个统一形式化定义,梳理出‘外化Harness工程×内化模型优化’双螺旋共演化主线,用六个视角串起技术版图。
Mythos逼谷歌再拉红色警报!布林连夜成立Coding突击队
Claude Mythos来势汹汹,谷歌拉响红色警报,布林和CTO成立Coding特攻队。团队重点提升模型复杂编程任务表现,还将内部代码纳入训练数据,且推动员工用编程工具。
VLA别再「走神」:即插即用提升视觉泛化,相对Pi0.5提升18%
至简动力、北大、港中文团队发现VLA模型深层动作预测对关键视觉区域依赖下降,提出DeepVision - VLA框架,在仿真和真实任务中效果显著,能有效提升视觉泛化能力。
半夜被AI「吓醒」!57岁导师投奔24岁华人女学霸,打造「AI数学家」
57岁杰出数学家Ken Ono辞去终身教职,加入24岁学生Carina Hong创办的Axiom Math。Carina履历逆天,想打造「AI数学家」。Ken受研讨会冲击,看好AI数学潜力,将助力模型发展。
提示词分享:帮助在 Hacker News 或者 Reddit 这样的讨论贴中提取精华内容
分享了在 Hacker News 或 Reddit 讨论贴提取精华内容的提示词,介绍最佳模型为 Gemini 2.5 Pro,还给出角色定位、工作流程、写作风格技巧及禁止出现的表达方式。