「大模型管理」共找到 9609 篇相关文章
不再迷信Hackathon,把Agent推翻重做了4次!Notion负责人复盘:做AI产品如何避免“逆流而上”?
Notion负责人复盘Agent开发历程,指出AI替代的是流程。他们将模型、产品和权限接入同一框架,历经多次重构,还探讨了组织管理、评估体系、软件工厂等内容,分享对CLI和MCP的看法及产品定价策略。
图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子
本文是对图灵奖得主杨立昆的访谈,他批判当前大语言模型局限性,指出难以靠扩大规模达人类水平AI。还强调理解世界需非生成式架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。
蚂蚁VLDB最佳论文:用一张“逻辑表”驯服3050亿条训练数据
蚂蚁集团论文《OmniTable: A Unified Wide-Table System for Petabyte-Scale LLM Data Curation and Exploration》获VLDB工业赛道最佳论文。其研发的OmniTable系统能管理超35PB、3050亿条以上训练数据,解决数据准备难题,如在SFT任务中大幅缩短周期。
我给阶跃星辰 Step 5 Preview 出了一道工程题
本文作者池建强参与阶跃星辰新一代旗舰大模型Step 5 Preview小范围内测,设置带两层bug和隐藏需求的编码工程题,与Qwen 3.8 Max、Kimi K3对比测试,分享实际项目使用体验,给出客观评测。
告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」
当前大语言模型长期记忆方案均基于相似度检索,存在结构性盲区,无法在无字面/语义相似时召回关联记忆。腾讯团队提出T-Mem,实现AI联想回忆,已被EMNLP 2026接收,代码开源并上线QQ AI伙伴。
Momenta港股上市:一个智驾供应商为何要讲物理AI?|甲子光年
今日Momenta在港交所上市,此前赴美上市搁浅。虽盈利状况优于同行,但研发投入大,累计亏损高。上市前夕其从‘自动驾驶公司’变为‘物理AI公司’,欲用物理AI模型打通多市场,这也是行业趋势。
分析了1.8亿个岗位后,我发现应届生们好像被AI堵在了门外。
文章分析1.8亿个岗位发现,AI使应届生就业难,创意和执行类岗位受冲击大,管理层岗位相对稳定。如应届生毕业即失业,执行岗减少使学徒制传承受阻,长远看不利于文明进步。
多模态后训练反常识:长思维链SFT和RL的协同困境
华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。
英伟达中国一把手造国产GPU,冲刺IPO了
摩尔线程完成上市辅导,冲刺IPO。其创始团队来自英伟达,创始人张建中深耕GPU近二十年。公司产品丰富,涵盖全功能GPU、大模型训推产品、专业和游戏显卡等。同时介绍了燧原和壁仞的上市情况。
Spring AI 实战|Spring AI入门之DeepSeek调用
文章介绍Spring AI框架,它简化企业数据或API服务与大模型集成,降低开发复杂度。还给出调用DeepSeek的实战步骤,包括手动请求、代码自动发起、实现流式响应等,也提及OpenAI starter的兼容性及生产环境监控。