「领域大模型」共找到 9956 篇相关文章
图灵奖得主杨立昆:中国人并不需要我们,他们自己就能想出非常好的点子
本文是对图灵奖得主杨立昆的访谈,他批判当前大语言模型局限性,指出难以靠扩大规模达人类水平AI。还强调理解世界需非生成式架构,如JEPA。同时以DeepSeek为例,称开源发展更快,中国人能想出好点子。
以史为鉴:从互联网泡沫到英伟达五万亿
文章回顾互联网发展历程及泡沫破灭影响,对比当下AI浪潮,指出英伟达成首家市值破五万亿美元公司。探讨AI是否为泡沫,认为其未来发展或类似互联网,还分析英伟达走势及国产GPU替代、AI边缘推理领域前景。
我给阶跃星辰 Step 5 Preview 出了一道工程题
本文作者池建强参与阶跃星辰新一代旗舰大模型Step 5 Preview小范围内测,设置带两层bug和隐藏需求的编码工程题,与Qwen 3.8 Max、Kimi K3对比测试,分享实际项目使用体验,给出客观评测。
告别「只会相似度检索」:腾讯最新T-Mem让AI学会「联想回忆」
当前大语言模型长期记忆方案均基于相似度检索,存在结构性盲区,无法在无字面/语义相似时召回关联记忆。腾讯团队提出T-Mem,实现AI联想回忆,已被EMNLP 2026接收,代码开源并上线QQ AI伙伴。
Momenta港股上市:一个智驾供应商为何要讲物理AI?|甲子光年
今日Momenta在港交所上市,此前赴美上市搁浅。虽盈利状况优于同行,但研发投入大,累计亏损高。上市前夕其从‘自动驾驶公司’变为‘物理AI公司’,欲用物理AI模型打通多市场,这也是行业趋势。
5Y News | AI-native投资管理公司GIM完成数千万美元A轮融资
近日,AI-native智能投资管理公司GIM完成A轮数千万美元融资,由弘毅投资旗下金涌投资和B Capital联合领投。公司沿着垂域大模型和自进化智能体系统两条主线建设资管基础设施,已进入实战阶段。
多模态后训练反常识:长思维链SFT和RL的协同困境
华为与香港科大研究发现,多模态视觉语言模型中,长思维链SFT与RL组合难协同增益。研究引入难度分类方法构建数据集,分析各方法表现及组合策略困境,还给出实验发现与未来研究方向。
从OpenAI离职创业到估值1700亿美元,Anthropic用4年时间引硅谷巨头疯狂押注
最新消息,Claude背后公司Anthropic即将达成新一轮融资50亿美元,总估值达1700亿,不到半年估值涨近3倍。该公司由前OpenAI员工创立,获亚马逊、谷歌等投资,其模型在代码生成领域优势明显。
Altman 嘲讽 Meta 挖走的不是顶尖人才,OpenAI 高管首曝内幕:ChatGPT 如何让我们一夜“封神”
AI 领域人才抢夺激烈,Meta 招募 AI 人才触动 OpenAI。OpenAI CEO Altman 嘲讽 Meta 没挖到顶尖人才,还透露正评估薪酬。同时,OpenAI 播客揭秘 ChatGPT 幕后,包括名称由来、传播、内部辩论等,也谈到模型问题及应对。
英伟达中国一把手造国产GPU,冲刺IPO了
摩尔线程完成上市辅导,冲刺IPO。其创始团队来自英伟达,创始人张建中深耕GPU近二十年。公司产品丰富,涵盖全功能GPU、大模型训推产品、专业和游戏显卡等。同时介绍了燧原和壁仞的上市情况。