大厂自研」共找到 5843 篇相关文章

新闻资讯8

震撼全网!3位00后夺200万奖,卷走鹅顶级Offer

历经四个月,「腾讯广告算法赛」战果揭晓,「Echoch」战队夺冠,另有两支战队杀入三甲,前十名全员获鹅Offer意向书。赛事揭示推荐系统正迈入「端到端生成」新纪元,各战队方案亮点多。

新智元
新闻资讯7

AI圈深夜乱斗!OpenAI、谷歌、Anthropic发布新模型,集体翻车?

昨晚,OpenAI时隔六年再次开源`gpt-oss-120b`和`gpt-oss-20b`,Anthropic发布`Claude Opus 4.1`,Google发布Genie 3及写故事书功能。不过OpenAI新模型幻觉率高,Anthropic更新提升有限。

探索AGI
新闻资讯7

Anthropic发最高警告:0day爆发即将来临!全球巨头瞬间蒸发数十亿

Anthropic发布新模型预览版Claude Mythos Preview,它在测试中表现惊人,致网络安全巨头Cloudflare股价暴跌。这动摇了SaaS帝国根基,Anthropic启动计划发布生存指南,却遭顶级黑客质疑。

新智元
新闻资讯7

突发!特朗普刚刚发布《美国AI计划》,OpenAI、微软、亚马逊成赢家

今天凌晨,特朗普公布《美国AI行动计划》,含加速AI创新、构建基础设施、主导外交安全三支柱及90多项行政命令,旨在让美成全球AI霸主,还将中国列为对手,多官员表态肯定该计划。

AIGC开放社区
算法论文8

何恺明首个语言模型:105M参数,不走GPT回归老路

何恺明团队推出全新连续扩散语言模型ELF,不走GPT回归老路。它将生成过程留在连续embedding空间,最后离散化变回token。ELF用较少参数、训练token和采样步数,跑赢主流扩散语言模型。

量子位
推荐文章7

AI越强,企业越迷茫:顶尖CIO们的十真实之问

阿里云CIO与40余家头部企业CXO深度碰撞,总结出《企业智变下的CIO集体之问》。报告指出企业AI落地困境,如数字人认知混沌、知识库建设难等,探讨十经典问题,为企业提供思考方向。

InfoQ
算法论文8

模型长脑子了?研究发现LLM中层会发模拟人脑进化

帝国理工学院等机构研究人员发表论文,指出型语言模型(LLM)学习中会发演化出类似生物脑的协同核心结构。研究对多个模型剖析,揭示其内部处理规律,为模型可解释性开辟新路径。

机器之心
开源动态8

专为“超模型而生”,新一代训练引擎 XTuner V1 开源!

9月8日,上海AI实验室开源书生模型新一代训练引擎XTuner V1。它能应对复杂训练场景、速度更快,尤其在超规模稀疏混合专家(MoE)模型训练中优势显著。还将一并开源AIOps工具DeepTrace与ClusterX。

OpenMMLab
推荐文章7

深刻理解Token:语言模型(LLM)是如何看待这世界?

文章指出在语言模型(LLM)中,Token是处理文本的基本单位。介绍了Token的概念、分词方法、向量化过程,还阐述了分词对模型性能的影响,如导致模型在数学、多语言处理上表现不佳等。

AINLPer
新闻资讯8

Anthropic 研究发现:仅需少量污染文档即可对 LLM 实施投毒

Anthropic的Alignment Science团队研究语言模型训练投毒攻击,实验发现仅250条恶意样本就能植入“后门”,且模型越攻击越易,还对微调数据集实验,引发讨论。

InfoQ