「唐开强」共找到 969 篇相关文章
吴恩达最新发声:大模型通往AGI还得好几年,做好长期苦战准备
吴恩达发表关于LLM现状与未来的观点,指出其虽通用但不及人类,榨干公网数据后进步难,相比人类还很‘笨’。强调推动发展需大量人工决策和数据工程,要做好长期苦战准备。
让大模型“吃一堑长一智”,南理工百度等提出模型记忆新方法
南京理工大学联合百度等提出新方法ViLoMem,构建视觉流+逻辑流的双流语义记忆,让模型“从错误中学习”。它能在多模态基准提升模型表现,强模型记忆还可迁移给小模型。
国产GPU赛道又跑出一个 2700 亿独角兽!“中国AMD”沐曦股份完成IPO,开盘大涨超 500%
继摩尔线程后,沐曦集成电路登陆科创板,截至发稿估值破 2700 亿。其核心团队多来自 AMD,产品覆盖多领域。虽三年累计净亏超 30 亿,但营收增长强劲。沐曦上市标志国产 GPU 进入“市场与资本检验期”。
GPU为什么能取代CPU,成为计算领域无可争议的核心?
过去CPU是计算核心,如今GPU崛起取代之。二者架构不同,GPU并行处理强。人工智能、大数据等领域需其能力,软件支持助其普及,未来或融合创新,成计算领域主角。
首个英文原生「弱智吧」!逻辑谬误数据集与生成框架来了 | AAAI'26
研究发现大模型判断逻辑谬误易误报正常句子,但分类能力较强。研究人员构建英文逻辑谬误基准SMARTYPAT - BENCH,开发生成框架SMARTYPAT,为大模型逻辑评估提供新思路,可用于多领域。
2.4万亿参数原生全模态,文心5.0一手实测来了
文心5.0正式发布,主打原生全模态,支持全模态输入和输出。官方测试显示其多维度表现突出,在LMArena文本排行榜并列全球第二。实测其理解精细、能捕捉细节,技术上采用自回归统一结构和超大规模混合专家架构。
Meta提出数据筛选的理论:何时“少即是多”成立?
Meta针对机器学习领域‘少即是多’悖论提出理论框架,用高维统计等方法推导测试误差缩放定律,揭示数据筛选‘相变’条件,为实践提供指导,还重新定义‘数据效率’意义。
AI分析师强得可怕
博主黄益贺称其AI分析师比多数人类分析师厉害。以分析ChatGPT Atlas为例,展示其深度思考、调研和分析能力。还介绍了用Claude Skills做的AI分析师能力包升级,提升了深度思考能力。
为MoE解绑:全新「专家即服务」推理架构发布,超细粒度扩展锐减37.5%成本
近年来大模型推理开销增长,MoE架构虽能避免计算量同比增,但带来扩展性差、容错性低、负载不均等问题。为此作者提出全新「专家即服务」推理架构EaaS,实验显示它能锐减37.5%成本。
17.6K Star跨平台逆向工程神器!免费替代IDA Pro,支持插件扩展!
在二进制文件分析或软件逆向工程中,专业工具如IDA Pro界面复杂、学习成本高。文章推荐开源跨平台逆向工程平台Cutter,它基于rizin核心引擎,功能完善,可降低使用门槛。