「3B参数模型」共找到 8677 篇相关文章
阅读7千万文章硅谷爆火:AI奇点已至,抛弃人类自我进化!
文章指出本月AI质变式飞跃,能独立完成复杂工作,递归自我提升循环已启动。如GPT - 5.3 - Codex有判断力和品位,AI构建自身进程加速。多数人认知滞后,作者给出应对建议,也提及AI带来创造机遇。
智谱GLM-OCR,0.9B开源即巅峰,复杂文档精准解析
智谱发布并开源GLM - OCR,以0.9B轻量级参数在多项基准取得SOTA。它解决视觉感知难题,具备视觉编码与语言解码协作架构,还可端侧与高并发部署,成本低,推动文档智能化处理升级。
我们对 Coding Agent 的评测,可能搞错了方向
用户对 Agent 不满常因它「做得不好」,不遵循指令和规范。当前主流评测体系以结果为导向,与真实场景错位。MiniMax 开源 OctoCodingBench 评测集,结果显示模型过程规范遵循不足,未来训练需引入过程监督。
65岁LeCun被卷回巴黎老家!与小扎一刀两断,曝光神秘AI初创
65岁的图灵奖得主Yann LeCun年底将离开Meta创业,其新公司专注高级机器智能,教AI理解物理世界。他批评LLM触及天花板,是AI黑洞,多年来坚持世界模型研究,认为其才是通向真正智能之路。
翁荔陈丹琦加盟的840亿AI公司,公开第二篇论文
明星创业公司Thinking Machines公开第二篇研究论文,主题为“Modular Manifolds”,通过统一框架约束和优化网络不同层/模块,提升训练稳定性与效率。论文提出模块化流形思路,若应用于大模型,训练效率和稳定性将大幅提升。
苹果秋季新品发布会,全系全面拥抱AI,比Pro还要Pro的iPhone Air已加购物车。
苹果秋季发布会如期而至,带来AirPods Pro 3、Apple Watch系列、iPhone系列新品。新品在AI功能融合上有进步,如AirPods的实时翻译与心率监测、Apple Watch的健康预警、iPhone的图片搜索与AI翻译等。
华为 | MoE推理「王炸」组合:昇腾原生盘古推理,性能狂飙6-8倍!
华为团队推出昇腾平台原生Pangu Pro MoE 72B模型,经系统级软硬协同等优化,推理性能提升6 - 8倍。还提出分层混合并行等策略,打造融合算子,设计推理算法,在昇腾不同平台展现卓越性能。
ICRA 2025|通用多机器人长时任务规划框架破解任务分配难题,成功率+105%、效率+36%
2025年5月,美两校联合团队在ICRA 2025发布LaMMA - P。它融合大模型与PDDL规划器,解决异构多机器人长时任务分配难题,在新基准数据集上,相比SMART - LLM,任务成功率提高105%,执行效率提升36%。
刚花完天价抢人,如今态度180度转变说AI泡沫?Meta冻结招聘遭网友群嘲:小扎翻脸比翻书快
近日,Meta 冻结 AI 招聘,此前它刚花巨资从对手处挖人。原因是 CEO 扎克伯格担心投资无回报,且公司在重组。此前 Meta 计划投数千亿美元建数据中心,其 Behemoth 模型发布推迟。此外,报告称 95% 公司 AI 投资零回报。
从芯片到集群:启邦泽益的推理算力性价比突围
本文整理自启邦泽益联席CEO马冠华在2026芯算力创新峰会上的演讲,针对大模型推理爆发、算力成本高企的行业痛点,介绍启邦泽益从芯片到集群的全栈高性价比推理算力方案。