「无数据训练」共找到 4427 篇相关文章
阶跃新模型快到“没推理”!印奇上任,果然气势一新
印奇上任后,阶跃星辰发布新一代开源Agent基座模型Step 3.5 Flash,总参数196B,支持256K上下文窗口。它推理快,适配多家芯片厂商,在多场景表现出色,还具备端云协同能力,架构也有多项优化。
猝不及防,Adobe关停2D动画软件Animate拥抱AI!最惨学生:一学期的课白上了
Adobe宣布将于2026年3月1日停止销售2D动画软件Animate,企业客户可获三年服务,其他用户仅一年。该软件历史超25年,虽有衰落但仍被不少人使用,Adobe此举或因重心转向AI。
摩尔线程AIBOOK一周实测:开箱即训的「AI Native」体验
摩尔线程AI算力本MTT AIBOOK专为AI学习与开发者打造。它搭载「长江」芯片,提供50TOPS异构AI算力,运行MT AIOS系统,预置完整AI开发环境。实测显示其部署简单,性能出色,还具备端云一体等优势。
The Batch: 899 | 更划算的推理
研究人员提出 Delethink 强化学习方法,训练大模型定期截断推理 token 至固定最大数量,以限制处理长思维链成本。经测试该模型在多方面超基线,且缓解计算成本限制,为长上下文推理提供路径。
不到百万级,看不见 MCP 的真实问题:创始人亲述这疯狂的一年
MCP 联合创作者 David 复盘其发展,从开源协议到行业事实标准,经历多阶段演进。他指出做对死磕标准 HTTP,踩坑让关键能力成可选致双向能力被削,规模达百万级有扩展性问题,还谈及多方面发展与规划。
Transformer已死?DeepMind正在押注另一条AGI路线
谷歌团队借鉴人类联想记忆,提出嵌套学习,解决AI「灾难性遗忘」问题。强调优化器与架构协同进化,构建联想记忆系统。HOPE架构在多任务表现出色,或开启AI从被动训练到主动进化大门。
谷歌看了都沉默:自家「黑科技」火了,但为啥研发团队一无所知?
当科技圈为‘谷歌黑魔法’兴奋时,所谓‘并行验证循环’可能是AI生成的‘赛博跳大神’。它号称超越思维链,性能提升显著,但发帖者身份存疑,无可靠源链接,其真实性遭业内质疑。
还在手搓PPT?试完这款AI,我连夜卸载了付费模板库
新智元报道,今年AI从「卷分数」变为「卷干活」。商汤升级的「办公小浣熊3.0」是超级「办公搭子」,能做PPT、分析数据、写报告。其APP即将上线,还实现全链路国产化适配。
模型大一统?1100多个模型殊途同归,指向一个「通用子空间」!
约翰斯・霍普金斯大学研究发现,1100多个不同神经网络,即便训练条件不同,最终权重会收敛到共享低维子空间。此研究为神经网络参数空间“通用性”提供严谨实证,虽成因待探索,但意义深远。
暴涨3倍!18-34岁占比反降15%:这届中年人开始占领AI
数字数据公司Similarweb发布《2025生成式AI全景报告》。显示全球GenAI平台访问量、App下载量增长,用户年龄层拓宽。ChatGPT跻身全球前五,与谷歌等形成新生态,市场走向多元,AI应用场景不断拓展。