「软件3.5」共找到 3962 篇相关文章
Loss收敛不代表学会:腾讯混元ACL 2026拆解SFT训练中15.3%的“假学会”样本
大模型微调(SFT)是主流LLM落地方案,但大家默认训练完就是学完了。腾讯混元团队发现SFT存在不完全学习现象(ILP),论文完成了定义ILP、找根因、提诊断框架和验证干预等工作。
还在拼命加 GPU?AI 应用规模化的下半场,拼的是这五大软件“新基建”
文章指出 AI 应用规模化下半场,拼的是五大软件“新基建”。从云原生到 AI 原生,应用基础设施面临诸多挑战,如从代码中心到智能体管理等。作者提出构建智能体协作网格、认知记忆平台等五座技术灯塔,助力 AI 原生应用发展。
2.5K Star 牛皮项目,512MB内存就能跑,树莓派、旧电脑秒变专属云桌面!
介绍开源Web桌面操作系统ArozOS,它由香港开发者tobychui为低功耗设备设计。始于2016年,用Go语言编写,在Github获2.5K star。功能强、资源占用低、易安装,能让旧设备变个人云桌面。
用2D数据解锁3D世界:首个面向运动学部件分解的多视角视频扩散框架
张昊等提出 Stable Part Diffusion 4D (SP4D) 框架,由 Stability AI 与 UIUC 联合完成。它能从单目视频生成多视角 RGB 与运动学部件序列,解决运动学部件分解及自动 rigging 问题,实验效果显著,被 Neurips 2025 接受为 Spotlight。
AI玩宝可梦找出30年前代码Bug!谷歌论文介绍AI通关全过程,复杂任务都能解
谷歌Gemini 2.5系列技术报告花长篇幅介绍Gemini 2.5 Pro玩《宝可梦蓝》,它通关游戏,展现出创造力与长期规划能力,还发现游戏代码Bug,但也有幻觉、思维定势等问题。Claude 4已加入比赛。
智谱 GLM-4.5 团队深夜爆料:上下文要扩、小模型在路上,还承诺尽快发新模型!
今日凌晨,GLM系列模型四位研发成员在Reddit的AMA活动中,回答了GLM系列技术细节、未来规划等问题。透露扩展上下文、推小模型是重点,还承诺尽快发新模型,也探讨了大模型发展观点。
xAI解散,但Grok还在上新,马斯克官宣新模型
xAI 解散、大批成员离职后,马斯克透露 Grok 最新模型进展,参数量 1.5T 的 Grok V9 - Medium 已完成训练,预计两到三周内发布。他还宣布现有 0.5T 模型年底前开源,此外首款编码智能体 Grok Build 也备受关注。
对骂之外,奥特曼正筹划脑机接口新公司,狙击马斯克的Neuralink
山姆·奥特曼正筹划脑机接口公司Merge Labs,对标马斯克的Neuralink。新公司以8.5亿美元估值融资2.5亿,OpenAI或投。此时,二人在X上因苹果推广ChatGPT起争执,脑机接口竞赛也将开启。
硅谷大厂开始AI-first换血:先裁3万人、再招8000个新人,传统产品经理正在被Builder淘汰!
随着AI浪潮席卷,产品经理职业正经历“角色重定义”,需成为“builder”。Nikhyl Singhal指出,未来12 - 24个月会“先大规模裁员,再大规模重招”,builder将迎来好时代,产品管理将更重构建与创造。
回归C++: 在GGUF上构建高效的向量模型
Jina AI分享将纯解码器向量模型适配到GGUF格式及在llama.cpp工具链的优化经验。经处理得到特定任务v4模型,还生成量化版本并上传。介绍使用方法、注意事项,经测试推荐IQ3_S或IQ3_M版配合定制工具。