「AI全栈开发框架」共找到 11176 篇相关文章
讯飞刚发的财报:净利润暴涨了202%
科大讯飞2025年第三季度财报亮眼,营收、利润、现金流全面转正,归母净利润同比大增202%。AI大模型技术突破与产业化落地成业绩修复关键,在技术、业务、生态方面成效显著,还将加大研发投入。
实时交互式长视频生成
文章提出用于实时交互式长视频生成的帧级自回归框架 LongLive,解决了长视频生成在效率和质量方面的挑战,具备长视频生成、实时推理、高效微调等亮点,还给出安装、推理、训练等步骤。
马斯克新模型背后算法来自英伟达???
Grok-4-fast降本增效表现出色,其背后或许关联英伟达算法论文。论文推出Jet-Nemotron模型,靠PortNAS框架降本提效,还开源代码。网友猜测Grok-4-fast基于此模型,也有人认为是营销手段。
英伟达50亿美元入股英特尔,将发布CPU+GPU合体芯片,大结局来了?
9月18日英伟达与英特尔宣布达成合作,英伟达投资50亿美元购其股份。双方将合作开发多代定制数据中心和PC产品,包括定制CPU、集成RTX GPU的x86 SoC等,此前二者有竞争历史。
专访希姆计算陈炜博士:“技术与人才标准”双轮驱动,推动 RISC-V 生态繁荣
在2025 RISC-V中国峰会期间,希姆计算陈炜博士接受专访,介绍RISC-V在AI领域布局,提及希姆计算推动技术标准制定的贡献与挑战,还阐述国内人才缺口及培养标准,认为技术与人才标准相辅相成。
开放世界任务成功率82%!美的攻克机器人泛化控制难题
美的AI研究院和华东师范大学联合提出ChatVLA - 2模型,引入动态混合专家架构和双阶段训练流程。真机实验显示其开放世界任务成功率达82%,远超现有方法,为通用机器人控制提供新思路。
伯克利最强代码Agent屠榜SWE-Bench!用Scaling RL打造,配方全公开
开源软件工程模型DeepSWE横空出世,基于Qwen3 - 32B,仅用强化学习训练,以59%准确率刷新SOTA。它采用rLLM框架、R2E - Gym环境,用改良GRPO++算法,还介绍了评估策略及训练挑战的解决办法。
华为昇腾推理对决:开源vLLM vs 官方MindIE,数据说话「Qwen与DeepSeek推理实测」
文章围绕华为昇腾推理,对比开源vLLM与官方MindIE。借助GPUStack平台测试Qwen与DeepSeek模型,分析不同场景性能。指出vLLM和MindIE各有优势,还强调构建国产AI推理生态需多要素,鼓励开源协作。
大模型微调知识与实践分享
文章详细介绍大型语言模型(LLM)微调知识与实践,包括模型结构、参数量等知识,以及Prompt工程、数据构造、LoRA微调等技术点。还给出微调实践流程,介绍相关平台和框架,如星云、TuningFactory等。
估值 20 亿美元的语音输入法,开源平替已经 3 万 star
文章指出语音输入随着 AI 发展价值重估,介绍了开源工具 OpenLess,分析了商业订阅、开源桌面工具、大厂输入法三类玩家,给出四层评估框架,也提及开源风险,并对不同需求给出选择建议。