「计算量降低」共找到 2037 篇相关文章
Unsloth宣布更新,可免费用强化学习训练视觉大模型Qwen2.5-VL-7B
Unsloth宣布更新,支持视觉/多模态模型强化学习训练,含Gemma 3和Qwen2.5 - VL。其独特机制使VLM RL训练速度提升、显存占用降90%等。还引入GSPO算法,能在免费Colab T4 GPU训练Qwen2.5 - VL - 7B。
人人都能炼专属Agent,上海交大开源端侧Agent全栈工具链,真实场景性能超GPT-5!
上海交大开源端侧Agent全栈工具链MobiAgent,将构建手机Agent全流程开放。它在真实场景性能超GPT - 5,还设计“潜记忆加速器”,通过三步养成Agent,评测表现出色,降低移动智能体开发门槛。
AI 时代,我们是否应该重温极限编程?
AI让代码编写门槛降低、速度提升,但交付结果仍不尽如人意。极限编程(XP)引入约束,强调适度放慢,提高走在正确方向的概率,能防止代码混乱,在AI时代有重要意义。
腾讯混元最新开源成“最强翻译”:国际机器翻译比赛获30个语种第一
腾讯混元团队的Hunyuan-MT-7B以7B总参数量获国际翻译比赛冠军,还开源了该模型及翻译集成模型Hunyuan-MT-Chimera-7B。其Shy框架有三大创新,在多方面表现优异,还为垂直领域优化提供模板。
马斯克放出编程界价格屠夫!Grok Code Fast 1:更快,更省,还免费
近日,马斯克旗下xAI发布全新编程模型Grok Code Fast 1,它为“代理式编程”而生,靠全新架构实现高速代码生成。在技术出色的同时,价格低廉还限时免费,虽在部分场景有不足,但仍是开发者实用工具。
首个基于MCP 的 RAG 框架:UltraRAG 2.0用几十行代码实现高性能RAG, 拒绝冗长工程实现
检索增强生成系统(RAG)复杂度提升,工程实现成本高。清华大学等联合推出首个基于MCP架构的UltraRAG 2.0,组件化封装、调用扩展灵活,低代码实现高性能,可用于科研和行业应用。
全球高被引第一人,图灵得主Bengio近百万屠榜!Hinton、何恺明冲进TOP 5
全球高被引科学家名单出炉,图灵奖得主Bengio成全球首位「全领域被引最高」学者,Google Scholar主页总引用量97万+。此外,Hinton、何恺明、Ilya Sutskever等计算机领域科学家也冲进总榜TOP 10。
谷歌Gemini | 一次提示能耗≈看9秒电视剧?
谷歌发布Gemini能源消耗研究报告,称处理中位数文本提示能耗低,2024 - 2025年能耗降33倍、碳足迹减44倍,归功于全栈式优化。但专家质疑方法论,指出未算间接用水、碳排放核算不全等问题。
稚晖君新大招:机器人二次开发0门槛了!
在智元机器人首届合作伙伴大会上,联合创始人稚晖君发布机器人动作与表达创作平台灵创平台。它以AI加持,能将机器人二次开发抽象成模块化工具,降低难度,适配多款机器人,10月上线beta版。
清华校友出手,8B硬刚GPT-4o!单一模型无限工具调用,终结多智能体
MIT等机构推出TIM和TIMRUN组合拳,突破模型token天花板。TIM将推理建模为任务树,TIMRUN优化内存管理。二者结合支持长程推理,实现单模型高效推理,简化智能体构建,在多方面表现出色。