「能力提升」共找到 5252 篇相关文章
OpenAI明年上市,万亿美元估值将成史上最大IPO
OpenAI正筹备史诗级IPO,估值或达1万亿美元。其通过架构重组削弱微软控制、强化自身独立性,为上市铺路。若成功,将改写AI产业格局,也考验其平衡商业利益与使命的能力。
全球首个AI Agent操作系统FlowithOS跑分超Atlas,网友:它「杀死」了比赛
AI应用初创企业Flowith推出全球首款专为AI Agent打造的操作系统FlowithOS。它能改写交互方式,功能超AI浏览器,跑分超竞品,还具记忆能力,适配多系统,已公测,或引发“AI操作系统”竞争。
奥特曼:OpenAI上市,势在必得
OpenAI完成架构重组,为IPO铺平道路。奥特曼公开AGI路线图,预计十年内迈入AGI时代。重组解除盈利上限,可自由增发股票和上市。微软支持转型,双方续约合作。OpenAI在技术、商业等多方面有新进展与规划。
只要强化学习1/10成本!翁荔的Thinking Machines盯上了Qwen的黑科技
新智元报道,翁荔的Thinking Machines研究同策略蒸馏策略,能以1/10强化学习成本,结合同策略训练优势与密集奖励信号。该策略受DAGGER启发,扩展Qwen3团队工作,可在Tinker复现,还能用于个性化和持续学习。
AI已经开始自己设计算法,并且超越顶尖人类专家,人类还能做什么?
谷歌DeepMind团队与加州大学伯克利分校研究显示,AI能设计出超越人类专家的算法。如在多个领域案例中,AI设计的算法在成本、效率等方面表现出色。ADRS方法将系统研究核心环节自动化,人类研究员角色也将转变。
快手Klear团队提出CE-GPPO:通过梯度保留协调熵,解决强化学习中的熵不稳定问题
快手 Klear 语言大模型团队提出新强化学习算法 CE - GPPO,以「熵」为核心,提出梯度保留策略,重新利用裁剪外区间低概率 token 的梯度,实现策略熵的精细调控,解决强化学习中熵不稳定问题。
Flash-Searcher:Web Agent的并行革命
当下Web智能体用顺序执行链解决复杂任务存在执行和信息利用率低的问题。为此提出Flash - Searcher,以DAG并行执行机制为核心,提升执行吞吐与速度,在多基准上表现优,代码已开源。
CMU&斯坦福提出Reasoning新范式!自己找“窍门”,教会LLM抽象Reasoning
大型语言模型解决复杂推理问题时效率低,论文提出创新方法,让模型利用“推理抽象”,通过RLAD两玩家强化学习框架训练,在多基准测试提升性能,还分析了其作用、局限与未来方向。
腾讯王者归来:混元图像3.0登顶LMArena!一手实测全球最强图像AI
LMArena最新榜单显示,腾讯「混元图像3.0」在文生图任务中夺冠,碾压谷歌Nano banana和字节Seedream 4。它9月28日开源,性能对标闭源模型,有强大推理、语义理解能力,支持中英文长文本渲染。
语音“PS”来了!蚂蚁又放大招,ASR+TTS+编辑的全能语音模型开源了!
在大模型浪潮下,语音领域迎来“整合与统一”趋势。阿里蚂蚁团队推出端到端统一语音模型Ming - UniAudio,能在一个框架下完成识别、生成、编辑等任务,语音编辑能力创新,开发者上手简单。