「多模型适配」共找到 9953 篇相关文章
快手Klear团队提出CE-GPPO:通过梯度保留协调熵,解决强化学习中的熵不稳定问题
快手 Klear 语言大模型团队提出新强化学习算法 CE - GPPO,以「熵」为核心,提出梯度保留策略,重新利用裁剪外区间低概率 token 的梯度,实现策略熵的精细调控,解决强化学习中熵不稳定问题。
讯飞刚发的财报:净利润暴涨了202%
科大讯飞2025年第三季度财报亮眼,营收、利润、现金流全面转正,归母净利润同比大增202%。AI大模型技术突破与产业化落地成业绩修复关键,在技术、业务、生态方面成效显著,还将加大研发投入。
Codex 和 Claude Code,用哪个?
文章探讨 Codex 和 Claude Code 的使用,建议有条件用最好的模型工具。介绍二者特点,给出文件同步、记忆文件更新、项目目录结构添加等使用方法,还强调写好 Prompt 及明确 AI 能力边界的重要性。
0.07B大败QwenVL72B!百度开源OCR3.0"三件套"
OCR 历经四次范式迁移,工业落地存在精度与参数量等矛盾。百度开源 PaddleOCR 3.0“三件套”,含 PP - OCRv5、PP - StructureV3、PP - ChatOCRv4,各有创新点,解决了多语种识别、版面还原等问题。
不止剪辑!剪映的未来是一站式AI视频平台
剪映产品负责人宣布,其野心是成为一站式AI成片的创意伙伴。今年对AI文字成片功能系统性升级,整合豆包、DeepSeek模型,新增多种功能,还推出剪小映应用,要打造一站式AI视频编辑平台。
GPT-5仅23.3%,全球AI集体挂科!地狱级编程考试,夺金神话破灭
最新基准测试SWE-Bench Pro评估AI编程智能体,直面真实企业级工程任务。顶尖模型几乎溃败,GPT - 5仅23.3%。该测试解决现有基准数据污染、任务简单问题,能成未来LLM编码能力标尺。
英伟达50亿美元入股英特尔,将发布CPU+GPU合体芯片,大结局来了?
9月18日英伟达与英特尔宣布达成合作,英伟达投资50亿美元购其股份。双方将合作开发多代定制数据中心和PC产品,包括定制CPU、集成RTX GPU的x86 SoC等,此前二者有竞争历史。
百度CTO王海峰:AGI曙光已现,Scaling Law仍有效|新智元十周年峰会
新智元十周年峰会,百度CTO王海峰分享AI发展。回顾十年,从AlphaGo到如今大模型爆发,AGI曙光已现。他指出AI具通用性和全面性,百度内部超45%新增代码由AI生成,Scaling Law仍有效。
刚刚!Thinking Machines Lab | 长文揭开LLM推理不确定性真相!
Thinking Machines Lab发布《克服LLM推理中的不确定性》,揭示大语言模型推理不确定性原因,并非“并发 + 浮点”假设那么简单,主要是负载及batch size不确定所致,还给出让核函数有批次不变性的方法及实验结果。
借助CoT监管AI?OpenAI、谷歌、Anthropic等罕见联合发文:AI系统安全的新机遇!
OpenAI等支持新研究论文,其指出高级AI不透明性有潜在风险,而‘推理模型’用自然语言推理带来可解释窗口,CoT监控可检测不当行为、发现早期信号等,但也存在使监控性下降的因素。