验证系统」共找到 2423 篇相关文章

算法论文8

大模型化身苏格拉底:通过主动提问挖掘人机协作的深度

微软与南加州大学联合团队研究揭示激发大模型主动提问能力新范式。通过定义主动信息收集任务、提出强化微调策略,经实验验证该方法有效,使模型在多领域表现出色,重新定义大模型角色。

AIGC开放社区
开源动态8

个人电脑也能进行智能体RL训练?尤佳轩团队开源OpenTinker

伊利诺伊大学厄巴纳 - 香槟分校尤佳轩团队开源OpenTinker,这是全新‘强化学习即服务’系统。它通过解耦架构和友好API,让开发者在不同算力设备启动智能体训练,解决传统RL框架难题,指明下一代智能体基建方向。

机器之心
产品应用8

以孔子命名,超越Claude 4.5 Opus,Meta发布工业级自我进化AI软件工程师CCA

Meta与哈佛联合推出工业级软件工程师CCA,它是一套让AI在工业级代码库协作的方法论,解决长上下文推理等难题。其三维解耦设计、精细记忆机制、自我进化能力获数据验证,还适合引入强化学习。

AIGC开放社区
新闻资讯8

Andrej Karpathy:做个好人,未来的 LLM 正在看着你

Andrej Karpathy 12 月 10 号写 blog,用现在视角为十年前 Hacker News 帖子自动打分,开源代码。他近期多篇文章探讨 LLM 相关,如可验证性、智能空间对比等,还启动 Eureka Labs。他认为未来 LLM 会审视当下行为。

MacTalk
算法论文8

全图与切片并非等价?LLaVA-UHD-v3揭示差异推出高效全图建模方案

随着多模态大模型发展,处理高分辨率图像成关键。主流视觉编码范式难兼顾性能与效率,清华和中科院团队发布 LLaVA-UHD v3,提出 PVC 框架,对比 SBE 和 GNE,验证其在提升效率同时保留模型能力。

机器之心
新闻资讯7

斯坦福人均≈0.1张GPU!学术界算力遭「屠杀」,LeCun急了

学术界GPU荒严重,美国顶尖大学人均GPU少,与大厂差距大。如斯坦福人均0.14张,而微软等大厂数据中心算力惊人。这导致人才流向工业界,学术验证能力弱,但部分高校有改善措施。

新智元
新闻资讯8

为什么所有企业都在谈 Agent?50+ 技术实践给出真实答案

12月19 - 20日北京举办的AICon全球人工智能开发与应用大会,聚焦AI Agent等关键方向。来自腾讯等企业的实践者将分享构建智能系统经验,大会设Keynote和12大平行技术专场,呈现AI技术全景。

PaperAgent
开源动态8

8.8K Star!真正的本地实时 Whisper 开源神器,彻底干翻云端 STT!

做实时语音转文字系统,上云端 API 贵且隐私难保障,本地跑 Whisper 延迟高。WhisperLiveKit 是专为本地流式语音识别优化的全栈方案,解决了 Whisper 痛点,有极速处理等功能,适用多类项目。

开源星探
产品应用7

卡帕西大模型横评方法太好玩了!四大AI匿名参赛评分,最强出乎意料

卡帕西发布“大模型议会”web app,系统通过OpenRouter调起多模型开会商议,各模型答题、互评、排序,由主席模型给出统一答案。可对比模型差异,模型自评与人类主观或不同,多模型集成或成突破点。

量子位
新闻资讯8

半年赚2亿,400亿市值,它是又一个“寒武纪”?

高端光芯片长期被海外垄断,源杰科技在技术隐士张欣刚带领下实现突破。其25G激光器芯片通过验证,后多款芯片量产,2025年上半年业绩与股价双涨,市值超400亿,还布局美国生产基地。

芯师爷