大厂工作」共找到 5815 篇相关文章

产品应用7

卡帕西模型横评方法太好玩了!四AI匿名参赛评分,最强出乎意料

卡帕西发布“模型议会”web app,系统通过OpenRouter调起多模型开会商议,各模型答题、互评、排序,由主席模型给出统一答案。可对比模型差异,模型自评与人类主观或不同,多模型集成或成突破点。

量子位
产品应用7

“豆包工作”已经是我的主力 Agent:查数据、做内容、协作,一条链全接住

这几天豆包工作推出独立应用,作者用两天后将其作为主力 Agent。它把模型能力和工具生态组合成工作系统,能拿齐信息、加工材料,产物可交下一步,还能跨端接力。

AI产品自由
新闻资讯8

刚刚,智源全新「悟界」系列模型炸场!AI第一次真正「看见」宏观-微观双宇宙

6月6日第七届智源会,智源研究院推出全新「悟界」系列模型,含原生多模态世界模型Emu3、脑科学多模态通用基础模型见微Brainμ等,反映其对模型发展的研判,推动AI向物理世界迈进。

机器之心
算法论文8

工行x上交发布多智能体研究成果,通过群体智能刷新翻译新高度!

2025年多智能体系统成模型研发新高地。工行数据和人工智能实验室与上海交人工智能学院推出多智能体翻译系统TACTIC,以认知翻译学为指导,在相同模型配置下提升翻译效果,在小模型下提升更明显。

深度学习自然语言处理
产品应用8

昇腾+鲲鹏联手上招!华为爆改MoE训练,吞吐再飙升20%,内存省70%

最近华为在MoE训练系统给出算子和内存优化新方案,三核心算子全面提速,系统吞吐再提20%,Selective R/S实现内存节省70%,为规模MoE模型训练扫清障碍。

新智元
新闻资讯7

小米小爱同学:资源受限下,实现端侧模型的高性能推理

InfoQ对话小米小爱同学端侧AI负责人杨永杰,了解其团队在资源受限的端侧设备实现模型高性能推理的策略。目前端侧模型商业化落地慢,团队提前布局,自研框架,实现超180 tokens/s推理速度,还分享未来突破方向。

InfoQ
产品应用8

模型虽好,但恕我直言:在OCR面前,开源小模型更香

作者所在公司项目需处理量纸质文档,起初考虑云端模型API调用和开源模型本地化部署,却因成本高、硬件要求高受阻。后经推荐调研PaddleOCR,其功能全、成本低、易用性强,最终被选为项目核心方案。

PaperAgent
算法论文8

破解人机协作密码:工作技能拆成两层,AI执行人类决策成功率狂飙 | ICML 2025

耶鲁和南研究人员合作的论文提出数学框架,把工作技能拆分为决策层和执行层子技能,揭示人类与AI在这两层面各有所长,优势互补可提升成功率,还为机构适应新工作体系提供指南。

量子位
算法论文8

清华&通院推出"绝对零"训练法,零外部数据模型自我博弈解锁推理能力

清华、北通院和宾州州立学研究人员提出“绝对零”训练法,让模型通过自我博弈生成并解决任务获推理能力。测试显示,其训练出的模型超专家标注样本训练的模型,且能提升编程与数学推理表现。

量子位
开源动态8

让图像生成告别 AI 味!清华 + 港中 + 腾讯混元联手推出SRPO

腾讯混元联合港中、清华推出SRPO,解决文生图技术痛点。它结合Direct - Align和SRPO,提升图像审美等,训练时间缩至十分钟,在测试中碾压主流方法,不过对冷门风格控制和机制可解释性待提升。

AIGC开放社区