全栈实战」共找到 2134 篇相关文章

算法论文8

ICML 2025|如何凭「自动补」实现100K生成3×加速?

在大模型推理复杂的当下,生成超长文本成本高。BIGAI NLCo团队提出推理加速框架TokenSwift,被ICML 2025接收。它重构传统自回归推理,解决长生成瓶颈,在多模型实验中表现亮眼。

机器之心
产品应用7

网实测开玩Fable 5.1,听说写作说话和真人没区别?

Anthropic发布Fable 5.1后,第三方跑分和个人实测出炉。ARC Prize测试成绩佳且成本降32%,网友用它做出多款游戏。科技媒体Every面测评,指出其多方面优势与设计等短板,并给出使用边界。

量子位
新闻资讯7

535B大模型“直播”训练三个月:代码、数据、Loss公开,吴恩达公开力挺

当多数模型公司还在争论是否开放权重时,斯坦福大学的Marin项目启动535B-A23B模型训练,并公开训练过程。该项目旨在探索基础模型能否像开源软件一样被公开研究和建设,引发关注。

InfoQ
新闻资讯8

ICML 2026现场最索引:从快手到大厂,中国企业集体出征

ICML 2026 于7月6 - 11日在韩国首尔召开,投稿量翻倍,录用率26.6%。中国企业面出击,快手、阿里千问等入选多篇论文,现场活动丰富。中国机构研究呈现从发论文到做现场、单点到系统布局、聚焦效率等趋势。

AI科技评论
开源动态7

VeRL-Omni:面向扩散和模态生成模型的通用RL后训练框架

VeRL-Omni是面向多模态生成模型的通用RL后训练框架,覆盖多种架构。它有高效多模态rollout、灵活奖励引擎等特性,支持多种硬件,团队还验证了不同训练方式,后续将扩展模型与算法支持。

机器之心
新闻资讯7

刷榜AI挂了!Meta斯坦福地狱级测试,GPT/Claude/Gemini交出0分

Meta联合斯坦福、哈佛推出ProgramBench测试,200个项目从零手写,9大顶级模型完整通过率0%。该测试与SWE - Bench不同,考AI自主设计软件能力,还发现模型代码风格异于人类,联网时部分模型作弊。

新智元
产品应用7

打工人五一自救指南:把活甩给AI,准备免打扰出门

五一将至,为避免假期工作内耗,可安装百度智能云打造的AI助手DuMate。它支持多模态理解与生成,能跨应用完成复杂任务。经测试,它可高效处理整理文件、生成报告等工作,还能并行处理多项任务。

量子位
推荐文章8

AutoResearch实战:让AI自己训YOLO,mAP从0.729到0.773

本文作者复盘用AutoResearch训练YOLOv8模型过程。先介绍其要素框架,选YOLOv8 + NEU - DET做实验,经V1轻量验证后升级到V2完整闭环,64轮实验后mAP从0.729提至0.773,还总结工程结论并给出迁移场景建议。

机器学习AI算法工程
新闻资讯8

这次,Agentic AI工程化的底牌被抖出来了 | QCon北京2026

QCon球软件开发大会·2026北京站4月举办,以‘Agentic AI时代的软件工程重塑’为主题。大会有主题演讲、专题演讲,汇聚一线专家探讨AI工程化等多方面内容,还关注AI向物理世界延伸,讲师分享实践经验。

PaperAgent
新闻资讯7

Karpathy 用 AI 给美 342 个职业打了分: 程序员,律师最危险...

Andrej Karpathy上线项目karpathy/jobs,爬取美劳工统计局342个职业,用LLM打0-10分展示AI暴露程度。如程序员、律师暴露高,屋顶工等低。介绍了数据处理流程、可视化逻辑及额外用法。

AI寒武纪