在线后训练」共找到 3879 篇相关文章

产品应用8

SDD-RIPER 团队落地指南:如何让整个团队在一周内跑通大模型编程

文章提供了 SDD - RIPER 团队落地方案,能让团队一周内跑通大模型编程,质量可控、效果可量化。阐述了推不动大模型编程的痛点及 SDD - RIPER 的解决办法,介绍了部署、实操流程和试点 SOP,还给出效果数据与常见问题解答。

阿里云开发者
算法论文8

再不怕乱引文献!绕过付费墙,BibAgent把学术核验转为证据链

大模型生成学术论述,其引用验证成难题,尤其付费墙论文难以核验。BIBAGENT突破此困境,不破解付费墙也能验证引文语义真伪,还构建MISCITEBENCH评测,表现优异,为科学写作补“可审计基础设施”。

新智元
新闻资讯7

刚刚,Anthropic首超OpenAI!暴买谷歌TPU,Claude杀疯了

Anthropic与谷歌、博通合作打造3.5 GW TPU集群,预计2027年上线。其年化收入破300亿美元首超OpenAI,客户呈指数级增长。但训练和推理成本高,与OpenAI都在冲刺IPO,竞争激烈。

新智元
推荐文章7

编程智能体的核心组件【译】(重发,补图)

文章围绕编程智能体展开,先厘清大语言模型、推理模型与智能体关系,指出智能体是含‘模型 + 工具 + 记忆 + 环境反馈’的循环系统,介绍编程智能体六大核心组件,还对比了与 OpenClaw 的区别。

宝玉AI
新闻资讯7

在中国 AI 生态圈摸底了两周,我学到了什么【译】

作者 José Maria Macedo 在中国考察 AI 生态,看法变得复杂。他看好中国硬件,但对软件更悲观;指出中国创始人特质与西方不同,本土 VC 加剧此现象;还提到市场泡沫、全球市场布局等情况。

宝玉AI
开源动态8

让AI自己“炼数据”!DataChef开源:用强化学习自动生成LLM数据配方

上海人工智能实验室联合复旦大学开源DataChef,它能通过在线强化学习自动生成LLM数据配方。实验显示其能力逼近Gemini - 3 - Pro,超越人类专家设计算法,解决传统数据工程难题,推动大模型数据工程迈向新范式。

OpenMMLab
产品应用8

测完阿里的Accio Work,我理解了「一人跨国公司」为什么可能

作者体验阿里Accio Work认为,它作为面向全球中小企业和创业者的企业级Agent,像出厂就懂做生意的团队,能让电商小白从零搭Shopify店,通用Agent难以做到,体现数据和场景壁垒。

花叔
新闻资讯7

市值950亿,陕西国资赚翻了

3月20日,源杰科技股价突破1000元,市值达958亿成A股2026首只千元股。其由70清华学霸张欣刚2013年回国创立,乘AI算力东风股价一年涨近770%,陕西国资投资收获颇丰。

芯师爷
新闻资讯7

全网都在扒的小米MiMo团队,几乎被“北大学子”承包了

小米MiMo-V2-Pro模型登上OpenRouter调用量榜单第一,网友关注其团队。该团队成立一两年冲到顶尖,核心作者多来自北大,技术理念受小米产品基因驱动,成功是多重因素叠加结果。

量子位
推荐文章7

龙虾开始投简历了,月薪1万刀。

一只日本龙虾为应聘RevenueCat的AI员工,写15篇日记作为求职作品集。日记记录其从菜鸟到终极秘书的进化,展现犯错、复盘、改进的过程,体现AI从错误中学习的能力,也凸显人对AI调教的重要性。

探索AGI