学习模式」共找到 2222 篇相关文章

开源动态8

SFT+RL双管齐下:ReasonGen-R1如何破解文生图「指令不遵」难题?

上海科技大学等机构提出 ReasonGen-R1 框架,结合链式推理监督微调与强化学习,提升自回归图像生成模型推理和创作能力,已全面开源。介绍了其训练阶段、实验结果及推理链模式

机器之心
算法论文8

TACO: 让 CLI Agent 在自主迭代中学会丢掉无用上下文

由多校及研究团队联合提出 TACO,这是无需训练、即插即用的终端智能体自进化观测压缩框架。它能让智能体学习压缩规则,过滤低价值输出,保留关键线索,实验显示其提升了任务成功率和 token 效率。

机器之心
推荐文章7

“被投资人怒怼30分钟后,我更确定中国To B的答案” | 甲子光年

文章讲述百融云创在AI To B领域的探索。它突破传统“卖工具”模式,采用“结果计价”,共担结果、承包KPI。技术上提前押注语音对话技术栈,“硅基员工”概念落地多场景,有望推动中国To B行业进入新秩序。

甲子光年
8

AI正在埋葬整个互联网的商业模式

AI正改写全球网站流量格局,让传统流量模式失效,广告收入蒸发。它带来新规则,如智能体即买手、决策即交易等。企业应将产品服务塞入AI对话路径,普通人也可凭信任溢价等不被碾压。

MCP Server
新闻资讯7

图解GPT-OSS:架构、消息格式与推理机制等

OpenAI发布首个开源大模型GPT-OSS,虽性能无惊喜,但设计思路有意思。其架构是经典延续,消息格式有巧思,支持三档推理模式,分词器有小进步,这些设计在实际应用和理论上有一定价值。

AI工程化
产品应用8

比肩Claude Opus:阶跃星辰最强模型Step 3.5 Flash发布

阶跃星辰发布最强模型 Step 3.5 Flash,参数强大,性能与前沿顶级大模型并驾齐驱。其架构平衡算力与智力,有独特注意力布局;基础设施保障训练稳定;强化学习激发智能体潜能;评测数据显示战斗力强,未来还将持续优化。

AIGC开放社区
产品应用8

英伟达帮你省钱,让大模型推理「短而精」,速度快5倍

过去大模型推理追求长链思维,导致推理链长、Token消耗大、响应慢。英伟达研究院的DLER研究给出解决办法,通过强化学习优化方法让模型‘短而精’,推理长度减超70%且准确率不变,还适用于大模型。

机器之心
新闻资讯7

Gemini再揽金牌,力压大学学霸,AI数学推理时代来了!

苏黎世联邦理工学院博士生在大学生国际数学竞赛(IMC)测试了Gemini三种模式,其表现远高于金牌门槛,远超普通大学生。研究人员还从模型输出提取见解,展现了Gemini在数学推理上的优势,凸显AI数学推理能力日益强大。

新智元
算法论文8

攻克「恶意投毒」攻击!华南理工联合霍普金斯和UCSD,连登TPAMI、TIFS顶刊

华南理工大学计算机学院AI安全团队联合国际高校,聚焦联邦学习中防范恶意投毒攻击。提出FedID和Scope两种创新防御方法,前者用多种度量标准和动态加权检测恶意梯度,后者通过逐维归一化等揭示后门维度,均有良好效果。

新智元
推荐文章7

聊聊AI应用架构演进

本文按AI应用架构演进路线,介绍每次演进增加的架构内容及相关技术,涵盖从简易架构到Agent模式等各阶段,还提及监控、推理性能优化等,助读者整理新技术,为探讨AI与传统应用架构异同做调研。

阿里云开发者