新学徒制模式」共找到 4345 篇相关文章

开源动态8

开源框架让代码AI偷师GitHub!bug修复率飙升至69.8%,性能创纪录

MemGovern团队联合多高校团队提出MemGovern框架,将杂乱GitHub数据转化为AI可用的结构化记忆。它构建筛选净化流水线,采用先搜后看模式,实验显示能显著提升代码智能体的bug修复率,还具跨领域推广价值。

量子位
算法论文8

别被室内基准高分骗了:大模型是在推理空间,还是在「背答案」?

2025年,空间智能成大模型竞争热点,模型在室内基准上分数飙升。但因训练与测试数据同源,其提升或只是“背答案”。中科院大学等机构发布OSI - Bench重审视大模型空间能力,评测显示当前提升可能是虚假繁荣。

机器之心
新闻资讯7

比0.99元羊毛更重要的,是跟AI砍价的快乐

双11期间,不少人分享跟Kimi Agent会员砍价战果,原本49元/月的会员能砍到0.99元。作者尝试多种砍价话术,如夸夸、卖惨等,还对比其他模型,最后总结出砍价秘诀,活动有时间和老用户限制。

量子位
算法论文8

UC伯克利作颠覆认知:LLM靠「自信爆表」学会推理?无需外部奖励超进化

UC伯克利华人团队发现,LLM不靠外部奖励,仅靠「自信爆棚」就能学会复杂推理。他们提出基于内部反馈的强化学习(RLIF)范式,用INTUITOR方法让模型用自身置信度作内在奖励,在多任务中表现良好。

新智元
产品应用8

千问Qwen旗舰预览版Qwen3.6-Max-Preview发布

千问Qwen发布下一代旗舰模型早期预览版Qwen3.6 - Max - Preview,在权威评测中登顶最佳国产模型。此前开源的Qwen3.6 - 35B - A3B用30亿激活参数匹敌数百亿参数稠密模型,模型在多方面给出技术演进方向。

AIGC开放社区
产品应用2

cursor 2.0实测:cursor的摆烂之作

作者实测Cursor 2.0后大失所望。它交互粗糙,多智能体虽有多个回答但选方案操作不明;因Claude涨价推出智能分发和自研Composer,后者除快无优势且需魔法;内置浏览器交互麻烦,窗口管理离谱,语音模式基本不可用。

AI产品自由
新闻资讯7

AI祛魅之后:2026年将是AI脱下华丽外衣并穿上工装的一年

2026年AI将从概念验证迈向产业深处,展现实用价值。行业焦点从构建大模型转向让AI好用,还会从依赖算力扩张过渡到研究架构。小模型崛起、智能体互联标准化、世界模型构建及物理智能落地成趋势。

AIGC开放社区
推荐文章7

推荐:AI搜索增加链接展示,从谷歌people also ask到AI搜索;AI绘画从吉卜力到Nano Banana增长方法论

文章推荐两篇内容。一是Google将在AI模式增加链接展示,访谈提及AI搜索是传统搜索迭代,核心SEO原则仍有效;二是复盘Remini借热点增长的DICE模型,含数据监测、敏捷创、创意营销和数据验证。

白杨SEO优化教程
产品应用8

手机“自动驾驶”时代来了,智谱还让手机拥有“云替身”

作者参加智谱AutoGLM版本闭门会并试用,该版本亮点多,如成全球首个手机通用Agent,操作在云设备运行,全平台覆盖等。云手机Agent能力稳定高效,能处理多类任务,还可助老人等群体用手机。

歸藏的AI工具箱
新闻资讯7

Anthropic封号OpenClaw之父!复刻、改价、拉黑,24天三连杀

OpenClaw创始人Peter Steinberger的Claude账号被Anthropic封号,后恢复但无官方解释。此前Anthropic改价限制OpenClaw使用,且Claude Cowork半年来对标OpenClaw核心功能。这撕开了AI平台与开源agent生态裂痕,也凸显包月模式被Agent算力需求击穿的问题。

新智元