在线后训练」共找到 3862 篇相关文章

新闻资讯7

AI六小虎,敲锣之分道扬镳

随着智谱AI与MiniMax先上市,AI大模型六小虎走向不同道路。未上市几家放慢脚步,百川或2027年上市,月之暗面“不差钱”不着急,阶跃走软硬结合路线。投资人更看重公司商业化能力。

芯师爷
算法论文8

Anthropic:大模型开始意识到自己在想什么!

Anthropic的Jack Lindsey论文《Emergent Introspective Awareness in Large Language Models》对大模型做神经科学受控实验。发现Claude Opus 4/4.1能感知内部念头,区分内外状态,通过检查内部状态一致性判断输出意图。

深度学习自然语言处理
产品应用7

独一份!带动效的 PPT 生成 Agent!使用教学&创作思路

作者实现用 Nano Banana Pro 生成带演示动画的 PPT 这一独特功能。介绍了更新的 PPT 生成 Skills 能力、使用方法、创作思路,还提及成本及对 AI Coding 发展的看法。

歸藏的AI工具箱
算法论文8

微软:DeepSeek-R1等推理模型循环的原因找到了

前几天,DeepSeek - R1论文更新,披露诸多细节。重点是推理模型在低温/贪心解码下易循环,根源是学得不对,如风险规避式复读、时序相关错误复读,还给出解决方案。

PaperAgent
新闻资讯7

Google 团队一年都没做出来的项目 Claude Code 一小时就把代码写出来了

Google首席工程师称团队一年没搞定的分布式Agent编排系统,Claude Code一小时生成代码。但续有澄清,AI是基于人一年探索成果生成‘玩具版本’。还分析了工作价值、瓶颈转移等,指出AI时代个体和小团队机会。

宝玉AI
新闻资讯7

Andrej Karpathy:一场里氏 9 级的大地震正在重塑整个编程行业

文章围绕AI在编程领域的应用展开,作者与大师交流AI Coding方式,提及Andrej Karpathy观点,指出编程行业正被重构,程序员需掌握新抽象层,应对不稳定智能系统。

MacTalk
新闻资讯7

389万寻找翁荔继任者!OpenAI紧急开招安全防范负责人

OpenAI在连遭安全指控,豪掷约389万元+股权急招安全防范负责人,要制定执行安全防范框架。此前其安全团队负责人更迭频繁,此次招聘是否‘应激之举’待商榷。

量子位
算法论文8

大模型幻觉的源头找到了!清华团队锁定大模型宁愿说谎也要讨好人类的神经元

清华大学研究团队深度解剖大语言模型微观机制,确认幻觉关联神经元存在,揭示其与过度服从行为相关。通过干预神经元激活状态可增减模型幻觉行为,为开发可靠 AI 系统提供靶点。

AIGC开放社区
推荐文章8

深度之赌:从卧室到上帝机器

文章讲述现代AI秘史,从Jeff Dean本科研究神经网络失误,到Google Brain诞生;还有Hinton等深度学习先驱经历,如Hinton当实习生、AlexNet诞生等,也提及Google发展及未先发ChatGPT原因。

宝玉AI
7

不拼爹,拼AI!青少年们用Claude“写”出百万生意,圈粉25万投资者,谷歌风投也主动求合作?

AI 发展让创业者年龄走低。14 岁 Nick Dobroshinsky 创办 AI 金融平台 BeyondSPX;16 岁 Raghav Arora 开 AI 生鲜配送公司 GetASAP;14 岁 Alby Churven 先做游戏化教育应用,转向开发 AI 编程工具。

AI前线