独立思考」共找到 838 篇相关文章

开源动态7

类R1训练不再只看结果对错!港中文推出SophiaVL-R1模型

DeepSeek - R1爆火后,类R1结果奖励训练范式引发推理热潮,但仅以结果对错奖励模型有弊端。港中文联合团队发布多模态推理模型SophiaVL - R1,引入‘思考奖励’机制,还用Trust - GRPO算法解决奖励欺骗问题。

机器之心
新闻资讯7

deepseek v4.1? 梁圣的端午礼物突袭。

群里小伙伴称deepseek官方灰度新模型,手机和web端Flash模型思考模式大变,典型bug修复。测试发现幻觉严重,知识库截止大概25年6月。同时,deepseek获500亿首轮融资,梁文锋自掏200亿,投资方无投票权,五年锁定期。

探索AGI
开源动态7

我们开源了一个可以降低 AIGC 率的模型

毕业季学校查 AI 率,作者为降 AIGC 率,经尝试不同路径后训练出模型。介绍训练数据和过程,包括 SFT、DPO 各阶段,展示改写效果,还开源模型和数据,最后引发对教育检测的思考

特工宇宙
产品应用8

VC、品牌顾问、编剧,正在批量把自己做成AI

AI发展中普通人使用门槛抬高,供需错配。5月19日袋袋(Profy)上线,专家说出经验就能封装成“数字专家”。它有四层能力和独特架构设计,让判断力独立流通,赋能普通用户。

量子位
产品应用7

这可能是Claude Code最重要的功能

Claude Code新功能Sub - agents很实用,能创建多个专精任务的Agent,有独立上下文窗口防‘记忆污染’,配置灵活,还能组成工作流。创建简单,比社区项目有优势,是Claude Code截至目前最重要功能。

newtype AI
新闻资讯8

谷歌深夜打假!27页论文全公开,揭秘Gemini如何碾压OpenAI,拿下IMO真金牌

OpenAI高调庆祝自家模型获IMO金牌,谷歌DeepMind携官方认证和27页论文官宣Gemini碾压夺金。谷歌公开解题方法论,介绍三步思考法及相关Prompt,还对比批评了OpenAI的做法。

探索AGI
新闻资讯7

全网破防,AI「手指难题」翻车逼疯人类!6根手指,暴露Transformer致命缺陷

最近网友被AI「手指难题」逼疯,给AI六指手,它始终无法数对。GPT - 5.2、Nano Banana Pro等均翻车。此问题揭露当前模型思考机械、割裂等缺陷,也凸显Transformer架构弱点。

新智元
算法论文8

不改模型也能提升推理性能?ICLR投稿提出测试时扩展新范式OTV

ICLR 2026投稿论文提出单token验证(OTV),是测试时扩展新机制,让模型能边推理边判断正误。它基于并行思考思路,借助轻量内部验证器分析推理过程,实验显示其性能优于主流方法。

量子位
新闻资讯7

独家丨商汤科技将成立独立的具身智能公司

AI科技评论独家消息,商汤科技将成立独立具身智能公司,核心班底有王晓刚、陶大程等大咖,正在招人。此前商汤已布局该领域,今年4月展示成果、达成合作,WAIC将发布大模型及平台。

AI科技评论
新闻资讯8

UCSD谢澎涛创业:用AI搞科研,4小时交付顶刊水平成果,已获数百万美金融资

谢澎涛团队推出面向AI for Science的AIBuildAI Science Agent,在NatureBench评测中排名第一,超多数通用编程智能体。该智能体可独立完成模型研发,效率大幅提升,还探讨了其能力边界、应用及对行业的影响。

DeepTech深科技