「个人超级智能」共找到 3815 篇相关文章
阿里最新开源王炸Agent!性能全面SOTA!
阿里WebAgent更新频繁,基本一月一版。它是类似DeepResearch的通用智能体,历经WebWalker到WebWatcher多阶段演进,各阶段解决不同问题,如网页导航、自主信息搜集等,还不断优化训练数据生成与处理方式。
月烧35万元token、逼得Claude官方连夜限速!被全网吐槽的中国“榜一大哥”,已经靠 AI 年入千万了
X 用户“刘小排”认领月耗 5 万美元 Claude Code token。他靠 AI 年入近千万,用 AI 开发产品,还分享找需求、做产品等经验。他认为 AI 是长期机会,能放大个人能力。
也许,该庆幸在这个时代被裁员
文章借一位失业者基于AI做产品的感慨,引出对GPT - 5发布的讨论。GPT - 5升级后被中外用户吐槽没人味,OpenAI 24小时内恢复GPT - 4o访问权限,还推出三种响应模式,这引发了对AI与人关系的思考。
反常识!GPT-5和Opus 4同时翻车:AI越强,越不爱用工具?
作者用GPT - 5和Claude Opus 4做进化实验,让其开发工具。两模型表现出色,但面对实际任务却不用自制工具。原因包括模型规模使脚手架工作无价值、RLHF带来工具厌恶、逼近AGI渐近线等。
重磅!OpenAI时隔五年再发布开源模型gpt-oss:开源SOTA,可在16g笔记本运行
谷歌推出Genie 3后,OpenAI宣布发布开源推理模型gpt-oss,有gpt-oss-120b和gpt-oss-20b两个型号,采用混合专家架构和4位量化方案,能快速推理,原生支持128k上下文长度。文章还介绍了模型表现、训练等情况。
谷歌深夜放出 IMO 金牌模型,多项测试力压 Grok 4、OpenAI o3!网友评论两极分化
昨夜谷歌向 Google AI Ultra 订阅用户推 Deep Think 功能,Gemini 2.5 Deep Think 模型获 IMO 金牌。它是多智能体模型,通过并行思维输出答案,在多领域及测试中表现佳,但网友评价不一。
机器人的「GPT时刻」来了?丰田研究院悄悄做了一场最严谨的VLA验证实验
丰田研究院(TRI)团队研究大型行为模型(LBM),在近1700小时机器人数据上训练并大量部署评估。发现LBM性能提升显著,预训练小数据量也能带来增益,预示机器人通用大模型或到来。
来自 OpenAI 离职员工的爆料:关于 OpenAI 的一些思考
OpenAI 前员工分享工作感悟,谈及公司文化、代码管理、个人收获及 Codex 发布情况。指出公司成长快但扩张中问题多,文化自下而上且精英主义,代码库大且围绕聊天构建,Codex 发布迅速成果佳。
如何将LLM的"思考习惯"迁移到视觉领域?
传统多模态模型处理复杂视觉推理能力不足,OVR团队以Qwen2.5 - VL - 7B为基础构建开源强化学习框架,成果模型OVR在12个基准测试刷新记录,揭示认知行为跨模态迁移三条黄金定律。
AI 编程冲击来袭,程序员怎么办?IDEA研究院张磊:底层系统能力才是护城河
在AICon全球人工智能开发与应用大会上,IDEA研究院张磊接受专访,剖析多模态智能体落地路径,分享平衡研究与产品的见解,还为年轻人在AI浪潮中发展给出建议,指出底层系统能力是关键。