「自改进」共找到 1391 篇相关文章
他,37岁华裔,靠AI成为福布斯400最年轻亿万富翁,身价180亿美金!
37岁华裔Edwin Chen成《福布斯400》最年轻亿万富翁,身价180亿美元。他拒绝VC融资,用积蓄打造估值300亿美元的AI数据标注公司Surge,希望让AI学会「人类的复杂性」,还担忧AI模型被错误优化。
微软开源3大突破AI Agent模型,仅140亿参数超越DeepSeek-R1
微软研究院开源AI Agent推理模型rStar2-Agent,140亿参数在多测试超6710亿参数的DeepSeek-R1。其通过智能体强化学习,在训练基础、算法、流程上有三大突破,显著提升性能且降低算力成本。
苹果新研究:不微调、不重训,如何让AI提问效率暴增6.5倍?
苹果与牛津、港城大合作提出 BED - LLM 方法,能让 AI 解决问题能力提升 6.5 倍,无需微调重训。它基于序贯贝叶斯实验设计框架,通过三重智慧设计,经测试全面超越基准方法,或开启‘智慧对话’时代。
GPT-5问题太多,奥特曼带团回应一切,图表弄错是因「太累了」
GPT - 5发布后问题频出,在数学、逻辑、编码任务中失误不断,还出现低水准图表错误,引发吐槽质疑。OpenAI联合创始人Sam Altman等在Reddit AMA活动中回应问题,给出解决方案并分享未来规划。
从 Hadoop 到 Kubernetes:Pinterest 在 AWS EKS 上的可扩展 Spark 架构
Pinterest将基于Hadoop的数据平台替换为Moka,这是在AWS EKS上运行Spark的Kubernetes原生系统。Moka实现容器化作业隔离,支持ARM实例,改进调度、简化部署,降低成本、提高效率。
不靠海量数据,如何精准喂养大模型?上交Data Whisperer:免训练数据选择法,10%数据逼近全量效果
上海交通大学等团队提出 Data Whisperer,首个免训练的注意力驱动数据选择框架。它利用模型自身能力打分挑数据,无需训练与人工标注,用 10% 数据让微调效果逼近全量数据,在多方面领先传统方法。
AI越训练,越会「满嘴跑火车」!普林伯克利重磅揭秘,RLHF竟是罪魁祸首?
普林斯顿和伯克利研究《Machine Bullshit》,定义并量化LLM胡扯行为,总结四大套路,提出胡扯指数。实验发现强化学习人类反馈训练后,AI胡扯倾向加重,多思考也会让其更会忽悠。
Chrome危!AI浏览器新品大爆发,OpenAI都来抢饭碗
AI时代浏览器成兵家必争之地。英伟达投资的Perplexity推出AI浏览器Comet,OpenAI也将发布。老牌谷歌Chrome难撼动,新势力各有亮点,国内市场争夺也愈发胶着。
突破全模态AI理解边界:引入上下文强化学习,赋能全模态模型“意图”推理新高度
在多模态大语言模型应用多元的当下,对模型理解人类意图需求迫切。阿里巴巴通义实验室团队推出HumanOmniV2,解决现有推理路径问题,其相关代码等开源,在多基准数据集成果突破性领先。
Cursor调价风波背后:商业逻辑与用户期待的错位
Cursor在6月16日调整Pro计划收费模式,从请求数限制改为计算量限制,虽称优化却引发用户不满。用户发现服务缩水且沟通模糊,社交媒体上一片失望愤怒声。7月4日Cursor道歉并推出补救措施,但信任修复不易。