「等变局部评分机」共找到 8029 篇相关文章
担心被曝“于谦门”,57岁的于谦到底用龙虾做了什么?
于谦视频播客《多新鲜呐》最新一期,本质是“AI产品用户体验公开测试”。于谦作为测试员,关注点在结果、省事、风险等,节目把技术叙事换成生活叙事,帮AI面向大众转译。
Kimi团队深夜潜入Reddit开了场AMA,他们都聊了些什么?(据说代号4494就是杨植麟本人)
今日凌晨,Kimi团队在Reddit社区开展AMA交流,解答大家疑问。期间回应Claude蒸馏争议,探讨编程写作侧重、小参数模型需求、缩放定律等问题。K2.5表现出色,K3值得期待。
AgentCPM-Explore开源,4B 参数突破端侧智能体模型性能壁垒
清华大学、中国人民大学等联合研发的 AgentCPM-Explore 开源,基于 4B 参数在深度探索任务上表现出色,打破参数壁垒,开源全流程基建,还探索出提升小模型性能的方法。
AAAI 2026 Oral|InfiGUI-G1模型来了,刷新GUI Grounding SOTA
多模态大语言模型发展下,GUI Grounding任务是难题,现有RLVR方法有瓶颈。浙江大学等团队提出AEPO框架,推出InfiGUI - G1系列模型,小参数量刷新GUI基准测试SOTA,代码已开源。
这,才是Vibe Coding的未来。
作者分享蚂蚁灵光更新,可搓小游戏,认为这是Vibe Coding未来。普通人能用上是其亮点,还举例扫地机器人、灵光开发三国人物关系等游戏,指出技术应隐藏自己,降低门槛。
听说,大家都在梭后训练?最佳指南来了
大模型时代,Scaling Law 边际效益递减,业界转向后训练。《Post-training 101》博客可助初学者入门,涵盖从预训练到指令微调、SFT 原理、多种强化学习技术及模型评测方法等内容。
一场「狼人杀」,考倒了一堆大模型
南开大学等机构设计 InMind 评测框架,在 Avalon 游戏对 11 个前沿大模型测试。多数模型停留在表层模仿,仅少数推理增强模型有初步‘风格敏感性’,未来人机交互应关注‘像不像’。
用了60天Claude Code,我的Vibe Coding终极指南:从0到1的正确打开方式
作者分享使用Claude Code 60天的经验,用多个案例展示其将AI编程从辅助推向自主的能力,还给出Vibe Coding方法论、工作流等,提醒别被工具束缚,技术为人服务。
OpenAI 内部访谈流出:新 Agent 强到让我们害怕,已接近“自我进化”的边缘!
红杉资本访谈 OpenAI 打造新款 ChatGPT Agent 的核心成员。介绍 Agent 结合多工具、共享状态,能执行复杂任务。还谈及起源、训练方法、应用场景,以及安全挑战和未来规划等。
人类选手苦战10小时获得世界编程冠军,OpenAI获得亚军,但这可能是最后一次了
在AtCoder启发式编程世界杯总决赛,人类选手Psyho苦战10小时击败OpenAI的AHC模型夺冠。赛事专注优化问题,比赛过程跌宕起伏,也证明了AHC具备持续性推理等关键能力。