「后训练技术」共找到 5968 篇相关文章
Thinking Machines首款产品重大更新:K2 Thinking、Qwen3-VL都可以微调了
由前OpenAI CTO创办的Thinking Machines Lab推出的首款产品Tinker API有重大更新。取消候选名单面向所有用户,还可微调Kimi K2 Thinking,新增兼容OpenAI API接口,支持Qwen3 - VL视觉输入,降低模型训练门槛。
6位前DeepMind老将打造「AI指挥官」,一半成本刷新SOTA
6名前Google DeepMind成员创立Poetiq,搭建元系统让前沿大模型自动生成解决特定任务的策略和模型组合,降低推理成本。其Gemini 3 Pro优化技术在ARC - AGI - 2上创SOTA,成本仅为之前最优方法一半。
AI Agent如何重构企业核心系统?深度拆解Agent、多模态与组织变革的实战路径|AICon
12月19 - 20日北京举办的AICon大会,围绕AI Agent等展开探索。来自腾讯等企业的人士将分享构建智能系统经验。大会有Keynote、平行技术专场、晚场辩论等,涵盖多领域议题,为参会者带来前瞻思想盛宴。
豆包手机被曝搭载锤子 SmartisanOS,二手价逼近8000元!罗永浩点赞字节:技术革命谁也挡不住
近日,豆包手机助手发售即被抢空。有博主发现其系统有锤子科技遗留字样。该手机官方价3499元,二手溢价超一倍。罗永浩点赞。不过,它风波不断,官方回应是技术预览版,不面向普通消费者。
曾经的“芯片之王”,如今在哪里?
文章探讨曾经芯片霸主Intel现状,分析其面临困境。虽有技术能力,但在财务、文化、客户关系等方面存在问题,还错失移动芯片代工与AI芯片发展机会。美国政府对其股权投资,引发市场机制与战略考量的讨论。
社区供稿丨揭秘端到端文档OCR模型 POINTS-Reader
腾讯开源端到端文档OCR模型POINTS-Reader,论文被EMNLP 2025主会录取。它提出可扩展数据生成方案,具简洁、性能好、高吞吐量等特点,通过两阶段训练方案解决依赖蒸馏数据问题,在多基准测试表现佳。
OpenAI没开源的gpt-oss基础模型,他去掉强化学习逆转出来了
OpenAI未发布gpt-oss基础模型,Cornell Tech博士生Jack Morris自行逆转gpt-oss模型强化学习,发布gpt-oss-20b-base。该模型可生成任意文本,但不再对齐,还测试了其记忆能力,介绍了诞生原理与技术细节。
OpenAI将上任新部门CEO,发表深度长文
Instacart首席执行官Fidji Simo将在8月18日加入OpenAI任新部门CEO,她发文阐述AI赋能人类的看法,指出要确保技术为更多人带来机遇,还详述AI在知识、健康等方面改变生活的潜力。
「AI 作弊产品」Cluely 创始人 Roy Lee:别再迷信 PMF 了,先传播才是王道
Cluely创始人Roy Lee颇具争议,他开发的AI作弊软件走红。公司主打病毒式传播,获超1500万美元投资,ARR达700万美元。Lee认为Z世代创始人将成主流,主张先传播后开发,还提出半透明AI覆盖层交互形态。
从实验室到工厂:具身智能如何跨越商业化的“死亡谷”?|甲子引力X
4月28日「AI共潮生——2025甲子引力X科技产业新风向」大会上,五位嘉宾围绕具身智能分享见解。当前行业处概念到商用过渡期,梅卡曼德邵天兰等四位机器人领军人物探讨商业化路径,指出需聚焦场景、降成本、强技术可靠性。