「是石科技」共找到 4773 篇相关文章
大模型竞赛转向:决胜关键为何是“后训练”?|甲子光年
大模型价值主战场向后训练转移,Grok 4凭后训练成“宇宙最强”。产业应用中通用模型适配难,后训练方法也在进化,如采用SFT+RL等,还介绍了夸克和阿里云的后训练实践。
夸克高考,背后藏着的其实是垂类场景「深度研究」方法论
夸克早在2019年就提供高考志愿填报服务,今年推出“志愿报告”功能。其“志愿报告”Agent已生成超1000万份报告,采用PDCA模式给出指导。夸克构建可信度体现在数据库和自研模型上,还降低了幻觉率。
苹果拆解AI大脑,推理模型全是「装」的?Bengio兄弟合著
苹果最新研究揭示大推理模型(LRM)在高复杂度任务中普遍‘推理崩溃’。即便给予明确算法提示,模型亦无法稳定执行,暴露推理机制的局限性。研究还通过多种实验环境分析了模型在不同复杂度问题中的表现。
LLM学习笔记:最好的学习方法是带着问题去寻找答案
文章总结拓展Andrej Karpathy教学视频,分析大模型聊天流程与原理,介绍LLM训练步骤,包括预训练、后训练和强化学习,还提及主流特性应用,如文件上传、网络搜索,强调带问题学习的重要性。
AI开始替人类调用AI!token用量已是人类5.2倍
据OpenRouter统计,截至8月10日,Agent类token用量半年涨14倍,人类仅2.8倍。差距源于用法差异,虽智能体部分token计价低,但用量大仍烧钱。省钱关键在配套,且智能体任务验收缺人手。
实锤了:Claude Code偷查用户,时区、中国AI实验室全是关键词
今日Anthropic双喜临门,发布Sonnet模型,且商务部解除Claude Fable 5和Mythos 5出口管制。但同日Claude Code被曝偷查用户,用隐写术藏信息,引发对其信任问题的争议,官方称将移除代码。
Headroom:Netflix 工程师开源的上下文压缩工具,省 token 还是烧 token?
Netflix工程师Tejas Chopra开源Headroom,定位为AI Agent的上下文压缩层,压缩工具输出等内容,有可逆压缩等特性。官方数据显示节省token效果好,但微软工程师实测结果中性偏负面。
OpenClaw大更新,AI智能体不再是黑箱!官方口号:少点神秘
4月25日,OpenClaw发布v2026.4.25版本,官方口号“Less mystery, more machinery”。此次更新核心指向AI智能体下半场要更透明、可控,涵盖语音、可观测性、插件启动等多方面改进。
黄仁勋:没有AI,英伟达依然是巨无霸!盛赞中国算力与能源优势
英伟达CEO黄仁勋在播客对话中称,即便AI未出现,英伟达靠加速计算也能成巨无霸。他盛赞中国算力与能源优势,反驳中国缺AI芯片的观点,还谈及错失与OpenAI等合作的经历。
突发!奥特曼豪宅遭二次袭击,燃烧弹之后又是深夜枪响
奥特曼家继上周五遭燃烧弹袭击后,周日凌晨又被开枪袭击。警方锁定车辆并逮捕两名嫌疑人。奥特曼曾发文感化仇恨者但无效,AI末日论者认为科技大佬推动AI有风险,呼吁采取紧急措施。