「超算Colossus 2」共找到 3783 篇相关文章
大模型最后一层竟是推理累赘?绕开对齐税,奥数准确率暴涨 22.4%!
Qwen团队、清华和南洋理工研究打破传统认知,揭示‘对齐税’现象。提出Confident Decoding策略,在多架构和评测集实验中表现出色,开销低,挑战‘LLM最后一层最优’常识。
豆包推出专业版,能成为你的「工作搭子」吗?
6月24日,豆包发布基于最新豆包2.1系列大模型的专业版,新增Agent驱动办公任务模式,支持理解目标、拆解任务等。它回应了用户需求分化,还改变评价标准,有望成生产力入口。
33.5k星星爆火!这个开源插件让AI不再写屎山,token自然就省下来了
Ponytail是开源插件,将资深工程师工程直觉整理成skill规则,供Claude Code等AI coding agent加载。它让AI开发更克制,减少代码量、成本,提升速度,核心是强制AI做复杂度判断。
哈?Q1狂烧250亿!OpenAI财报泄露全网炸锅
最新泄露财报显示,2025年OpenAI收入130.7亿美元,支出340亿,亏损385亿。今年Q1收入57亿美元,却烧掉37亿。虽账上现金充裕,但后续烧钱预计递增。与Anthropic对比,财务状况差异大。不过亏损不绝对影响其IPO。
从3632个漏洞看AI时代的评测基准重构!VulnGym基准发布
随着新一代漏洞检测工具出现,漏洞检测走向理解业务风险。腾讯悟空安全团队联合多机构发布 VulnGym 评测基准,基于真实漏洞构建,覆盖 400+ 漏洞路径,71.2% 为业务逻辑漏洞,支持确定性评测。
ICML 2026 | 西湖大学提出 PiEvo:基于原理进化的科学发现智能体框架
西湖大学研究团队提出PiEvo框架,将科学发现重点从“搜索假设”转变为“进化科学原理”,通过不确定性最小化实现原理空间自主扩展。该框架构建双循环优化机制,实验结果显示其核心指标超越SOTA,收敛速度大幅提升。
陪5岁小朋友玩到黔驴技穷,我用一张照片给他做了个汪汪队手办。
作者陪5岁小朋友玩时,用一张照片结合Hi3D网页和3D打印技术做汪汪队手办。介绍了3D建模、格式选择、代加工等全流程,还分享了成本控制和上色等经验。
“为了一个功能,需要再造一个Google!”Jeff Dean最新对话:TPU的诞生,与那些差点把服务器烧了的疯狂往事
在Google Cloud Next上,Jeff Dean和Amin Vahdat分享了Google算力帝国崛起秘史。从TPU诞生背景,到自研硬件血泪史,再到软硬件协同设计,还探讨了AI未来瓶颈,如能源、硬件等,以及代码编写现状。
以前写书比看书慢,现在看书比写书慢——AI时代最被低估的变局
AI时代信息生产速度超消费速度,这是文明范式转移。过去知识稀缺,现在过剩,多数人应对信息爆炸的方法有误。应从消费信息转为使用信息,这还会重塑教育、社交与社会分层。
狂揽近4万Star!这份Claude Code最佳实践,效率翻倍!
GitHub上`claude - code - best - practice`项目爆火,Star近4万。它是Claude Code全功能实战指南,将「Agentic Engineering」落地开发,解决开发者接入AI的痛点,有结构化方法论、可复用模板等亮点。