「日日新6.5」共找到 5498 篇相关文章
Anthropic:警惕评测排行榜!差别可能只是机器的内存更大,而已
Anthropic发工程博客指出,AI编程评测排行榜上排名前列的模型分差小,而运行环境硬件配置能让分数波动6个百分点。同一模型在不同沙箱策略下分数不同,资源配置影响评测结果,排行榜分数差距或因硬件。
模力工场 033 周 AI 应用榜:从评论区互动到游戏陪玩,AI 已悄悄加载完成
模力工场 033 周 AI 应用榜发布,展示了 AI 在各领域的应用。各大厂选择在原有产品里做能力延伸,开发者将分散的 AI 功能整合。榜单涵盖学习、生活、娱乐等多领域应用,AI 更便利、隐形地融入日常。
香农、信息论、AI、Scaling Law,以及信息的观察者效应
文章围绕经典信息论在AI实践中的矛盾展开,介绍CMU和NYU论文《From Entropy to Epiplexity》提出的新概念,解释合成数据、数据排序等问题,还探讨合成数据飞轮能否持续,指出epiplexity可定义数据质量。
美团悄悄上线的AI浏览器Tabbit,我觉得它更适合普通人。
美团光年之外团队发布AI浏览器Tabbit,作者认为它比Comet的Agent能力更强,产品完整细节好还免费。与类OpenClaw产品是互补关系,能处理场景式任务,还有很多实用功能,值得一试。
吴恩达复盘百度岁月:我带过的自动驾驶、智能音箱都成了!Altman 我也带过,但 Gemini 3 比 ChatGPT 强
吴恩达团队提出新版图灵测试,重新界定 AGI。他参加播客谈及 AI 发展关键议题,认为 AGI 短期内难实现,规模化时代未结束但非唯一路径,AI 不会大面积取代岗位,中美 AI 各有所长。
一天两枚“代码核弹”:OpenAI 祭出首个“主打实时协作”的 Codex 模型,谷歌放出 Gemini Deep Think,码力冲到世界前8
OpenAI 发布 GPT - 5.3 - Codex - Spark 研究预览版,专为实时编码设计,降低交互延迟。谷歌更新 Gemini 3 Deep Think,面向科研与工程难题,在多领域测试表现出色,二者引发网友热议。
美议员联合施压:拟对华芯片设备出口管制再升级!
本周美国众议院多位议员致信国务院与商务部,呼吁加强对华晶圆制造设备出口限制。新提案禁止向中国出售无法本地生产的设备,还限制售后维修,要求施压盟友建立多边禁运机制。
Yann LeCun非生成世界模型前瞻:开年三篇论文展示JEPA工程化拐点
2026年Yann LeCun团队3篇论文展示基于JEPA框架的非生成世界模型工程化拐点。Rectified LpJEPA让表示更省力,GRASP将长时域规划并行求解,EB - JEPA把方法写成代码,为非生成式世界模型提供技术路线。
彩讯股份 CEO 白琳:企业级AI正从技术热潮走向系统化落地
1月31日彩讯股份发布《企业级AI应用白皮书》,CEO白琳接受采访。指出企业级AI正从技术驱动转向应用落地,面临系统性挑战,白皮书梳理发展阶段、痛点与路径,还介绍了‘1+1+N’策略等。
3年、1万人,快手技术团队首次系统披露AI研发范式升级历程
快手首次系统性披露自2023年以来的AI研发范式升级历程。其研发效能演进分三阶段,从平台化到智能化,虽遇个人提效难传导至组织提效的问题,最终仍找到提升需求端到端交付效率的路径。