「谷歌I/O」共找到 1241 篇相关文章
Test Time Scaling Law远未达到上限! o4-mini仅15.8%通过率,华为诺亚提出代码HLCE终极基准
华为诺亚研究员推出全新编程基准HLCE,含235道竞赛难题。实验显示,顶级LLM在该基准表现不佳,推理模型优势大,IOI交互式题难攻克。研究还发现模型自我认知与推理能力发展不同步,Test Time Scaling Law远未达上限。
OpenAI连丢4位大将!Ilya合作者/o1核心贡献者加入Meta,苏黎世三人组回应跳槽:集体做出的选择
OpenAI连失4员大将,Trapit Bansal跳槽Meta,继续研究推理大模型;苏黎世三人组Lucas Beyer等也加入Meta。此外,Meta还在洽谈收购语音AI初创公司PlayAI,连续布局语音AI。
只训练数学,却在物理化学生物战胜o1!新强化学习算法带来显著性能提升,还缓解训练崩溃问题
上海创智学院、上海AI Lab的MM - Eureka系列工作提出新强化学习算法CPGD,缓解训练崩溃问题,提升性能。还构建多模态强化学习框架,推出MMK12数据集和MM - PRM模型,开源相关成果。
承认自己开源不行?转型“美国DeepSeek”后,两个谷歌研究员的AI初创公司融到20亿美元,估值暴涨15倍!
AI创业公司Reflection AI由两位前Google DeepMind研究员创立,一年完成20亿美元融资,估值达80亿美元。它从编码智能体起步,现转型为开源替代公司,主打“开源”牌,计划明年推前沿语言模型。
推荐:AI搜索增加链接展示,从谷歌people also ask到AI搜索;AI绘画从吉卜力到Nano Banana增长方法论
文章推荐两篇内容。一是Google将在AI模式增加链接展示,访谈提及AI搜索是传统搜索迭代,核心SEO原则仍有效;二是复盘Remini借热点增长的DICE模型,含数据监测、敏捷创新、创意营销和数据验证。
图像界的DeepSeek!12B参数对标GPT-4o,5秒出图,消费级硬件就能玩转编辑生成
Black Forest Labs开源旗舰图像模型FLUX.1 Kontext[dev],专为图像编辑打造,能在消费级芯片运行。12B参数少、推理快,性能媲美闭源模型。有诸多特点,经优化训练,在KontextBench基准表现优。
SOTA大模型遇上加密数据评测:Qwen3未破10%,o1也栽了丨上海AI Lab等联合研究
当前推理模型在基准测试中性能卓越,但在密码学领域推理能力待探索。上海AI Lab等推出CipherBank评测,用海量真实隐私场景数据和多类型密码算法挑战SOTA大模型,结果显示模型表现不佳,还分析了模型“犯难”原因。
28岁印度裔创始人忽悠谷歌24亿!劈柴哥力推的王牌IDE,底裤被扒了个精光:“套壳”Windsurf,连Bug一起!
Google发布号称‘下一代agentic开发平台’的Antigravity IDE,开发者上手体验不佳。深入分析发现它像是Windsurf专有分支,界面、功能高度相似。其创始人称它是全新理念平台,但产品问题多,安全性存风险。
马斯克挖不动的清华学霸,一年造出 “反内卷 AI”!0.027B 参数硬刚思维链模型,推理完爆 o3-mini-high
新加坡 Sapient Intelligence 推出小型模型 HRM,参数仅 2700 万却能解决复杂推理难题,其不依赖“思维链”,借鉴人类大脑工作方式。该模型准确率超先进思维链模型,推理能力强,具经济性,可提升任务效率。
Angular 官方的智能体 Skills 助力 AI 编程工具生成现代化的 Angular 代码
谷歌 Angular 团队发布 angular/skills 仓库,含两种智能体 Skills,能让 AI 编程智能体编写现代化 Angular 代码。这些 Skills 针对特定工具设计,开发者可安装使用,社区对此看法不一。