「深度补全」共找到 2647 篇相关文章
Anthropic万名工程师都离不开!深夜随手撸出的开源神器,被OpenAl高价收购,23人创业逆袭
昨日,OpenAI 宣布收购 AI 安全初创公司 Promptfoo,其技术将整合进 OpenAI Frontier 平台。该公司由 23 人创立,开发开源工具测试 AI 系统安全。收购后 Promptfoo 保持开源,OpenAI 将新增相关功能。
谷歌Gemini 3.1新模型深夜掀桌, 每秒狂飙363 token! 1/4价格暴击Claude
谷歌深夜推出Gemini 3.1 Flash-Lite,输出速度363 token/s,价格仅0.25美元/百万Token,跑分碾压GPT-5 mini和Claude 4.5 Haiku。开发者可通过Google AI Studio体验,企业用户可通过Vertex AI接入。
AI智能体也有「蜘蛛感应」,防御延时骤降至8.3%
传统Agent防御机制易致延时积累,研究者联合推出Spider - Sense智能体防御框架,利用两大核心技术将防御延时从200% + 降至8.3%,在主流数据集和新基准测试中表现优异。
ICLR 2026 oral | AI代码真能进生产环境?SwingArena:从「写对代码Commit」到「通过CI审查」
过去一年大模型写代码能力提升,人们思考其能否参与软件工程核心流程。现有评测基准有缺失,SwingArena填补空白,将博弈引入评测,设计检索增强流水线,其开源后或成评估AI编程能力新工具。
冲159K星 OpenClaw工具链,正在悄悄改变Agent玩法
Clawdbot更名openclaw后在github星冲到159K。它能让AI深入工作流且保数据隐私,有集成渠道多、工具齐全、有状态会话与持久记忆、路由策略适配不同模型等核心能力,并在多方面优于常见AI工具。
Karpathy盛赞,啥都没有的创业公司刚融了1.8亿美元,要用小数据造强智能
AI创业公司Flapping Airplanes几乎无产品、盈利,也不急于商业化,却获1.8亿美元融资及Andrej Karpathy力挺。它专注解决“数据效率”问题,探索新思路,目标是做改变范式的研究。
大语言模型逻辑评估
现有归因问答评估方法有‘归因短视’问题,研究团队提出 LOGICSCORE 框架,从三维度量化推理质量。在多数据集测试多款 LLM,发现专有、开源模型等存在不同逻辑问题,还分析典型逻辑错误。
智源悟界 · Emu3.5 重塑世界模型格局:首提多模态 Scaling 范式,AI 理解世界再进化
北京智源研究院发布大规模多模态世界模型“悟界·Emu3.5”,它能模拟复杂动态物理世界,揭示“多模态Scaling范式”。该模型继承深化Emu3技术哲学,在多方面有提升,为世界模型领域提供进化路线。
SEO->GEO?大模型时代如何构建人类获取信息新范式
文章指出百度信息入口根基被侵蚀,或被DeepSeek替代。还阐述互联网大势格局,如基模最终收敛,互联网盈利模式从用户免费-营销付费向用户付费转变,高价值真实信息将重构互联网。
北大校友、华人学者金驰新身份——普林斯顿大学终身副教授
华人学者金驰宣布在普林斯顿晋升为终身副教授,任命2026年1月16日生效。他在机器学习理论领域贡献大,为LLM崛起提供数学基石,解决非凸优化和强化学习样本效率等问题。