「双植入」共找到 195 篇相关文章
马斯克兑现承诺,开源X推荐算法!100% AI驱动,0人工规则
1月11日马斯克宣布7天内开源X平台推荐算法,如今承诺兑现。新算法由Grok驱动,全AI化,移除人工规则。它双引擎驱动信息流、15种行为预测打分,还揭示过滤机制与设计理念,为创作者提供曝光建议。
GEO破圈,豆包爆火,为什么我劝你别轻易丢掉SEO?
A股GEO概念股大涨、罗永浩与豆包对话爆火,让老板和SEO朋友焦虑是否转型GEO、SEO是否凉了。作者认为GEO是未来要重视,但不能丢SEO基本功,还给出构建“SEO+GEO”双引擎的建议。
Chrome已死,Agent当立。 AI Chrome正式发布~
谷歌官宣为Chrome浏览器植入Gemini AI,发布10项更新,如智能体助理上线、跨标签页整合等。但用户体验不稳定,其AI能力是嫁接非原生。创业公司可放弃浏览器,拥抱智能体,利用自身优势发展。
告别RAG相似匹配!百度Agentic-R为多轮搜索重塑检索器
传统检索增强生成(RAG)有“单跳”局限,多跳推理易出错。人大高瓴与百度提出面向智能搜索的检索器训练框架 Agentic - R,采用双视角打分和双向飞轮模式,在多数据集上表现出色。
AI自己给自己当网管,实现安全“顿悟时刻”,风险率直降9.6%
大型推理模型有安全风险,此前监督微调泛化能力有限。SafeKey团队提出创新的SafeKey框架,发现大模型信息“越狱”两大核心,通过双通路安全头和查询遮蔽建模强化模型安全,实验验证其有效性。
73%人类认同率!Video-Bench实现视频质量精准打分
上海交大等团队提出视频评估框架Video - Bench,让多模态大模型‘像人一样评判视频’。它构建双维度评估框架,引入链式查询和少样本评分技术,与人类判断73%高相关,为视频生成模型优化提供标尺。
5 万行代码 Vibe Coding 实践复盘:最佳实践、关键技术,Bitter Lesson
大厂资深工程师分享 3 个月用 AI 写 5 万行代码的体验,介绍 Vibe Coding 实践,分析 Coding Agent 关键技术如语义搜索、MCP,对比 Cursor、GitHub Copilot、Cline 等产品,还提到 Agent 开发要避免过度植入人类经验。
GPT-5.6泄露了!
GPT-5.6泄露,150万Token+神级极简UI下月上线。它在前端有质变,能生成高质量UI,上下文窗口达1.5M tokens。OpenAI采取双版本策略,6月还将迎来Anthropic、Google等模型混战,模型迭代周期也在缩短。
Knowledge还是Reasoning?具体分析LLM答案正确,不代表思考过程靠谱的问题
斯坦福/加州大学团队指出大模型答案正确不代表思考过程靠谱,传统评估忽略思考路径问题。团队提出双维度评估框架,透视模型思考过程,还测试发现不同领域决胜关键、最佳训练法不同,且框架正解锁新场景。
CVPR2025视频生成统一评估架构,上交x斯坦福联合提出让MLLM像人类一样打分
Video-Bench视频评估框架由上海交通大学、斯坦福大学等团队提出,能让MLLM像人一样评估视频。它构建双维度评估框架,引入链式查询和少样本评分技术,突破现有评估方法限制,更全面智能地评分。