「AI生活助手」共找到 9669 篇相关文章
Docker 通过 Cagent 提供 AI 代理确定性测试
AI 代理系统普及,工程团队面临测试概率性输出的挑战。Docker 的 Cagent 是一种 AI 代理确定性测试方法,采用 proxy - and - cassette 模型,虽处早期,但揭示了 AI 代理测试的不同方向。
谷歌年度大招:所有AI模型全升级一遍!Gemini2.5大杯中杯霸榜前二,新版视频/图像模型亮相
谷歌在I/O大会放大招,升级所有AI模型,重做原有产品,推出诸多实验性新产品。如Gemini 2.5系列升级,具备新功能;还有异步代码助手Jules、新搜索模式等,多模态模型也全线升级。
Anthropic曝光自家整套,AI原生研发手册
Anthropic 在官方博客发布两篇内部实践文章,《The AI-Native SDLC Playbook》讲 AI 承担多数编码工作时软件流程安排,《How Anthropic secures its AI-native software development lifecycle》谈流程自动化后安全体系建设。
小美Agent:当龙猫遇到美团外卖的灾难现场
作者体验美团AI助手“小美”后吐槽不断。美团称其用有5600亿参数的龙猫大模型,能力接近GPT - 4o,但它理解需求差、操作订单无效、定位混乱。美团做AI是为跟风,未解决用户真需求,是资源浪费。
起底“豆包手机”:核心技术探索早已开源,GUI Agent布局近两年,“全球首款真正的AI手机”
当红的“豆包手机”技术详情被证实,其助手技术基于字节自研的UI-TARS模型,该模型初代开源后引发热议,“豆包手机”用的闭源版性能更优。UI-TARS历经迭代,成果成热门开源多模态智能体。
国产算力解决方案,如何赋能“AI for Science”?
AI已成驱动科研范式变革的核心力量,“AI for Science”成趋势。中科院陈刚分享AI赋能高能物理见解,还谈及国产算力方案应用表现,22家机构企业发起“科学智能联合攻关行动”。
Anthropic 新研究:AI出错是“热混乱”
Anthropic研究团队发现AI可能无一致目标,只是瞎搞。他们将AI错误分类,测试发现推理越久越混乱,大模型复杂任务易失控。此发现改变对AI风险的认知,论文已在arXiv发布。
微软强塞AI暴涨价!小哥惨遭Office全家桶绑架,每月含泪打钱一次未用
最新调查称仅8%的人愿为AI买单,科技巨头却将AI硬塞进日常软件。外国小哥Ted Gioia吐槽被微软AI全家桶绑架,付费却未用。巨头此举或为掩盖亏损,Meta还计划激进推AI,而ChatGPT将上线新功能。
GitHub告诉你,开发者真正需要的AI是什么
GitHub高级产品经理与开发者布道师交流发现,开发者想要更顺畅、少打断的创造过程。优秀AI编码工具应守护专注力、减少对话框干扰、赋予开发者掌控权,适应不同阶段开发者需求。
A16z: AI 产品的护城河在哪里?
a16z新博文结合与创始人沟通,总结AI公司突围成长关键点。指出演示易、产品难,AI初创增长快,开发成本降,速度很重要,还介绍了AI公司建立护城河的方式,认为当下是创业者好时机。