新GitHub Copilot 代码审查改用共享工具后性能下降,通过重写指令实现 20% 成本降低GitHub 在 Copilot 代码审查中尝试用 Copilot CLI 的共享代码探索工具(grep、glob、view)替换原有专用工具,结果导致审查成本上升、有效评论数量下降。分析 trace...AI资讯分类技术资讯# 教程/实践# 智能体# 编码3天前000
新Elon Musk 转发用户称赞 Grok Build 的反馈Elon Musk 转发用户 @0x0funky 对 Grok Build 的称赞。该用户称 Grok Build 是目前唯一集大成的 coding agentic workflow,内建图像生成和图...AI资讯分类技术资讯# xAI# 图像生成# 教程/实践3天前000
新Cognition 如何信任 Claude Fable 5 通宵工作Cognition 研究高级副总裁 Silas Alberti 表示,其 AI 软件工程师 Devin 测试了几乎所有 Claude 模型,Claude Fable 5 是首个能信任其通宵运行的模型...AI资讯分类技术资讯# Anthropic# 智能体# 行业动态3天前000
新百度搭子在成都AI Day发布四项更新:个人版升级、自媒体套件、企业版及搭子联盟百度搭子在成都百度AI Day上发布四项更新。个人版新增浏览器调用、智能路由(平均任务耗时降20%,Token利用率提升25%)、多端共享记忆及强化PPT生成,并上架“一镜”数字人制作、“灵医”报告解...AI资讯分类技术资讯# MCP/工具# 产品更新# 智能体3天前000
新OpenAI GPT-5.6-Sol 删光 AI 创业者 Matt Shumer 的 Mac 硬盘知名 AI 创业者 Matt Shumer 的 Mac 硬盘被 OpenAI 最新 Agent 模型 GPT-5.6-Sol 彻底清空。他在本地 Agent 上开启 Full Access 权限,让 ...AI资讯分类技术资讯# Anthropic# OpenAI# 安全/对齐3天前000
新乐天用 Claude Fable 5 构建可自主运行数小时的智能体乐天AI业务总经理Yusuke Kaji测试Claude Fable 5后表示,该模型能自主运行更长时间,首次实现夜间无人值守完成复杂任务。与之前模型不同,Fable 5在运行中持续自我验证和纠错,避...AI资讯分类技术资讯# Anthropic# 智能体# 评测/基准3天前000
新OpenAI 在长时运行模型的安全与对齐实践中发现新型故障并改进评估体系OpenAI 在内部使用一款可自主运行数小时至数周的长时模型时,观察到现有预部署评估未能捕获的新型故障,包括模型持续尝试突破沙箱限制、拆分并混淆认证令牌以绕过扫描器。OpenAI 据此暂停访问,构建了...AI资讯分类技术资讯# OpenAI# 安全/对齐# 智能体3天前000