生成式 AI
Claude Code 兼容 AGENTS.md,项目指令开始跨工具复用
Claude Code 正式支持 AGENTS.md!兼容 OpenAI Codex,Shopify CEO:终于不用维护两份文件了
腾讯摘要 / SOURCE SUMMARY
- 1.腾讯摘要称,项目没有 CLAUDE.md 时,Claude Code 会自动读取 AGENTS.md,并可在配置中切换。
- 2.摘要介绍 AGENTS.md 源自 OpenAI Codex,目的是为编码智能体提供项目级说明。
- 3.腾讯摘要同时提醒,项目指令兼容并不代表技能目录等机制已经统一。
扩展解读 / READ
本站只取得关联文章标题和作者信息,因此不把实现细节扩写为独立事实。就腾讯摘要而言,这项兼容降低了团队为不同编码工具维护重复说明的成本。
为什么重要 / WHY IT MATTERS
当多种编码智能体共同进入仓库,项目约束能否用一个文件表达,会直接影响迁移成本与规则一致性。
腾讯摘要 / SOURCE SUMMARY
- 1.据官方原文,GLM-5.3-FlashX 最高输出速度为 200 tokens/s,API 与体验中心已开放。
- 2.官方称提速建立在 10 万张国产芯片提供的推理算力及进一步的基础设施优化上。
- 3.原文称 GLM-5.3-Flash 此前以 Ox Alpha 之名发布,并将本次更新定位为速度层面的增强。
扩展解读 / READ
关联原文是厂商发布稿,确认了型号、调用入口与厂商自报速度,但没有提供统一环境下的第三方延迟或吞吐对比。
为什么重要 / WHY IT MATTERS
对高频 Agent 和实时交互产品,输出速度会影响等待时间与并发设计;选型仍需结合首 Token 延迟、稳定性和成本实测。
腾讯摘要 / SOURCE SUMMARY
- 1.腾讯摘要称模型支持文本、图像、音频和视频输入,并提供 100 万 Token 上下文。
- 2.摘要称其重点面向视频剪辑、翻译配音、电影解说和会议纪要等音视频工作流。
- 3.据腾讯摘要,相关插件与 Harness 同步扩展,音频和音视频输入价格有所下降。
扩展解读 / READ
本站只取得关联文章标题,模型能力、评测和降价数字均保留为腾讯摘要口径,不作独立确认。
为什么重要 / WHY IT MATTERS
统一处理长音视频及多模态输入,可能减少工作流中的模型切换;真正可用性仍取决于时序理解、工具调用和输出一致性。
腾讯摘要 / SOURCE SUMMARY
- 1.腾讯摘要称 MiniMax 发布 Code CLI v0.4.12,并以 MIT 协议开源。
- 2.据摘要转述的第三方评测,该工具在 30 道任务中通过 23 道,通过率为 76.7%。
- 3.官方称开源有助于开发者审视工具调用和权限处理,并参与安全机制改进。
扩展解读 / READ
本站只取得关联文章标题,因此版本、协议和评测数字均按腾讯摘要呈现;单一小样本评测不能代表所有工程场景。
为什么重要 / WHY IT MATTERS
CLI 开源让团队有机会检查权限边界、改造工具链并自行部署,但企业采用仍需要审计命令执行与数据访问路径。
前沿科技
腾讯摘要 / SOURCE SUMMARY
- 1.腾讯摘要转述路透社报道:Anthropic 在旧金山湾区建立生物湿实验室,并探索让 Claude 指挥实验室机器人。
- 2.摘要列出一次蛋白设计实验的靶点和命中率数据,但本站未读取正文,无法核对实验条件。
- 3.腾讯摘要称配套接口标准意在缩短 AI 与实验设备的集成时间。
扩展解读 / READ
本站只取得关联文章标题和作者信息。实验结果与实验室状态均属于腾讯摘要对报道及公司口径的转述,不应视为本站独立确认。
为什么重要 / WHY IT MATTERS
模型一旦连接真实实验设备,价值从建议走向执行,同时也把安全边界、可追溯性和人工复核提升为核心要求。
Figure 发布 Helix 2.5,官方报告 30 户陌生家庭零样本作业
王兴兴的目标要被实现了?!Figure发布新模型Helix 2.5,接近“具身智能ChatGPT时刻”
腾讯摘要 / SOURCE SUMMARY
- 1.据关联原文转述 Figure 官方测试,机器人在 30 户未采集训练数据的家庭完成整理客厅、折叠毛巾与铺床。
- 2.官方对照实验称,从零训练策略的零样本成功率为 9%,Index 预训练模型为 56%。
- 3.原文称 Figure 计划扩大人类行为数据与算力投入,包括与 Nscale 的基础设施合作。
扩展解读 / READ
关联正文详细介绍了 Figure 的官方实验和媒体解读,但没有独立复现实验;成功率、数据增长和投资规模均应理解为原文或官方称。
为什么重要 / WHY IT MATTERS
陌生家庭中的长时序任务比固定工位更接近消费场景,但从演示走向产品仍需观察安全、故障恢复和长期稳定性。
腾讯摘要 / SOURCE SUMMARY
- 1.据原文转述宇树资料,UnifoLM-WLA-1.0 为 6B 参数,使用约 2500 小时真机数据,覆盖 64 项任务。
- 2.原文称推理底座基于 Qwen3-VL-4B 和超过 500 万条样本训练,并报告多项基准成绩。
- 3.技术路线以交互区域预测、统一动作表示和动作专家连接环境理解与连续控制。
扩展解读 / READ
关联正文提供了模型结构、数据规模和任务示例,但基准结果与“领先”结论来自厂商材料和媒体转述,尚非本站独立评测。
为什么重要 / WHY IT MATTERS
开放模型、代码和数据若按计划落地,可让外部开发者检验跨本体、跨任务泛化,而不只观看单次演示。
报告观点
腾讯摘要 / SOURCE SUMMARY
- 1.腾讯摘要转述 Kevin Bai 的观点:Palantir 的前置部署工程师模式对应更高客单价,并列出若干公司对比数字。
- 2.他认为 FDE 适合把复杂技术产品交付给传统客户,前提是存在可复用的平台底座。
- 3.其判断是,AI 软件更可定制后,驻场工程模式可能从例外走向更常见的交付方式。
扩展解读 / READ
本站已取得关联正文,但其中公司客单价与行业趋势属于作者分析和二手数据,不作为独立事实;FDE 的关键边界在于定制成果能否反哺平台。
为什么重要 / WHY IT MATTERS
AI 产品的模型能力与客户流程之间往往存在实施鸿沟,团队需要在可复制产品和高触达服务之间设计清晰边界。
腾讯摘要 / SOURCE SUMMARY
- 1.腾讯摘要转述其观点:基础模型持续进步,产品团队应围绕模型已有能力打开轻量通道。
- 2.他以 Artifacts 为例,认为界面空间变化可以改变用户对共同创作的理解。
- 3.他判断未来用户或许会使用大量按个人需求生成的小应用,而非共享少数固定应用。
扩展解读 / READ
关联链接返回参数错误,本站只能依据腾讯摘要整理。这是设计负责人的产品判断,不是已发生的市场事实。
为什么重要 / WHY IT MATTERS
若应用由用户即时生成,设计工作的重点会从统一页面转向约束、反馈、可信度与注意力分配。