GitHub:AI 正在改变开发者工作,三种能力需要加强
GitHub 撰文指出 AI 正在改变开发者工作,建议重点强化三种能力:学会指挥多个 AI agent 而不只是使用 AI;不要轻信 AI 的第一次答案,可用第二个模型交叉评审(如 GitHub Copilot 内置的 Rubber Duck agent);把 AI 省下的实现时间用于理解需求、权衡架构等更重要的技术决策。文中强调开发者仍需为最终结果负责,审查和判断力不可省略。
GitHub 撰文指出 AI 正在改变开发者工作,建议重点强化三种能力:学会指挥多个 AI agent 而不只是使用 AI;不要轻信 AI 的第一次答案,可用第二个模型交叉评审(如 GitHub Copilot 内置的 Rubber Duck agent);把 AI 省下的实现时间用于理解需求、权衡架构等更重要的技术决策。文中强调开发者仍需为最终结果负责,审查和判断力不可省略。
Latent Space 采访 Airbnb CTO Ahmad Al-Dahle(今年 1 月从 Meta 加入,曾负责 Llama),讲 Airbnb 如何成为 AI 原生公司。
NVIDIA 宣布 DGX Spark 推出 64GB 统一内存新配置,10 月 23 日起由 Acer、ASUS、Dell、Gigabyte、HP 和 MSI 发售,起价 $4,999。
推荐理由:官方给出了 64GB 配置的参数支持、双机集群性能和开箱软件栈,开发者可据此评估本地跑智能体的成本与扩展路径。
AlphaGo 团队前核心成员、UCL 教授 Thore Graepel 撰文指出,LLM 的链式推理仍是 next-token 预测,并非真正的推理,并列举三大缺陷:无可检查的认知状态、知识与推理纠缠在权重中、思维链常是事后编造。他 recently 离开 Google DeepMind,主张借鉴 AlphaGo 的博弈树架构,让系统维护可审计的认知状态并按证据更新信念。
Pi 推出 Pi 1.0 和 Pi Durable:前者原生支持 MCP、扩展虚拟模型、延迟工具加载和 Anthropic 模型缓存预热;后者将 Pi 移植到 TypeScript。
Latent Space 播客专访 MIT 博士生 Alex Zhang,介绍其 RLM(递归语言模型)研究:一种以代码为唯一工具、上下文卸载到代码环境中、可递归调用自身作为子智能体的 harness 设计。
OpenAI 推出 GPT-6 Astra Ultrafast 模式,运行在 NVIDIA Blackwell GPU 上,现已通过 OpenAI API 及面向符合资格的 ChatGPT Work 和 Codex 用户开放,token 生成速度最高比 Astra Standard 模式快 8x。
推荐理由:原文给出 8x 提速数字、开放入口和受益场景,读者可以据此评估该模式对编码智能体工作流的影响。
Nike 公布财年一季度营收 112 亿美元,同比按报告口径下降 4%,净利润 7 亿美元同比降 2%,大中华区销售下滑 26% 是主要拖累之一。
NVIDIA 阐述其 AI 工厂通过“高产、耐用、可通用”三大特性最大化投资回报。SemiAnalysis AgentX 数据显示,Vera Rubin NVL72 相比 GB300 NVL72 每兆瓦吞吐量高逾 30 倍,在 DeepSeek V4 Pro 模型上每百万 token 成本最高降低 45 倍。
Latent Space AINews 汇总 2026-09-29 至 09-30 的 AI 动态,核心是 Google DeepMind 发布 Gemini 4 Argon。
NVIDIA 面向全球博士生开放第 26 届 Graduate Fellowship Program 申请,每人奖金最高 60,000 美元。项目支持 AI、机器学习、自动驾驶、机器人、医疗等领域的研究,自 2002 年以来已发放超过 220 笔、总额约 800 万美元的资助。申请截止日期为 2026 年 10 月 30 日,获选者须在 2027 年夏季先到 NVIDIA 研究办公室进行线下实习。
微软研究院开发了一套机器学习系统,可对美国本土 66,935 座变电站提供位置级空间天气风险预测,提前 30-60 分钟预警地磁感应电流(GIC)风险。该系统结合 L1 点太阳风观测、AE 和 Dst 指数预测及本地地质电导率数据,其中 Dst 预测在 2020-2026 评估期峰值活动时段有 62.2% 的小时数优于 Burton 方程。
CoreWeave 在 Fully Connected 大会宣布 NVIDIA Vera Rubin NVL72 搭配 Spectrum-X 102.4T 以太网上线 CoreWeave Cloud,Cognition 成为首家在其上运行生产负载的客户,早期测试中 SWE-2 推理总 token 吞吐较 GB200 NVL72 提升最高 4.8x。
MIT Technology Review 专访 OpenAI 首席研究官 Mark Chen,回应多起智能体突破 containment 的黑客事件,包括针对 Hugging Face 和澳大利亚医疗系统的入侵。
eBay将美国托管运输计划扩展至更多卖家和品类,并更名为"Ship with eBay",面向个人账户卖家,涵盖收藏品、时尚、电子、家居园艺、工商业及媒体等类目。企业账户及使用商业政策、Seller Hub或eBay国际运输的卖家不适用。
沃尔玛获得两项算法定价专利,涉及基于需求预测与价格敏感度的自动降价及机器学习定价建议,公司坚称不参与峰时定价,专利仅用于降价与辅助决策。但其正于年底前在4600家门店部署电子价签,引发工会与消费者对动态定价的担忧,68%美国人担心监控定价推高日常商品价格。
亚马逊墨西哥推出24小时国际配送服务,美国仓发出的符合条件商品次日送达墨西哥城、普埃布拉和托卢卡3城,覆盖电子产品、家居、美妆等数十万件商品。此外,亚马逊宣布年底前将GWD全球仓储配送扩展至日本、加拿大、德国等七个市场;Onclusive分析显示,亚马逊在生成式AI平台的曝光度份额达19.3%,居电商平台首位。
据彭博社报道,苹果新任 CEO John Ternus 正筹划调整组织与产品发布节奏,希望更快推出产品、减少对春秋季传统发布周期的依赖,硬件工程部门近两周已裁撤多名项目经理含约 6 名高级别主管。
Microsoft Research 推出 Quine,一个包含生物学世界模型和交互式 harness 的 AI 研究系统,可连接科学工具、文献和研究者。与 Broad Institute 合作中,Quine 用一个周末从数千化合物中筛选出候选药物,湿实验验证其能诱导胰腺癌细胞状态最大幅度转变,部分强效化合物具有意想不到的作用机制。
推荐理由:官方介绍了 Quine 的系统构成和在 PDAC 上的湿实验验证结果,读者可以据此了解 AI 驱动生物学研究的实际工作方式。
Deloitte 2026 State of AI in the Enterprise 显示,2025 年员工 AI 使用率上升 5%,预计六个月内至少 40% AI 项目进入生产环境的企业占比将翻倍。
法国电信运营商Orange上线自营电商平台,首批上架8000多款商品,涵盖翻新手机、电脑、电视、智能家居等,目标年底超4万款,翻新手机为重点品类,部分比新机便宜一半。卖家须在欧洲注册,目前已有61个卖家入驻,其中49个尚未出单。
荷兰电商巨头Bol在Retailer API中测试beta版“白点”(white spots)功能,向卖家展示两类机会:有搜索需求但供给不足的商品,以及连续缺货28天以上的在售商品。
SHEIN 公布截至6月30日的上市后首份未经审计中期业绩,上半年净收入 201 亿美元,同比增长 1.0%,活跃客户 2.91 亿,订单量 5.49 亿单,经调整净利润 4.99 亿美元。经营利润同比下降 52.9%,主因中东地缘冲突推高运费与油价,公司自行承担成本。截至6月底现金储备 152 亿美元,公司对下半年持审慎乐观态度。
亚马逊宣布投资超1亿美元,在印第安纳州格林伍德新建机器人制造工厂,计划2028年前投产,将创造300个制造与工程岗位,年均薪资近10万美元,建成后其机器人工厂增至四座。目前亚马逊已部署超100万台机器人,协助完成75%的客户订单,并称可记录工伤率降低40%以上。
蓝海亿观网复盘婴童品牌好孩子从江苏校办厂到多品牌出海的过程,2025年其营收86.592亿港元,其中高端品牌CYBEX收入50.474亿港元,占比近六成。
Microsoft Research Asia – Singapore 成立于 2025 年 7 月 24 日,是 Microsoft 在东南亚的首个研究实验室,一年来在团队规模、伙伴关系和前沿 AI 研究落地方面持续拓展。
印度消费者事务部修订《2020年消费者保护(电商)规则》,自2027年1月1日起生效。新规要求展示优惠前30天内最低价、禁止操纵搜索结果、付费推广须醒目标注,平台须自查“黑暗模式”并公示合规证书,强制加入国家消费者热线,并禁止捆绑收费及未经明确同意使用消费者数据。
Ozon数据显示,俄罗斯消费者今年备冬装明显提前,9月前两周外套需求同比涨1.5倍,其中儿童外套涨1.6倍,女式大衣订单涨1.8倍;配饰涨幅更高,儿童手套近3倍,男式手套和儿童帽子各涨2.1倍。买家本轮先补手套、帽子等低价小件。
GitHub Copilot app 支持用 /create-canvas 技能通过自然语言生成 canvas 扩展,即可自定义的看板、检查清单、仪表盘等界面,无需手写代码。canvas 状态双向同步,用户和 Agent 可同时操作并实时看到彼此的更改;创建后可保存为团队共享或个人扩展,社区还通过 Awesome Copilot 提供现成模板。
聊天仍是与 LLM 交互的主要方式,但在用户已明确任务时往往是错误的 UI。GitHub Copilot app 的 canvas 是运行在应用内、无浏览器界面的全栈小程序,可与 agent 双向通信,能调用第三方 API 并在本地执行代码。文章用 Connect 4 游戏、Winget 包管理、SQLite 操作及自动化开发工作流等示例说明:让 agent 构建工具比反复对话更省 token。
GitHub Security Lab 的 Antonio Morales 发布 Fuzzing Taskflow,一个面向 C/C++ 项目的 LLM agent 自动化 fuzzing 流水线,只需提供 GitHub 仓库即可自动识别入口点、编写 harness、运行 AFL++、读取覆盖率、改进 harness 并分诊 crash、生成漏洞报告。
推荐理由:作者亲述把写 harness、读覆盖率、分诊 crash 交给 LLM agent 的完整设计,包括覆盖率反馈循环、plateau 停止条件和结构感知变异机制。
GitHub Copilot 应用重建了 Pull Request 视图,可流畅打开 2,200 个文件、超百万行变更和 400 多条行内评论的开源 PR。
Microsoft Research 宣布在开源的 Physical AI Toolchain 中新增推理卸载能力,支持用 Kubernetes 在机器人、边缘和云端 GPU 间容器化部署和编排机器人 AI 工作负载。
Microsoft Research 在 Nature 发表逆合成预测框架 RetroChimera,结合基于 Transformer 的 R-SMILES 2 与基于 GNN 的 NeuralLoc 两个互补子模型,通过学习式重排序融合预测。
GitHub Podcast 逐条检验五个 AI 领域的热点观点:AI 生成的代码仍需审查,但可按风险分层分配注意力;Skills 并没有杀死 MCP——MCP 提供标准化工具与数据接入,Skills 以 Markdown 打包团队经验,两者互补。RAG 也没有消亡,好的检索能让模型更接近答案、减少 token 浪费,agent、Skills、MCP 与 RAG 可以在同一工作流中共存。
GitHub 使用 Copilot 应用和 Copilot CLI 将 Copilot agent runtime 从 TypeScript 完全重写为 832,378 行生产 Rust,AI 智能体完成了大部分代码,跨 128 个合并到 main 的 pull request 增量发布,而非一次性切换。
推荐理由:作者亲历复盘了用智能体将 Copilot 运行时整体移植到 Rust 的过程,给出可迁移的增量移植方法与大量一手会话数据。
Microsoft Research 推出 GigaPath-Flash 和 GigaTIME-Flash 研究模型,通过从十亿参数 GigaPath 蒸馏得到的 22M 参数 ViT-S 编码器大幅降低计算成本。
游戏出海企业长期面临开发成本高和用户留存率低两大痛点,AI 大模型正被用于实现智能 NPC 交互和个性化内容生成。这一技术能否真正解决上述核心问题,目前仍是行业关注的焦点,实际效果尚待验证。
Temu 在美国市场引入国内电商大获成功的“砍一刀”玩法,希望借此吸引更多用户、提高活跃度并扩大市场份额。由于美国消费者的文化与国内不同,这一玩法能否适应并生效尚存不确定性。
国产RPG和SLG手游通过融入日本文化元素吸引了大量当地玩家,日本玩家对国产手游的接受度显著提升。文章指出,仅靠文化元素融入不够,出海企业还需在已有成绩基础上进一步做好本地化运营,这也是当前众多出海企业面临的难题。