微软在IFA 2026上提出“无计量智能”战略,旨在将更多日常AI工作从云端转移至用户的Windows PC本地运行,以改变AI服务的token经济模式。该战略由Windows与设备部门企业副总裁Mark Linton阐述,其核心是利用PC本地性能运行AI模型,减少对订阅付费云端服务的依赖。此举被视为AI行业从“聊天机器人”向“智能体”转变趋势的一部分,但云端AI仍将作为体系的重要补充。
feed
Data source: 本地采集管线定期导出的快照
244 rows where category = "ai" and severity = 0
This data as json, CSV (advanced)
Suggested facets: created_on (date), tags (array)
用户 Justin3go 使用 GPT-6 Astra 模型重构了个人博客首页。其方法主要是通过提示词引导AI生成前端代码,并实现了碎片拼接式的过渡动画效果。该案例展示了在明确用户指令(指定风格)下,大模型在前端设计与实现中的应用潜力,但实际设计决策(如具体动画形式)仍由模型自主生成。
该报告总结了一项针对GPT-6 Astra模型在建筑领域进行“地狱难度”任务的测试。测试包含5项专业任务,总耗时13小时,消耗2.1亿token,总得分为60/100(及格线)。具体任务表现差异明显,例如行业软件建模复原度为70%,而施工图完成度仅为40%,表明模型在复杂系统性任务中仍存在局限性。
论文将大语言模型的采用过程类比为一种“认知病毒”的传播,并使用流行病学模型进行了建模。该研究将用户划分为未耦合、保留认知自主的常规使用和持续依赖三种状态,构建了扩散动力学模型。其特色在于跨学科视角,将流行病学理论引入社会技术系统分析,为评估LLM的社会影响提供了新的量化框架。
OpenAI 的 GPT-6 Astra (Max) 模型在 Code Arena: WebDev 排行榜上以 1797 分登顶,领先第二名 Claude Fable 5.1 (Max) 35 分。该模型在 $40/Mtoken 的定价区间内重塑了性能与成本的帕累托前沿,成为该价位上性能最强的模型。值得注意的是,该模型的具体优势在于其在 Web 开发任务上的性能表现,以及与竞争对手 Claude 系列在相同成本下的直接对比结果。
Nous Research 在 Hermes Desktop 中新增了一键安装本地模型的功能。该应用会自动检测用户硬件,并根据 GPU 能力在模型目录中适配检查,自动选择并下载满足最低 4-bit 量化和 64K 上下文窗口要求的最高质量版本,同时配置好 llama.cpp。其特色在于将复杂的本地模型部署流程简化为单一点击操作,降低了非专业用户的使用门槛。
Kimi、MiniMax、阶跃星辰等多家国产大模型厂商正与天猫接洽,计划开设官方旗舰店销售Token订阅套餐。此前,智谱已入驻天猫并上架了基于GLM-5.3模型、适配20余款Agent的GLM Coding Plan套餐。这标志着大模型订阅服务开始从官网等自有渠道,拓展至天猫这类传统电商平台的消费场景,是AI服务商业化渠道的一次重要探索。
OpenAI CEO 萨姆·奥尔特曼公开表达了对苹果公司起诉 OpenAI 的失望情绪,并重申其个人对苹果的长期喜爱。他在采访中表示,苹果的诉讼指控令他难过,并强调 OpenAI 不寻求获取任何公司的知识产权。事件背景源于苹果今年7月提起的诉讼,指控两名前苹果员工在加入 OpenAI 时不当带走了商业机密。
用户反馈 OpenAI 的 GPT-6 Astra 模型在 CSS 相关任务上表现可能不及前代 GPT-5.6 Sol。用户报告称,一些 GPT-5.6 Sol 能解决的问题,Astra 却未能解决,最终需自行查找 Google 解决。讨论中提及官方 App Store 版本,并指出使用 browser use 功能可能提升 GPT-5.6 Sol 的表现。
Greg Brockman转发了Greg Isenberg整理的9个GPT 6 Astra实用提示词,旨在为个人和工作生活提供AI助手支持。这些提示词覆盖了账单谈判、将服务商业务转化为AI软件、监控二手市场低价商品、生成公司周度仪表盘、审计智能体机会、浏览器操作生成SOP、夜间自动化QA截图、订阅竞品月报以及构建带获客入口的小游戏等具体场景。其特色在于将通用大模型Astra定位为高度自动化、可执行复杂多步骤任务的实用工具,展示了当前AI应用在流程自动化和商业辅助方面的潜力。
地平线创始人余凯在2026亚布力论坛宣布,公司2024年中国智能辅助驾驶芯片市场份额第一,并计划在2025年推出560TOPS大算力芯片,目前已在高阶自动驾驶芯片市场位居第二、仅次于英伟达,明年目标是超越英伟达。截至9月3日,其征程芯片累计出货1500万颗,赋能800万车主,合作品牌超40家,覆盖中国前十大车企。该动态反映了国产大算力芯片在自动驾驶领域的市场份额与技术追赶态势。
Anthropic发布了费马大定理在Lean 4.33.1和Mathlib v4.33.0上的完整机器检查证明,并以Apache 2.0协议开源。该证明遵循Frey、Serre、Ribet、Wiles和Taylor-Wiles的经典论证路线,构建包含60,475个模块,并通过Lean内核逐声明检查,最终验证定理仅依赖于Lean的三个标准公理。这是一个研究性工件,提供了完整的验证链路和可离线浏览的HTML版本,允许读者独立复现。
用户 TokenUs 在 V2EX 分享了其运营的开源大模型 API 中转站 TokenUs。该服务基于 new-api 搭建,提供包括 DeepSeek V4 全系、GLM 5.x 等在内的 15 个开源模型 API,接口与 OpenAI 兼容,定价为官方价格的 3.5 折。其特点在于通过极低的定价(例如 DeepSeek V4 Flash 输入价 $0.049/1M tokens)和注册赠送额度,为开发者提供了低成本测试和使用多个主流开源大模型 API 的途径。
OpenAI员工透露其内部工具Astra在公开发布前是公司最大的竞争优势。使用Astra后,公司生产力大幅提升,部分产品开发计划提前了六个月(从明年年中提前到DevDay)。该案例表明前沿实验室自用模型能显著加速其自身研发节奏与产品发布预期。
用户报告在使用Codex的“重置卡”后,发现其额度的“下次重置时间”也被重置了。关键数据是,重置时间会从使用卡后的首次请求开始重新计算(例如5小时或7天),而非从卡片使用时刻起算。值得注意的特色是,多位社区成员指出这是该服务一直以来的机制,可能存在用户记忆偏差,类似于“曼德拉效应”。
用户测试了GPT-6 Astra Ultra处理在线Google表格数据预测任务,生成了百多行预测数据,数据质量尚可。关键发现是Ultra级别的token消耗极高,运行十分钟即消耗了Plus用户约15%的周额度,按此速率一小时可耗尽周额度。该实例表明高端AI模型在处理复杂数据任务时,其成本效率与用户预期存在显著落差。
用户DogeDesigner在X平台发文,提醒用户可为每个Grok Bot设置自定义头像,具体操作是点击Bot后选择并上传相册中的图片。该功能允许用户个性化不同的Grok Bot,作者展示了为营销、内容、设计等不同用途Bot设置的狗狗头像。这属于产品功能的用户引导与个性化展示,不涉及技术突破。
Artificial Analysis发布了Intelligence Index v4.2中期更新。该更新新增了两个评测:AA-Briefcase(私有测试集,评估智能体知识工作能力)和Surge AI的GDP.pdf(跨100份PDF、共4,592页的长文档推理,按1,275条专家标准评分)。同时,为防止评测刷分,移除了已饱和的GPQA Diamond基准,并加大了保留测试集的权重,使评估更贴近复杂现实任务。
该讨论涉及用户对Claude(Anthropic旗下AI模型)服务额度重置时间的观察与反馈。核心发现是部分用户(主要是MAX订阅者)的用量额度被重置,而Pro用户则未经历重置,且系统为部分用户发放了“重置卡”。讨论内容反映了AI服务提供商在用户额度管理策略上的不一致性,以及用户对服务条款稳定性的关注。
该情报是一段关于 GPT-6 Astra 模型 computer use 能力的社交媒体分享片段。内容提及模型在计算机操作方面的“超强”能力,但正文未提供具体任务描述、性能数据、评测基准或方法细节。其特色在于以一种轻松幽默的方式(如表情符号和标题语气)引出话题,但实质信息匮乏,属于社区讨论而非技术报告。
文章分析内蒙古乌兰察布成为增长最快的AI算力集群之一的原因,核心结论是中国将电力而非芯片视为AI竞赛的关键约束。关键设施“星河”数据中心占地相当于20个足球场,设计可容纳百万级AI加速器,理论算力达1亿PFLOPS;截至2026年6月,该市已签约89个数据中心项目,总投资超5000亿元人民币。值得注意的是,当地通过将发电设施整合为数据中心一部分的离网微电网模式来加速扩张,而非单纯依赖外部电网排队。
swyx 针对 Astra 和 Fable 两款前沿模型进行了一次大规模的 AEO 报告分析。其核心发现是,在询问“最佳 AI 新闻简报/播客”时,Claude 模型频繁推荐 Latent Space 播客。这一结果起初让作者感到惊讶,以至于另一位用户 ricmac 建议他检查是否存在记忆泄漏,这提示了该结果的异常性。
用户 Dex Horthy 在社交平台 X 上调侃并转发了 SlopCodeBench 基准测试的更新,指出名为 Astra 的模型已加入该评测。该动态以“这才是真正的 slop”为标题,但未提供任何关于模型性能、测试方法或具体结果的详细信息。这是一个简单的社交媒体动态转发,未披露实质性的技术细节或评测数据。
据报道,Anthropic 正接近指定摩根士丹利和高盛在潜在的 2 万亿美元 IPO 中担任主要承销角色。该公司 7 月销售额隐含年化水平达 650 亿美元,较 5 月的 470 亿美元显著增长;2 万亿美元估值将超过其此前 9000 亿美元以上的估值,并超过 SpaceX 1.78 万亿美元的上市估值。值得注意的是,摩根士丹利和高盛曾在 SpaceX 6 月的 IPO 中担任关键角色。
Google Gemini 推出了名为“Daily Brief”的每日简报功能,可自动整理用户当天日程与待办事项生成清单。该功能整合了 Google Calendar、Tasks、Drive 和 Gmail 等全家桶应用,旨在帮助用户提前规划一天。对于深度使用谷歌生态的用户,其跨应用信息整合能力是一个实用亮点。
用户ZHO观察到GPT-6 Astra已具备使用Rhino/Grasshopper进行参数化建模的能力。他转发了此前发起的测试任务,这些任务要求AI完成BIM级建筑重建、3分钟建筑微电影、初步设计施工图、竞赛图纸及2分钟悬疑短片等复杂工作流。该案例展示了大型语言模型在专业工程设计软件操作与复杂任务规划上的潜在进展,引发了设计从业者对其专业技能价值被冲击的感叹。
Perplexity 为其 Pro 和 Max 订阅用户在 Computer mode 中同时集成了 Fable 和 Astra 模型。此举表明平台正在整合更先进的模型(如提及的 GPT-6 Astra)以增强其 AI 助手功能,并可能指向更复杂的任务执行能力。其特色在于将多个模型(如 Fable 与 Astra)的协同能力提供给付费用户,作为产品功能演进的信号。
Jason Liu在X平台发文称,他正在尝试让AI模型Astra游玩《RimWorld》游戏。推文仅陈述了这一目标,未提供任何关于具体实现方法、进展细节或测试结果的信息。该尝试属于将AI应用于复杂交互环境的初步探索,但目前公开信息极为有限。
Ethan Mollick 评论了 Artificial Analysis Intelligence Index v4.2 的发布。他认为该指数在更新评判标准时,不应大幅改变现有模型的排名与评估结果,并指出 Artificial Analysis 自研 AA-Briefcase 基准时,应已移除其认为仍然糟糕的 GDPval-AA 评测。其核心观点是强调模型评估基准的连续性与稳定性。
SpaceXAI 将其 Grok Bot 智能体平台从 Mac 扩展至 iPad 和安卓系统。该平台于 8 月推出,核心功能是支持 AI 智能体全天候组队协作,能登录不同应用和网站,并在不同机器人间共享任务上下文。目前 Grok Bot 已实现对 Mac、iPhone、iPad 和安卓四个终端的覆盖,展示了其跨平台部署的进展。
Advanced export
JSON shape: default, array, newline-delimited
CREATE TABLE feed( title TEXT, category TEXT, severity INT, created_on TEXT, summary TEXT, tags TEXT, origin_url ); CREATE INDEX idx_feed_created_on ON feed(created_on);