rowid,title,category,severity,created_on,summary,tags,origin_url 6,微软提出无计量智能战略,推动 AI 在 Windows PC 本地运行 · AIHOT,ai,0,2026-09-06T10:51:00+00:00,微软在IFA 2026上提出“无计量智能”战略,旨在将更多日常AI工作从云端转移至用户的Windows PC本地运行,以改变AI服务的token经济模式。该战略由Windows与设备部门企业副总裁Mark Linton阐述,其核心是利用PC本地性能运行AI模型,减少对订阅付费云端服务的依赖。此举被视为AI行业从“聊天机器人”向“智能体”转变趋势的一部分,但云端AI仍将作为体系的重要补充。,"[""微软"", ""无计量智能"", ""本地AI"", ""Windows"", ""AI战略"", ""IFA 2026""]",[跳转到原文](https://www.ithome.com/0/999/014.htm) 16,GPT 6 Astra 重构的我的博客首页,有点喜欢 - V2EX,ai,0,2026-09-06T08:11:18+00:00,用户 Justin3go 使用 GPT-6 Astra 模型重构了个人博客首页。其方法主要是通过提示词引导AI生成前端代码,并实现了碎片拼接式的过渡动画效果。该案例展示了在明确用户指令(指定风格)下,大模型在前端设计与实现中的应用潜力,但实际设计决策(如具体动画形式)仍由模型自主生成。,"[""GPT-6"", ""前端开发"", ""个人博客"", ""AI编程""]",[跳转到原文](https://justin3go.com) 35,/items/cmtp9jle40avzrobl18f8h7bh,ai,0,2026-09-06T03:29:00+00:00,该报告总结了一项针对GPT-6 Astra模型在建筑领域进行“地狱难度”任务的测试。测试包含5项专业任务,总耗时13小时,消耗2.1亿token,总得分为60/100(及格线)。具体任务表现差异明显,例如行业软件建模复原度为70%,而施工图完成度仅为40%,表明模型在复杂系统性任务中仍存在局限性。,"[""GPT-6"", ""Astra"", ""基准测试"", ""建筑AI"", ""大模型评估""]",[跳转到原文](https://x.com/ZHO_ZHO_ZHO/status/2096440695146020916) 47,arXiv 论文提出大语言模型作为认知病毒的传播模型 · AIHOT,ai,0,2026-09-05T22:19:00+00:00,论文将大语言模型的采用过程类比为一种“认知病毒”的传播,并使用流行病学模型进行了建模。该研究将用户划分为未耦合、保留认知自主的常规使用和持续依赖三种状态,构建了扩散动力学模型。其特色在于跨学科视角,将流行病学理论引入社会技术系统分析,为评估LLM的社会影响提供了新的量化框架。,"[""大语言模型"", ""认知病毒"", ""流行病学模型"", ""社会影响"", ""跨学科""]",[跳转到原文](https://arxiv.org/abs/2609.03344) 49,OpenAI GPT-6 Astra 登顶 Code Arena WebDev 榜首,领先 Claude Fable 5 · AIHOT,ai,0,2026-09-05T21:31:00+00:00,OpenAI 的 GPT-6 Astra (Max) 模型在 Code Arena: WebDev 排行榜上以 1797 分登顶,领先第二名 Claude Fable 5.1 (Max) 35 分。该模型在 $40/Mtoken 的定价区间内重塑了性能与成本的帕累托前沿,成为该价位上性能最强的模型。值得注意的是,该模型的具体优势在于其在 Web 开发任务上的性能表现,以及与竞争对手 Claude 系列在相同成本下的直接对比结果。,"[""GPT-6"", ""OpenAI"", ""Benchmark"", ""WebDev"", ""Code Arena""]",[跳转到原文](https://x.com/testingcatalog/status/2096350628054176240) 56,Nous Research 为 Hermes Desktop 增加一键本地模型安装 · AIHOT,ai,0,2026-09-05T19:12:00+00:00,Nous Research 在 Hermes Desktop 中新增了一键安装本地模型的功能。该应用会自动检测用户硬件,并根据 GPU 能力在模型目录中适配检查,自动选择并下载满足最低 4-bit 量化和 64K 上下文窗口要求的最高质量版本,同时配置好 llama.cpp。其特色在于将复杂的本地模型部署流程简化为单一点击操作,降低了非专业用户的使用门槛。,"[""本地模型"", ""桌面应用"", ""模型部署""]",[跳转到原文](https://www.marktechpost.com/2026/09/05/nous-research-hermes-desktop-one-click-local-model-setup) 74,消息称 Kimi、MiniMax 等大模型厂商即将入驻天猫开售 Token 订阅套餐 · AIHOT,ai,0,2026-09-05T12:52:00+00:00,Kimi、MiniMax、阶跃星辰等多家国产大模型厂商正与天猫接洽,计划开设官方旗舰店销售Token订阅套餐。此前,智谱已入驻天猫并上架了基于GLM-5.3模型、适配20余款Agent的GLM Coding Plan套餐。这标志着大模型订阅服务开始从官网等自有渠道,拓展至天猫这类传统电商平台的消费场景,是AI服务商业化渠道的一次重要探索。,"[""大模型"", ""Token订阅"", ""电商"", ""商业化""]",[跳转到原文](https://www.ithome.com/0/998/822.htm) 87,奥尔特曼称自己是苹果超级果粉,对苹果起诉 OpenAI 感到难过 · AIHOT,ai,0,2026-09-05T09:49:00+00:00,OpenAI CEO 萨姆·奥尔特曼公开表达了对苹果公司起诉 OpenAI 的失望情绪,并重申其个人对苹果的长期喜爱。他在采访中表示,苹果的诉讼指控令他难过,并强调 OpenAI 不寻求获取任何公司的知识产权。事件背景源于苹果今年7月提起的诉讼,指控两名前苹果员工在加入 OpenAI 时不当带走了商业机密。,"[""OpenAI"", ""苹果"", ""诉讼"", ""知识产权"", ""奥尔特曼""]",[跳转到原文](https://www.ithome.com/0/998/790.htm) 88,只有我觉得 GPT-6 Astra 好像降智了吗? - V2EX,ai,0,2026-09-05T09:34:00+00:00,用户反馈 OpenAI 的 GPT-6 Astra 模型在 CSS 相关任务上表现可能不及前代 GPT-5.6 Sol。用户报告称,一些 GPT-5.6 Sol 能解决的问题,Astra 却未能解决,最终需自行查找 Google 解决。讨论中提及官方 App Store 版本,并指出使用 browser use 功能可能提升 GPT-5.6 Sol 的表现。,"[""OpenAI"", ""GPT-6"", ""Astra"", ""GPT-5.6 Sol"", ""模型性能"", ""CSS""]",[跳转到原文](https://www.v2ex.com/t/1239705) 92,Greg Brockman 转发 9 个 GPT 6 Astra 实用提示词 · AIHOT,ai,0,2026-09-05T08:52:00+00:00,Greg Brockman转发了Greg Isenberg整理的9个GPT 6 Astra实用提示词,旨在为个人和工作生活提供AI助手支持。这些提示词覆盖了账单谈判、将服务商业务转化为AI软件、监控二手市场低价商品、生成公司周度仪表盘、审计智能体机会、浏览器操作生成SOP、夜间自动化QA截图、订阅竞品月报以及构建带获客入口的小游戏等具体场景。其特色在于将通用大模型Astra定位为高度自动化、可执行复杂多步骤任务的实用工具,展示了当前AI应用在流程自动化和商业辅助方面的潜力。,"[""GPT-6"", ""Astra"", ""提示词"", ""AI应用"", ""自动化"", ""生产力工具""]",[跳转到原文](https://x.com/gdb/status/2096159589771485299) 96,余凯:地平线明年的目标是在中国高阶自动驾驶芯片市场超过英伟达 · AIHOT,ai,0,2026-09-05T08:27:00+00:00,地平线创始人余凯在2026亚布力论坛宣布,公司2024年中国智能辅助驾驶芯片市场份额第一,并计划在2025年推出560TOPS大算力芯片,目前已在高阶自动驾驶芯片市场位居第二、仅次于英伟达,明年目标是超越英伟达。截至9月3日,其征程芯片累计出货1500万颗,赋能800万车主,合作品牌超40家,覆盖中国前十大车企。该动态反映了国产大算力芯片在自动驾驶领域的市场份额与技术追赶态势。,"[""自动驾驶"", ""芯片"", ""地平线"", ""英伟达"", ""市场份额""]",[跳转到原文](https://www.ithome.com/0/998/775.htm) 99,费马大定理的 Lean 4 机器检查完整证明开源发布 · AIHOT,ai,0,2026-09-05T07:56:00+00:00,"Anthropic发布了费马大定理在Lean 4.33.1和Mathlib v4.33.0上的完整机器检查证明,并以Apache 2.0协议开源。该证明遵循Frey、Serre、Ribet、Wiles和Taylor-Wiles的经典论证路线,构建包含60,475个模块,并通过Lean内核逐声明检查,最终验证定理仅依赖于Lean的三个标准公理。这是一个研究性工件,提供了完整的验证链路和可离线浏览的HTML版本,允许读者独立复现。","[""formal-verification"", ""lean4"", ""mathlib"", ""theorem-proving"", ""open-source"", ""fermat-last-theorem""]",[跳转到原文](https://github.com/anthropics/fermats-last-theorem) 100,搞了个开源大模型 API 中转站,官方价 3.5 折,送 25 份 5 刀额度 - V2EX,ai,0,2026-09-05T07:55:54+00:00,用户 TokenUs 在 V2EX 分享了其运营的开源大模型 API 中转站 TokenUs。该服务基于 new-api 搭建,提供包括 DeepSeek V4 全系、GLM 5.x 等在内的 15 个开源模型 API,接口与 OpenAI 兼容,定价为官方价格的 3.5 折。其特点在于通过极低的定价(例如 DeepSeek V4 Flash 输入价 $0.049/1M tokens)和注册赠送额度,为开发者提供了低成本测试和使用多个主流开源大模型 API 的途径。,"[""大模型"", ""API"", ""开源"", ""中转站"", ""V2EX""]",[跳转到原文](https://www.v2ex.com/t/1239673) 103,OpenAI 员工称内部工具 Astra 使部分计划提前六个月 · AIHOT,ai,0,2026-09-05T07:38:00+00:00,OpenAI员工透露其内部工具Astra在公开发布前是公司最大的竞争优势。使用Astra后,公司生产力大幅提升,部分产品开发计划提前了六个月(从明年年中提前到DevDay)。该案例表明前沿实验室自用模型能显著加速其自身研发节奏与产品发布预期。,"[""OpenAI"", ""Astra"", ""生产力"", ""AI工具""]",[跳转到原文](https://x.com/kimmonismus/status/2096140916851380552) 108,Codex 用重置卡怎么把我重置时间也给重置了 - V2EX,ai,0,2026-09-05T07:14:07+00:00,用户报告在使用Codex的“重置卡”后,发现其额度的“下次重置时间”也被重置了。关键数据是,重置时间会从使用卡后的首次请求开始重新计算(例如5小时或7天),而非从卡片使用时刻起算。值得注意的特色是,多位社区成员指出这是该服务一直以来的机制,可能存在用户记忆偏差,类似于“曼德拉效应”。,"[""Codex"", ""OpenAI"", ""额度管理"", ""用户反馈""]",[跳转到原文](https://www.v2ex.com/t/1239665) 109,GPT-6 Astra Ultra 消耗有点大 - V2EX,ai,0,2026-09-05T07:14:00+00:00,用户测试了GPT-6 Astra Ultra处理在线Google表格数据预测任务,生成了百多行预测数据,数据质量尚可。关键发现是Ultra级别的token消耗极高,运行十分钟即消耗了Plus用户约15%的周额度,按此速率一小时可耗尽周额度。该实例表明高端AI模型在处理复杂数据任务时,其成本效率与用户预期存在显著落差。,"[""GPT-6"", ""Astra"", ""token消耗"", ""额度"", ""数据预测"", ""Google Spreadsheet""]",[跳转到原文](https://www.v2ex.com/t/1239618) 116,Grok 支持为每个 Bot 设置自定义头像 · AIHOT,ai,0,2026-09-05T06:40:00+00:00,用户DogeDesigner在X平台发文,提醒用户可为每个Grok Bot设置自定义头像,具体操作是点击Bot后选择并上传相册中的图片。该功能允许用户个性化不同的Grok Bot,作者展示了为营销、内容、设计等不同用途Bot设置的狗狗头像。这属于产品功能的用户引导与个性化展示,不涉及技术突破。,"[""Grok"", ""AI Bot"", ""个性化"", ""X平台""]",[跳转到原文](https://x.com/cb_doge/status/2096126182228214053) 117,Artificial Analysis 发布 Intelligence Index v4.2:新增 AA-Briefca · AIHOT,ai,0,2026-09-05T06:37:00+00:00,"Artificial Analysis发布了Intelligence Index v4.2中期更新。该更新新增了两个评测:AA-Briefcase(私有测试集,评估智能体知识工作能力)和Surge AI的GDP.pdf(跨100份PDF、共4,592页的长文档推理,按1,275条专家标准评分)。同时,为防止评测刷分,移除了已饱和的GPQA Diamond基准,并加大了保留测试集的权重,使评估更贴近复杂现实任务。","[""Intelligence Index"", ""benchmark"", ""AI evaluation"", ""long context"", ""agentic AI""]",[跳转到原文](https://artificialanalysis.ai/articles/artificial-analysis-intelligence-index-v4-2) 118,Claude 是不是又重置了? - V2EX,ai,0,2026-09-05T06:30:03+00:00,该讨论涉及用户对Claude(Anthropic旗下AI模型)服务额度重置时间的观察与反馈。核心发现是部分用户(主要是MAX订阅者)的用量额度被重置,而Pro用户则未经历重置,且系统为部分用户发放了“重置卡”。讨论内容反映了AI服务提供商在用户额度管理策略上的不一致性,以及用户对服务条款稳定性的关注。,"[""Claude"", ""AI服务"", ""用户反馈"", ""额度管理""]",[跳转到原文](https://www.v2ex.com/t/1239616) 125,GPT‑6 Astra 超强 computer use 的正确打开方式 😂 · AIHOT,ai,0,2026-09-05T05:26:00+00:00,该情报是一段关于 GPT-6 Astra 模型 computer use 能力的社交媒体分享片段。内容提及模型在计算机操作方面的“超强”能力,但正文未提供具体任务描述、性能数据、评测基准或方法细节。其特色在于以一种轻松幽默的方式(如表情符号和标题语气)引出话题,但实质信息匮乏,属于社区讨论而非技术报告。,"[""GPT-6"", ""Astra"", ""computer_use"", ""社交媒体""]",[跳转到原文](https://x.com/dongxi_nlp/status/2096107747116818834) 128,乌兰察布:中国判断 AI 真正瓶颈是电网而非芯片,靠离网微电网加速数据中心扩张 · AIHOT,ai,0,2026-09-05T05:14:00+00:00,文章分析内蒙古乌兰察布成为增长最快的AI算力集群之一的原因,核心结论是中国将电力而非芯片视为AI竞赛的关键约束。关键设施“星河”数据中心占地相当于20个足球场,设计可容纳百万级AI加速器,理论算力达1亿PFLOPS;截至2026年6月,该市已签约89个数据中心项目,总投资超5000亿元人民币。值得注意的是,当地通过将发电设施整合为数据中心一部分的离网微电网模式来加速扩张,而非单纯依赖外部电网排队。,"[""AI基础设施"", ""数据中心"", ""能源"", ""乌兰察布"", ""算力""]",[跳转到原文](https://aihot.virxact.com/items/cmtnxxyi90fpnroqs6cd220yt) 133,swyx 制作 Astra/Fable 前沿模型 AEO 报告,Claude 频繁推荐 Latent Space · AIHOT,ai,0,2026-09-05T04:39:00+00:00,swyx 针对 Astra 和 Fable 两款前沿模型进行了一次大规模的 AEO 报告分析。其核心发现是,在询问“最佳 AI 新闻简报/播客”时,Claude 模型频繁推荐 Latent Space 播客。这一结果起初让作者感到惊讶,以至于另一位用户 ricmac 建议他检查是否存在记忆泄漏,这提示了该结果的异常性。,"[""AEO"", ""AI模型评估"", ""Claude"", ""Latent Space"", ""前沿模型""]",[跳转到原文](https://x.com/swyx/status/2096095862732755342) 139,Dex Horthy 调侃 SlopCodeBench 更新:Astra 加入评测 · AIHOT,ai,0,2026-09-05T04:08:00+00:00,用户 Dex Horthy 在社交平台 X 上调侃并转发了 SlopCodeBench 基准测试的更新,指出名为 Astra 的模型已加入该评测。该动态以“这才是真正的 slop”为标题,但未提供任何关于模型性能、测试方法或具体结果的详细信息。这是一个简单的社交媒体动态转发,未披露实质性的技术细节或评测数据。,"[""Astra"", ""SlopCodeBench"", ""基准测试"", ""社交媒体动态""]",[跳转到原文](https://x.com/dexhorthy/status/2096088073558016300) 142,FT:Anthropic 接近指定 Morgan Stanley 和 Goldman Sachs 担任 2 万亿美元 I · AIHOT,ai,0,2026-09-05T03:57:00+00:00,据报道,Anthropic 正接近指定摩根士丹利和高盛在潜在的 2 万亿美元 IPO 中担任主要承销角色。该公司 7 月销售额隐含年化水平达 650 亿美元,较 5 月的 470 亿美元显著增长;2 万亿美元估值将超过其此前 9000 亿美元以上的估值,并超过 SpaceX 1.78 万亿美元的上市估值。值得注意的是,摩根士丹利和高盛曾在 SpaceX 6 月的 IPO 中担任关键角色。,"[""Anthropic"", ""IPO"", ""摩根士丹利"", ""高盛"", ""估值"", ""融资""]",[跳转到原文](https://aihot.virxact.com/items/cmtnv794a0db7roqsredz0vgg) 145,Gemini 推出 Daily Brief 每日简报功能 · AIHOT,ai,0,2026-09-05T03:47:00+00:00,Google Gemini 推出了名为“Daily Brief”的每日简报功能,可自动整理用户当天日程与待办事项生成清单。该功能整合了 Google Calendar、Tasks、Drive 和 Gmail 等全家桶应用,旨在帮助用户提前规划一天。对于深度使用谷歌生态的用户,其跨应用信息整合能力是一个实用亮点。,"[""Google Gemini"", ""Daily Brief"", ""效率工具"", ""Google Workspace""]",[跳转到原文](https://x.com/frxiaobei/status/2096082770187739485) 146,ZHO 感叹 GPT-6 Astra 用 Rhino/Grasshopper 建模 · AIHOT,ai,0,2026-09-05T03:45:00+00:00,用户ZHO观察到GPT-6 Astra已具备使用Rhino/Grasshopper进行参数化建模的能力。他转发了此前发起的测试任务,这些任务要求AI完成BIM级建筑重建、3分钟建筑微电影、初步设计施工图、竞赛图纸及2分钟悬疑短片等复杂工作流。该案例展示了大型语言模型在专业工程设计软件操作与复杂任务规划上的潜在进展,引发了设计从业者对其专业技能价值被冲击的感叹。,"[""GPT-6"", ""Astra"", ""Rhino"", ""Grasshopper"", ""建筑设计"", ""参数化建模"", ""AI能力""]",[跳转到原文](https://x.com/ZHO_ZHO_ZHO/status/2096082364833407102) 147,Perplexity Pro 和 Max 订阅用户可在 Computer mode 使用 Fable 与 GPT-6 A · AIHOT,ai,0,2026-09-05T03:41:00+00:00,Perplexity 为其 Pro 和 Max 订阅用户在 Computer mode 中同时集成了 Fable 和 Astra 模型。此举表明平台正在整合更先进的模型(如提及的 GPT-6 Astra)以增强其 AI 助手功能,并可能指向更复杂的任务执行能力。其特色在于将多个模型(如 Fable 与 Astra)的协同能力提供给付费用户,作为产品功能演进的信号。,"[""Perplexity"", ""GPT-6"", ""AI产品"", ""订阅服务"", ""计算机模式""]",[跳转到原文](https://x.com/AravSrinivas/status/2096081180043125186) 150,Jason Liu 尝试让 Astra 游玩 RimWorld · AIHOT,ai,0,2026-09-05T03:17:00+00:00,Jason Liu在X平台发文称,他正在尝试让AI模型Astra游玩《RimWorld》游戏。推文仅陈述了这一目标,未提供任何关于具体实现方法、进展细节或测试结果的信息。该尝试属于将AI应用于复杂交互环境的初步探索,但目前公开信息极为有限。,"[""AI"", ""游戏"", ""RimWorld"", ""Astra""]",[跳转到原文](https://x.com/jxnlco/status/2096075261145907337) 152,Ethan Mollick 评 Artificial Analysis Intelligence Index v4.2: · AIHOT,ai,0,2026-09-05T03:08:00+00:00,Ethan Mollick 评论了 Artificial Analysis Intelligence Index v4.2 的发布。他认为该指数在更新评判标准时,不应大幅改变现有模型的排名与评估结果,并指出 Artificial Analysis 自研 AA-Briefcase 基准时,应已移除其认为仍然糟糕的 GDPval-AA 评测。其核心观点是强调模型评估基准的连续性与稳定性。,"[""AI benchmark"", ""model evaluation"", ""criticism""]",[跳转到原文](https://x.com/emollick/status/2096072875622985977) 156,马斯克旗下 SpaceXAI 将 Grok Bot 拓展至 iPad 和安卓平台 · AIHOT,ai,0,2026-09-05T02:35:00+00:00,SpaceXAI 将其 Grok Bot 智能体平台从 Mac 扩展至 iPad 和安卓系统。该平台于 8 月推出,核心功能是支持 AI 智能体全天候组队协作,能登录不同应用和网站,并在不同机器人间共享任务上下文。目前 Grok Bot 已实现对 Mac、iPhone、iPad 和安卓四个终端的覆盖,展示了其跨平台部署的进展。,"[""SpaceXAI"", ""Grok Bot"", ""AI智能体"", ""跨平台""]",[跳转到原文](https://www.ithome.com/0/988/570.htm)