码厩开发者笔记

coding in a complicated world

AI

关注 · Tag · 14 条

北京协和医院医生借助GPT-5.6破解数学界Crouzeix猜想

2026年7月30日,北京协和医院神经外科住院医师金山木发布预印本,宣布借助GPT-5.6证明了困扰数学界22年的Crouzeix猜想。消息称,猜想提出者Michel Crouzeix及多位数学家逐行核验后确认其证明逻辑成立,引发学术界关注。

金山木本科就读北京大学地质学专业,后获北京协和医学院医学博士学位。面对这一数学难题,他通过设计多智能体并行探索、交叉审计和持续推演等流程,让GPT-5.6自主运行约16小时,最终形成完整证明。相关提示词、手稿和验证代码已开源。

Crouzeix猜想提出于2004年,是数值线性代数领域的重要问题。若最终得到正式同行评审确认,这一成果不仅意味着22年数学难题可能被攻克,也凸显AI编排能力正在降低专业领域的知识门槛。

目前成果仍处于预印本阶段,最终结论仍需学界进一步验证。

马斯克600亿美元收购AI编程平台Cursor,补齐“模型+算力+入口”最后一块拼图

北京时间8月14日,SpaceX宣布以约600亿美元估值全资收购AI编程工具Cursor母公司Anysphere,交易以SpaceX股票完成,团队整体并入SpaceXAI部门。若交易终止,SpaceX需支付15亿美元现金及85亿美元算力资源作为“分手费”。
诞生仅两年的Cursor凭借“VS Code习惯+AI原生交互”快速突围:从代码补全升级至多智能体并行开发,自研Composer系列模型,日生成代码超1.5亿行,商业结构由80%个人用户反转为80%企业客户,成为目前增长最快的开发者AI入口。
此次收购核心在于“用股权换时间”:SpaceX手握Colossus超算与Grok模型,但缺乏高黏性产品场景;Cursor有海量真实开发数据与用户,却长期受困于算力掣肘。合并后,双方打通“模型训练—产品迭代—行为反馈—再训练”闭环,相当于马斯克直接买下AI编程竞赛的“近道”。
不过隐忧随之浮现。Cursor原以“多模型中立工作台”为核心卖点,接入Claude、GPT、Gemini等主流模型。并入SpaceXAI后,其是否保持开放、还是会逐步向Grok倾斜,将决定开发者用脚投票的走向。
业界认为,AI编程已从单点工具竞争升级为“模型+算力+分发”的生态战争,迭代最快者赢。马斯克花600亿美元,买的是少走几年弯路的权利。

DeepSeek 大幅涨价:部分价格最高上涨至12倍

DeepSeek宣布,随着V4系列正式版上线,API价格将于北京时间8月17日零时起调整,并首次采用峰谷定价机制,闲时价格为高峰时段的一半。

此次涨价幅度较大,按开发者测算,Flash模型常规时段价格约上涨2.5倍,高峰时段约上涨5倍;Pro模型常规时段约上涨6倍,高峰时段最高达到此前价格的12倍。整体来看,部分Agentic Coding场景的实际成本预计上涨数倍。

此次调整将明显削弱DeepSeek长期以来的低价优势,其API价格体系也将从此前的极低成本模式,转向更加接近行业市场化定价。

苹果官网文档上线《在 Mac 上配合 Apple 智能使用千问》一天后撤下

8月8日,苹果官网Mac简体中文使用手册短暂上线《在Mac上配合Apple智能使用千问》文档,首次以官方形式确认Apple智能可调用阿里千问。文档显示,该功能需macOS 26.6及以上,满足中国大陆地区、账户或国行设备条件之一即可在“系统设置-Apple智能与Siri-扩展”中登录千问账户启用,支持写作工具与Siri问答增强。次日该文档被撤下,页面恢复为ChatGPT说明,苹果客服称未收到相关发布通知。

日本前AV女优引退后转行做程序员

日本前AV女优Noa(曾用艺名花吹诗音、菜月光)于2026年7月27日引退后,转行做程序员,8月6日在X平台发新号自我介绍走红,帖文浏览超千万。她原2万粉旧号被事务所收回,靠AI工具Claude自学网页设计与编程,现接Web制作、自动化开发单,自嘲“尽量正经偶尔放飞”。其5月曾用AI练手做“AI类型诊断”小项目。网友调侃“女优抢前端饭碗”“有些行业死得比前端快”,也感慨AI降低技术门槛、带来学习平权。

知乎推出 CLI 与 MCP 接入能力,AI 助手可直接调用站内数据

近日,知乎开放平台上线 Zhihu CLI 及配套 Skill,同时提供托管式 MCP 服务,为 AI 助手接入知乎内容提供新方式。

据介绍,Zhihu CLI 可通过命令行调用知乎搜索、全网搜索、热榜、AI 直答等能力,并支持读取用户自身的创作、关注、收藏数据。配合 Access Secret 后,AI 助手可在本地环境中直接调用相关接口,实现内容分析、写作辅助等功能。

与 CLI 不同,MCP 采用标准化协议接入,无需安装本地组件,AI 客户端配置密钥后即可调用知乎提供的工具服务。目前两者共享同一套后台接口和权限体系,但 CLI 额外支持个人账号数据访问。

安全方面,CLI 通过系统凭证库保存密钥,并提供哈希校验等机制;MCP 则依赖客户端配置管理凭证。业内人士认为,两种方式分别适用于不同场景:CLI 更适合个人创作分析和本地 AI 工作流,MCP 更适合多 Agent 系统和标准化接入。

此次开放被视为知乎探索 AI 时代内容生态的重要一步。

谷歌首席科学家杰夫·迪恩离职创业,AI核心团队迎重大调整

8月6日消息,谷歌宣布人工智能部门进行重大调整,公司首席科学家、Gemini负责人杰夫·迪恩将在任职27年后离开。消息公布后,谷歌母公司Alphabet股价一度下跌超5%。

杰夫·迪恩是谷歌AI领域核心人物,1999年作为谷歌第30名员工加入公司,2011年联合创办Google Brain,并主导开发TPU芯片,为谷歌大模型提供关键算力支持。

离开谷歌后,迪恩将创办AI初创公司Discovery Loop,聚焦利用人工智能自动化科学研究流程。与他同行的还有三名谷歌资深科学家,包括AlphaFold贡献者Vinyals等。Alphabet将向该公司提供云计算资源并参与投资。

迪恩在告别信中表示,27年来见证谷歌从小团队成长为全球科技巨头,能够参与打造众多影响全球用户的产品是巨大荣幸。此次离职被认为将重塑谷歌AI内部权力格局。

OpenAI近日公布下一代模型Astra内部版本的研究成果

OpenAI近日公布下一代模型Astra内部版本的研究成果,称其在数学和理论计算机科学领域取得10项突破,包括高维球堆积、编码理论、群论、量子复杂性等方向。OpenAI表示,这些成果所需推理token成本按API价格估算约2000美元,并已通过Lean形式化验证。

Astra是OpenAI正在研发的下一代模型系列,定位为更强的科学推理模型。公开信息显示,其内部版本具备处理长期开放数学问题、生成证明方案并进行形式化验证的能力。该模型尚未公开发布,被视为继o系列推理模型之后,OpenAI探索“AI辅助科学研究”的重要方向。

DeepSeek V4 Flash登顶全球AI模型调用榜

8月3日,开发者平台OpenCode称,DeepSeek V4 Flash单日调用量达8万亿Token,其中5万亿来自免费试用,3万亿来自付费调用。OpenRouter数据显示,7月27日至8月2日,DeepSeek V4 Flash以7.22万亿Token位居全球模型调用量第一。同期排名前五的AI模型均来自中国厂商,国产大模型持续领跑全球调用市场。

京东外卖推出 AI 智能头盔 首批免费配发全职骑手

2026 年 8 月 3 日,京东外卖发布全新 AI 智能头盔,将于近期投用,首批免费发放给全职骑手,后续逐步覆盖全体骑手。头盔搭载 AI 语音、单王带路、一键 SOS、商户核验四大功能。“单王带路” 整合资深骑手路线经验,每单平均省时 3 分钟;全流程语音操作避免骑手低头看手机,还可语音播报订单备注,同步辅助核查门店卫生,兼顾配送效率、骑行安全与食品安全,完善骑手全链路配套保障。

亚马逊完成500亿美元全额投资 OpenAI发力翻盘迎战Anthropic

当地时间7月31日,亚马逊在10-Q季报披露,已完成对OpenAI总计500亿美元的全额投资,资金全部用于认购OpenAI C轮优先股。投资分多批次落地,一季度投入150亿美元,二季度投入137亿美元,剩余213亿美元于报告期后完成交割。根据协议,该批优先股将在OpenAI完成IPO等流动性事件后转为普通股,且上市后将受合规锁定期及证券法相关约束。
当前AI行业格局生变,OpenAI因市场方向误判陷入用户增长放缓、营收不及投入、投资方心态波动等困境,被聚焦实体经济场景的Anthropic反超。后者凭借Claude Code等工具实现营收与估值双突破,估值逼近万亿美元,计划秋季启动IPO。为夺回主导地位,OpenAI全面调整战略,深耕编程、专业办公场景,迭代GPT 5.6 Sol等新模型,联动亚马逊合作、聘任首席营收官,同时或将上市时间推迟至明年,持续蓄力行业翻盘。

老农轻信AI农药方案 150亩芝麻苗全毁

安徽滁州67岁农户吴大伯因完全依赖AI指导农事,按AI生成的“百亩芝麻飞防除草+除虫全套方案”施药,致150亩芝麻苗次日全部枯萎,损失惨重。该方案推荐除草剂“高效氟吡甲禾灵”“氟磺胺草醚”及杀虫剂“噻虫嗪”“甲维盐”。农技人员指出,氟磺胺草醚系大豆田专用阔叶除草剂,芝麻田严禁全田喷施,否则必致死植株。

吴大伯称使用AI逾一年,渐弃疑虑全盘采信,事发后AI自认氟磺胺草醚为“元凶”。涉事平台客服回应,AI无独立知识库、仅整合网络公开信息,已登记损失待反馈;界面虽有“AI生成可能有误,注意核实”小字提示,吴大伯表示从未留意。事件暴露生成式AI在农业高风险场景的“幻觉”隐患与适老警示缺位。

DeepSeek-V4-Flash 发布

DeepSeek 今天开放 DeepSeek-V4-Flash API 公测,这是 V4 系列首个正式发布版本。
据介绍,DeepSeek-V4-Flash 采用 284B 参数规模,激活参数为13B,支持 1M Token 上下文。该版本整体模型结构与此前预览版保持一致,但经过进一步后训练优化,在智能体(Agent)能力方面取得明显提升,在 9 项核心基准测试中均超过 V4-Pro 预览版。

PS:DeepSeek-V4-Pro 预览版于 2026 年 4 月 24 日发布,总参数规模达到 1.6T(万亿),激活参数 49B,同样支持 1M Token 上下文,重点追求模型性能上限。预计将在 8 月上线正式版。

科技公司大规模采购二手图书用于训练AI模型

据调查媒体404 Media最新报道,多家AI公司正通过中间商大规模收购二手图书,以获取高质量训练数据用于训练AI模型,同时避免引发公众舆论反弹。这一现象揭示了AI行业在数据获取上的新动向——从互联网转向人类传统出版物。
随着AI生成的低质量内容充斥网络,污染数据环境并降低模型学习效果,领先的AI公司开始重新寻找由人类创作的原创内容,尤其是2022年前出版的纸质书籍。这些未被AI污染的作品被视为优质训练数据的“金矿”。
事实上,AI公司利用纸质图书训练模型早有先例。卷入版权诉讼的AI公司Anthropic曾投入数百万美元购买大量纸质图书,提取内容后将其销毁。该公司从Better World Books大量采购,虽法院认定将正版图书用于AI训练属“合理使用”,但因长期保存含700万本盗版图书的数据库,被判赔偿15亿美元。与此同时,出版商联盟已起诉谷歌,指控其未经授权使用数百万本受版权保护的图书训练Gemini模型。
拥有超1.11亿本图书目录的在线数据库ISBNdb已调整业务方向,推出面向AI企业的大规模采购服务,订单规模从一次1000本到100万本不等。二手书商反映,今年4月以来销量飙升,周销量达平时的五倍,且采购几乎无主题、类型或作者偏好,甚至不在意价格。
更令人担忧的是数字化过程中的破坏性操作。Anthropi c“巴拿马计划”负责人证实,公司聘请专业扫描公司对纸质图书进行破坏性扫描——直接拆解书籍送入高速工业扫描仪。由于成本更低,AI公司普遍选择此方式,导致数百万本纸质图书被拆毁。
批评者指出,这种做法引发多重伦理争议:稀有书籍可能永久退出流通;扫描内容进入AI私有数据库后,公众无法访问。这意味着,人类积累的知识资源将以不公开的形式被少数AI公司垄断。正如古代学阀通过控制孤本掌握解释权,现代AI公司正通过控制训练语料、模型权重和安全策略,垄断知识的解释与分配权。当AI成为人类主要的信息来源和知识入口,这种垄断或将深刻影响未来世代的认知方式。