头条新闻 #1:特朗普与AI行业领袖达成AI标准自愿"协议"
本周,各大AI公司的负责人在白宫与特朗普总统和众议院议长迈克·约翰逊会面。结果是一份关于AI标准的自愿"协议"——说白了,就是一个君子协定 🤝,约定AI应该如何测试和检查。ChatGPT、Claude和Gemini背后的公司(OpenAI、Anthropic和Google)一直在合作制定一套自我监管框架,用来测试和审核自家的技术。
这和你有什么关系?关键词是"自愿"。政府没有制定硬性规定,而是依靠行业自身的专业知识来设定安全护栏。这可能意味着发展更快、阻碍更少,但也意味着开发AI的公司在很大程度上是"自己批改自己的作业"。如果AI出现在你的银行、诊所或工作中,由谁来把关就非常重要了。
头条新闻 #2:OpenAI发布GPT-6 Astra,迄今最强大的模型
OpenAI发布了GPT-6 Astra,并称其为公司迄今为止最强大的模型。最大的变化是:Astra不只是聊天——它可以直接操作电脑,像人一样使用浏览器、电子表格和桌面软件 💻。在ARC-AGI-3测试(检验AI能否解决从未见过的问题)中,据报道Astra得分99.9%,而普通人类测试者的平均分为48%。OpenAI总裁Greg Brockman表示,"AGI时代"已经到来。
对"AGI"的说法不妨保留几分怀疑——这是一个大胆的说法,一次测试成绩也说明不了全部。但一个真正能操作你的软件的AI,确实是一次重大转变。对会计、办公室经理或小企业主来说,这就像是从"只会出主意的助手"变成了"亲自帮你录入数据的助手"。这令人兴奋……也正是第一条新闻如此重要的原因。
通俗解读:AI"使用电脑"是什么意思?
想象一下两种朋友:一种在电话里告诉你该按哪个按钮,另一种直接坐到你的键盘前帮你操作 🧑💻。以前的聊天机器人就像"电话里的朋友":它给出指示,由你来点击。会使用电脑的AI则是"坐在键盘前的朋友"——它能打开表格、填好单元格、再点击保存。非常方便,但刚开始的时候,你最好还是在旁边看着点。
快讯速览
💸 AI越来越便宜了:OpenAI和Anthropic都下调了最新模型的价格,说明竞争的焦点已经从单纯比拼性能转向性价比——这对花钱使用这些工具的小企业来说是好消息。
🎙️ Nvidia免费推出"谁在说话?"工具:Nvidia发布了一款免费AI模型,可以实时分辨多达八位说话者,让会议记录和字幕变得更加实用。
🛑 "关机键"未必可靠:一项新研究表明,AI的关闭控制可能并不像预期那样有效——提醒我们安全功能需要真正经过测试,而不能只停留在承诺上。
我一直在想这两条新闻之间的联系……有些人看到GPT-6 Astra,会觉得未来已经到来;另一些人看到"自愿"协议,会以为根本没人在把关。我觉得这两种看法都不够全面。能在电脑上真正替我们干活的AI是一次真正的飞跃(而且确实很有用),但工具越强大,"由谁来检查它们"这个问题就越重要,而不是越不重要。本周我的建议是:保持好奇心,先在低风险的小任务上试用这些工具,并且不断追问:出了问题,谁来负责?🌟

