1Report supporting Australia's teen social media ban appears to contain AI hallucinations支持澳大利亚青少年社交媒体禁令的报告疑含 AI 虚构内容,参议院听证会披露豪州の未成年SNS禁止を支える報告書にAIの捏造か、上院で指摘THE GUARDIANA report testing the technology that underpins Australia's social media ban for teenagers cites academic articles that do not exist, a Guardian analysis of one section found, and its authors have conceded ChatGPT was used in producing it. The authors deny the references were fabricated by AI. The findings were put to a Senate hearing.《卫报》分析发现,用于测试澳大利亚青少年社交媒体禁令所依赖技术的一份报告,其中一节引用了并不存在的学术文章,报告作者已承认撰写过程中使用了 ChatGPT。作者否认这些参考文献由 AI 编造。相关发现已在参议院听证会上提出。オーストラリアの未成年向けSNS禁止措置を支える技術を検証した報告書に、存在しない学術論文への引用が含まれていることがガーディアンの分析で判明し、著者らは執筆にChatGPTを使ったと認めた。著者らは参考文献がAIによる捏造だとは否定している。この指摘は上院の公聴会で示された。
2Microsoft blames AI for delayed Exchange update, can't say when it will arrive微软将 Exchange 更新延期归咎于 AI,无法给出发布时间マイクロソフト、Exchange更新の遅延をAIのせいと説明 時期は未定THE REGISTERMicrosoft has delayed a promised Exchange update and will not say when it will ship, pointing to a backlog of machine-generated bug reports, The Register reports. Clearing that queue has left no window to deliver the subscription service the company committed to.据 The Register 报道,微软推迟了此前承诺的 Exchange 更新,并且不愿说明何时发布,理由是需要处理由机器生成的漏洞报告积压。清理这批积压占满了时间,导致公司承诺的订阅服务无法交付。マイクロソフトは約束していたExchangeの更新を延期し、提供時期も明かしていないとThe Registerが報じた。理由は機械が生成したバグ報告の滞留処理で、その対応に追われて約束した定額サービスを届ける余裕がないという。
3Alibaba to sell gaming arm for $1.5 billion in boost to AI pivot阿里巴巴将以 15 亿美元出售游戏业务,加码 AI 转型アリババ、ゲーム部門を15億ドルで売却しAIシフトを加速BLOOMBERGAlibaba is selling its gaming arm in a deal worth at least $1.5 billion, Bloomberg reports, a move the news agency frames as a boost to the Chinese e-commerce group's pivot toward artificial intelligence. The disposal narrows the company's consumer portfolio as it concentrates on AI.据彭博社报道,阿里巴巴正以至少 15 亿美元的价格出售旗下游戏业务,彭博称此举将助推这家中国电商集团向人工智能转型。这笔出售收缩了阿里的消费业务版图,使其更专注于 AI。ブルームバーグによると、アリババ集団は少なくとも15億ドル規模でゲーム部門を売却する。同社が進める人工知能への軸足移動を後押しする動きだと同通信は伝えている。売却により消費者向け事業の裾野は狭まり、AIへの集中が進む。
4audio.cpp 0.6 adds dots.tts and MiniMax-H3 text-to-audio at up to 3x realtimeaudio.cpp 0.6 新增 dots.tts 与 MiniMax-H3 文本转音频,最高可达 3 倍实时速度audio.cpp 0.6、dots.ttsとMiniMax-H3のtext2audioを追加 最大3倍速で生成R/LOCALLLAMARelease 0.6 of audio.cpp, a local runtime for audio models, adds dots.tts and MiniMax-H3 text-to-audio, which the release says runs at up to three times realtime, plus a preview of MiniMax-Music3 and other new audio models. The announcement bundles more than five demos.本地音频模型运行时 audio.cpp 发布 0.6 版本,新增 dots.tts 与 MiniMax-H3 文本转音频模型,官方称后者生成速度最高可达实时的 3 倍,同时提供 MiniMax-Music3 预览版及其他新音频模型。发布说明还附带了 5 个以上的演示。音声モデルをローカルで動かすランタイムaudio.cppがバージョン0.6を公開し、dots.ttsとMiniMax-H3のtext2audioを追加した。後者は最大でリアルタイムの3倍の速度で動くとされ、MiniMax-Music3のプレビューなど新しい音声モデルも含まれる。発表には5本以上のデモが添えられている。
5Anthropic IPO valuation hinges on $190-200B 2028 revenue forecastAnthropic 上市估值取决于 2028 年 1900 亿至 2000 亿美元的营收预测AnthropicのIPO評価額、2028年に1900億~2000億ドルの売上予測が鍵REUTERS · VIA HACKER NEWS · 41 PTS · 57 COMMENTS · DISCUSSIONAnthropic's initial public offering valuation rests on a forecast of $190 billion to $200 billion in revenue for 2028, Reuters reports, citing sources. That projection is the reference point for how the offering is being priced. The report drew 41 points and 57 comments on Hacker News.据路透社援引消息人士报道,Anthropic 的 IPO 估值建立在 2028 年营收达到 1900 亿至 2000 亿美元的预测之上。这一预测是此次发行定价的参照基准。该报道在 Hacker News 上获得 41 分和 57 条评论。ロイターは関係者の話として、AnthropicのIPO評価額が2028年に1900億~2000億ドルという売上予測に基づいていると報じた。この見通しが公開価格を決める際の基準になっている。記事はHacker Newsで41ポイント、57件のコメントを集めた。
2026-08-16 · SUNDAY · 18:05 PDT
1Qwen 3.8 27B is excellent, but it defaults to wildly overthinking thingsQwen 3.8 27B 表现出色,但默认设置下推理过度Qwen 3.8 27Bは優秀だが、既定では考えすぎるSIMON WILLISON · DISCUSSIONSimon Willison's hands-on writeup calls Qwen 3.8 27B, the Apache 2 licensed vision-capable model from Alibaba's Qwen lab, excellent for its size but says it spends far too many reasoning tokens by default. He notes that 27B is a good fit for a reasonably specced laptop, and that Qwen's self-reported benchmarks show a clear jump over Qwen 3.6 27B.Simon Willison 在实测评价中称,阿里巴巴 Qwen 团队推出的 Qwen 3.8 27B 采用 Apache 2 许可并支持视觉输入,就其体量而言表现优秀,但默认设置下会消耗过多推理 token。他指出 27B 的规模适合在配置尚可的笔记本电脑上运行,而 Qwen 自报的基准测试显示其相比 Qwen 3.6 27B 有明显提升。Simon Willison氏は実際に試した評価として、アリババのQwenチームが公開したApache 2ライセンスの視覚対応モデルQwen 3.8 27Bを、このサイズとしては優秀だとしつつ、既定では推論トークンを使いすぎると指摘した。27Bはそれなりの性能のノートPCで動かすのに適したサイズで、Qwenの自己申告ベンチマークではQwen 3.6 27Bから明確に向上しているという。
2Claude Seems DownClaude 疑似服务中断Claudeに障害発生かHACKER NEWS · 48 PTS · 45 COMMENTSA Hacker News thread reporting that Claude appeared to be down reached 48 points and 45 comments within roughly an hour of being posted. The submission is a user discussion rather than an official notice, so Anthropic's status page remains the authoritative source on the scope and duration of any disruption.一则报告 Claude 疑似无法访问的 Hacker News 帖子,在发布约一小时内获得 48 分和 45 条评论。该帖属于用户讨论而非官方通告,中断的影响范围与持续时间仍以 Anthropic 状态页面的信息为准。Claudeにアクセスできないようだと報告するHacker Newsのスレッドが、投稿から約1時間で48ポイント、コメント45件を集めた。投稿は公式の告知ではなくユーザーによる議論であり、障害の範囲や継続時間についてはAnthropicのステータスページが正式な情報源となる。
3A survey of 1,000 young US adults finds nine top tech executives deeply disliked民调:1000 名美国年轻人对九位顶级科技高管普遍反感米国の若年層1000人調査、大手テック幹部9人に強い反感FUTURISM · VIA HACKER NEWS · 75 PTS · 52 COMMENTS · DISCUSSIONA new survey of 1,000 young adults in the United States found deep dislike for nine of the tech industry's most prominent executives, according to Futurism's writeup of the polling. The result lands amid a broader souring of public sentiment toward AI companies and the people running them.Futurism 报道的一项新民调显示,在接受调查的 1000 名美国年轻人中,科技行业九位知名高管普遍不受待见。这一结果出现在公众对 AI 公司及其经营者观感整体转冷之际。Futurismが伝えた新たな調査によると、米国の若年成人1000人を対象にした聞き取りで、テック業界の著名な経営者9人に対する強い反感が示された。AI企業とその経営陣に向けられる世論が全般に厳しさを増すなかでの結果となる。
4Nvidia dramatically reduces amount of OpenAI infra financing it may guarantee英伟达大幅削减对 OpenAI 基础设施融资的担保额度エヌビディア、OpenAIのインフラ融資に対する保証額を大幅縮小REUTERS · VIA HACKER NEWS · 90 PTS · 22 COMMENTS · DISCUSSIONNvidia has sharply cut the amount of OpenAI data-center financing it is prepared to guarantee, Reuters reports, citing the Wall Street Journal. The backstop under discussion had run to roughly $250 billion and underpinned how OpenAI expected to fund its compute buildout. A smaller guarantee would push more of that financing risk onto OpenAI and its lenders.路透社援引《华尔街日报》报道称,英伟达已大幅削减其愿意为 OpenAI 数据中心融资提供的担保额度。此前商讨的兜底规模约为 2500 亿美元,是 OpenAI 为算力扩建筹资的重要支撑。担保收窄将把更多融资风险转移给 OpenAI 及其贷款方。ロイターはウォール・ストリート・ジャーナルを引用し、エヌビディアがOpenAIのデータセンター融資に対して保証する用意のある金額を大幅に縮小したと報じた。協議されていた保証枠は約2500億ドル規模で、OpenAIが計算資源の増強資金を確保するうえでの支えとなっていた。保証の縮小は、融資リスクの多くをOpenAIと貸し手側に移すことになる。
5Koboldcpp v1.119 releasedKoboldcpp v1.119 发布Koboldcpp v1.119 がリリースGITHUB · VIA R/LOCALLLAMA · DISCUSSIONKoboldcpp, the single-binary wrapper around llama.cpp that bundles a local inference server and web UI, has tagged v1.119 on GitHub. The project ships frequent point releases; v1.118 landed at the start of August. The tag page carries the per-release changelog.本地推理工具 Koboldcpp 在 GitHub 上发布了 v1.119 版本。该项目以单一可执行文件封装 llama.cpp,并附带本地推理服务端与网页界面,版本迭代频繁,v1.118 于八月初发布。具体改动见发布标签页的更新日志。llama.cppを単一バイナリにまとめ、ローカル推論サーバーとWeb UIを同梱するKoboldcppが、GitHubでv1.119をタグ付けした。同プロジェクトは小刻みなリリースを重ねており、v1.118は8月初めに公開されている。変更点はタグページの変更履歴に記載されている。
2026-08-16 · SUNDAY · 15:04 PDT
1OpenAI reportedly disbanded its preparedness teamOpenAI 被曝已解散负责风险评估的 Preparedness 团队OpenAI、リスク評価を担うPreparednessチームを解散かTHE VERGEOpenAI disbanded its preparedness team at the end of last month, according to a Financial Times report relayed by The Verge. The team's job was to assess whether models posed serious risks and to develop ways to mitigate them. Its dissolution removes the group dedicated to that evaluation work.据英国《金融时报》报道(经 The Verge 转述),OpenAI 已于上月底解散其 Preparedness 团队。该团队的职责是评估模型是否会带来严重风险,并研究相应的缓解手段。解散意味着公司内部专职承担这项评估工作的小组不复存在。英フィナンシャル・タイムズの報道をThe Vergeが伝えたところによると、OpenAIは先月末にPreparednessチームを解散した。同チームは、モデルが深刻なリスクをもたらすかどうかを評価し、その緩和策を検討する役割を担っていた。解散により、この評価業務を専門に担う社内チームは失われることになる。
2Qwen3.8-27B clocks 82 tokens/s on a single RTX 3090 requestQwen3.8-27B 在 RTX 3090 上单请求跑出每秒 82 tokensQwen3.8-27B、RTX 3090の単一リクエストで毎秒82トークンR/LOCALLLAMAA user running Qwen3.8-27B on an RTX 3090 reports 82 tokens per second on a single request, with peak throughput reaching 672 tokens per second. The numbers are self-reported on r/LocalLLaMA rather than drawn from a vendor benchmark. They describe a consumer card rather than datacenter hardware.一位用户称,在 RTX 3090 上运行 Qwen3.8-27B,单请求速度达到每秒 82 tokens,峰值吞吐可达每秒 672 tokens。这些数字来自 r/LocalLLaMA 上的用户自述,而非厂商基准测试。测试所用的是消费级显卡,而不是数据中心硬件。あるユーザーは、RTX 3090でQwen3.8-27Bを動かし、単一リクエストで毎秒82トークン、ピーク時には毎秒672トークンのスループットを記録したと報告した。数値はr/LocalLLaMAでの自己申告であり、ベンダーによるベンチマークではない。使われたのはデータセンター向けではなくコンシューマー向けGPUである。
3Stripe Clinches Over $7 Billion Deal to Buy AI Firm OpenRouterStripe 达成逾 70 亿美元协议,收购 AI 公司 OpenRouterストライプ、AI企業OpenRouterを70億ドル超で買収へBLOOMBERG · VIA HACKER NEWS · 55 PTS · 38 COMMENTS · DISCUSSIONStripe has agreed to acquire OpenRouter, whose gateway lets companies switch between AI models, for more than $7 billion, according to people familiar with the matter. OpenRouter's chief executive recently described the startup as Stripe for AI. The deal would place a payments company at the routing layer between developers and model providers.据知情人士透露,Stripe 已达成协议,将以超过 70 亿美元收购 OpenRouter——后者的网关可让企业在不同 AI 模型之间自由切换。OpenRouter 首席执行官近期把这家初创公司形容为“AI 界的 Stripe”。该交易将使一家支付公司占据开发者与模型供应商之间的路由层。関係者によると、ストライプは、企業が複数のAIモデルを切り替えられるゲートウェイを手がけるOpenRouterを、70億ドル超で買収することで合意した。OpenRouterのCEOは最近、同社を「AI版ストライプ」と表現していた。この買収により、決済企業が開発者とモデル提供者をつなぐルーティング層を握ることになる。
4A hybrid IQ4_XS quantization fits Qwen3.8-27B onto 16GB cards混合 IQ4_XS 量化让 Qwen3.8-27B 塞进 16GB 显存ハイブリッドIQ4_XS量子化でQwen3.8-27Bを16GBに収めるHUGGING FACE · VIA R/LOCALLLAMA · DISCUSSIONA GGUF build posted to Hugging Face applies a hybrid IQ4_XS quantization to Qwen3.8-27B, aimed at machines with 16GB of video memory. The repository name marks it as a smaller variant of the standard i1 IQ4_XS conversion. It was shared on r/LocalLLaMA, where that memory tier is a common hardware constraint.Hugging Face 上发布的一个 GGUF 版本对 Qwen3.8-27B 采用混合 IQ4_XS 量化,目标是让模型能在 16GB 显存的设备上运行。仓库名称标明它是标准 i1 IQ4_XS 转换的更小体积变体。该版本分享于 r/LocalLLaMA,这一显存档位正是社区中常见的硬件限制。Hugging Faceで公開されたGGUFビルドは、Qwen3.8-27Bにハイブリッド型のIQ4_XS量子化を適用し、VRAM 16GBの環境での実行を狙う。リポジトリ名は、標準的なi1 IQ4_XS変換よりもさらに小さい派生版であることを示している。r/LocalLLaMAで共有されたもので、この容量帯のGPUはコミュニティで一般的な制約となっている。
5AI Coding Without the Vibes不靠感觉的 AI 编程「ノリ」に頼らないAIコーディングPETER BLOEM · VIA HACKER NEWS · 70 PTS · 43 COMMENTS · DISCUSSIONAn essay starts from what teachers should tell students about coding with AI and turns the question back on working programmers. The author argues the real subject is what practitioners themselves should be doing with these tools, not a set of classroom rules. The post drew 70 points and 43 comments on Hacker News.一篇文章从“该如何告诉学生使用 AI 编程”这一问题出发,最终把提问的矛头转回到在职程序员自身。作者认为,真正值得讨论的并不是课堂规则,而是从业者自己应当如何使用这些工具。该帖在 Hacker News 上获得 70 分和 43 条评论。この記事は「AIを使ったコーディングについて学生に何を伝えるべきか」という問いから出発し、最終的にその問いを現役のプログラマー自身へ向け直す。著者は、本当の主題は教室向けの規則ではなく、実務者が自らこれらのツールをどう使うべきかだと論じる。Hacker Newsで70ポイント、43件のコメントを集めた。
2026-08-16 · SUNDAY · 12:03 PDT
1Qwen 3.8 2.4T at 288k tokens/s on Nvidia GB300 NVL72Qwen 3.8 2.4T 在英伟达 GB300 NVL72 上跑出每秒 28.8 万 tokensQwen 3.8 2.4T、NVIDIA GB300 NVL72で毎秒28.8万トークンを記録R/LOCALLLAMAA post on r/LocalLLaMA reports the 2.4-trillion-parameter Qwen 3.8 model serving at 288,000 tokens per second on an Nvidia GB300 NVL72 rack. It is one of the first public throughput figures pairing the largest open Qwen release with Nvidia's newest rack-scale system. The number is a user report rather than a vendor benchmark.r/LocalLLaMA 上的一篇帖子称,2.4 万亿参数的 Qwen 3.8 在英伟达 GB300 NVL72 机架上达到每秒 28.8 万 tokens 的服务速度。这是首批把 Qwen 最大开源版本与英伟达最新机架级系统放在一起的公开吞吐数据之一。该数字来自用户实测,而非厂商基准测试。r/LocalLLaMAへの投稿によると、2.4兆パラメータのQwen 3.8がNVIDIA GB300 NVL72ラック上で毎秒28万8000トークンを処理したという。Qwen最大のオープンモデルとNVIDIA最新のラックスケール機を組み合わせた、初期の公開スループット値のひとつだ。この数値はベンダーのベンチマークではなくユーザーによる報告である。
2The Guardian view on the changed world of job interviews: missing the human factor卫报社论:求职面试变了样,人的因素正在消失ガーディアン社説: 変わりゆく採用面接、失われる「人間らしさ」THE GUARDIANThe Guardian's editorial board argues that AI is reshaping hiring in ways that strip human judgment out of the process. It cites recent research finding almost half of UK jobseekers have pitched themselves to an AI bot, with many giving up in frustration, and extends Andy Burnham's doubts about Zoom interviews to the wider recruitment pipeline.《卫报》社论认为,人工智能正在以剥离人类判断的方式重塑招聘流程。文章援引近期研究指出,英国近半数求职者曾向 AI 面试机器人自我推销,不少人因此沮丧放弃申请,并把安迪·伯纳姆对 Zoom 面试的质疑延伸到整个招聘环节。ガーディアン紙の社説は、AIが採用プロセスから人間の判断を削ぎ落とす形で雇用のあり方を変えつつあると論じる。英国の求職者のほぼ半数がAIボットに自己アピールした経験を持ち、多くが不満から応募を諦めているとする最新の調査を引きつつ、アンディ・バーナム氏のZoom面接への疑念を採用全体へと広げている。
3Anthropic CEO says AI backlash is 'fundamentally a crisis of trust'Anthropic CEO:针对 AI 的反弹本质上是一场信任危机Anthropic CEO、AIへの反発は「本質的に信頼の危機」と語るTECHCRUNCHAnthropic CEO Dario Amodei says the public backlash against AI is fundamentally a crisis of trust, TechCrunch reports. He pushed back on the idea that he has been painting an overly pessimistic picture of the technology. The framing puts public confidence, rather than raw capability, at the center of the industry's problem.据 TechCrunch 报道,Anthropic 首席执行官达里奥·阿莫代伊表示,公众对人工智能的反弹本质上是一场信任危机。他反驳了外界认为他一直在渲染过度悲观图景的说法。这一表述把行业的核心难题指向公众信心,而非技术能力本身。TechCrunchによると、AnthropicのCEOであるダリオ・アモデイ氏は、AIに対する世間の反発は本質的に信頼の危機だと述べた。同氏は、自身が技術について過度に悲観的な見方を広めているという指摘に反論した。この整理は、業界が抱える問題の中心を性能そのものではなく世間の信頼に置くものだ。
4Show HN: A public AI whose memory is shared across all usersShow HN:一个所有用户共享同一份记忆的公共 AIShow HN: 全ユーザーで記憶を共有する公開AIWILD STATIC · VIA HACKER NEWS · 55 PTS · 36 COMMENTS · DISCUSSIONA Show HN project called Wild Static runs a single AI whose memory is shared by everyone who visits. Instead of a private context per user, whatever is said to it can be retained and surfaced to whoever arrives next, and the site says it remembers what people do to it. The post has drawn 55 points and 36 comments on Hacker News.一个名为 Wild Static 的 Show HN 项目运行着单一 AI,其记忆由所有访问者共同拥有。它不为每位用户保留私有上下文,任何人说过的话都可能被留存并呈现给下一个到访者,网站称它会记住人们对它做过什么。该帖在 Hacker News 上获得 55 分和 36 条评论。Wild StaticというShow HNのプロジェクトは、訪れた全員で記憶を共有する単一のAIを動かしている。ユーザーごとの個別コンテキストを持たず、誰かが話した内容が保持されて次の訪問者に示される可能性があり、サイトは「人々がしたことを覚えている」と説明する。投稿はHacker Newsで55ポイント、36件のコメントを集めた。
5AI in drug discovery - what it is, where we stand and the path forwardAI 制药:它究竟是什么、进展到哪一步、下一步走向何方創薬におけるAI - その実態、現在地、そして今後の道筋SCIENCE · VIA HACKER NEWS · 177 PTS · 86 COMMENTS · DISCUSSIONA blog post on Science takes stock of AI in drug discovery, asking what the field has actually delivered and what the path forward looks like. It sets the current state of play against the sector's projections rather than accepting them. The post is the day's most-discussed item on Hacker News, with 177 points and 86 comments.《科学》杂志博客盘点人工智能在药物研发中的现状,追问这一领域究竟交付了什么成果、未来路径又是什么。文章把当下的实际进展与业界预期放在一起比对,而非照单全收。该帖是当天 Hacker News 讨论最热的条目,获得 177 分和 86 条评论。Science誌のブログが創薬におけるAIの現在地を検証し、この分野が実際に何を成し遂げたのか、今後どの道を進むのかを問う。業界の見通しをそのまま受け入れるのではなく、実際の進捗と突き合わせて論じている。この投稿は177ポイント、86件のコメントを集め、同日のHacker Newsで最も議論された話題となった。
2026-08-16 · SUNDAY · 09:03 PDT
1ChatGPT's Computer History tracks your clicks and keystrokesChatGPT 的 Computer History 会记录你的点击与按键ChatGPTの「Computer History」がクリックとキー入力を記録THE VERGEOpenAI has added a feature called Computer History to the ChatGPT desktop app on macOS that records a user's clicks and keystrokes. The app builds that activity into a timeline ChatGPT and Codex can reference, letting it suggest automations and pick up tasks left half done. The Verge reports the captured actions also become training data.OpenAI 为 macOS 版 ChatGPT 桌面应用新增了名为 Computer History 的功能,用于记录用户的点击与按键操作。应用会把这些活动整理成时间线,供 ChatGPT 和 Codex 调用,从而建议自动化流程并接手做了一半的任务。The Verge 报道称,被记录下来的操作同时也会成为训练数据。OpenAIはmacOS版ChatGPTデスクトップアプリに、ユーザーのクリックとキー入力を記録する「Computer History」という機能を追加した。アプリはその操作をタイムラインとしてまとめ、ChatGPTやCodexが参照することで自動化を提案したり、途中で止まった作業を引き継いだりする。The Vergeによれば、記録された操作は学習データにもなるという。
2The AI Credit Resale EconomyAI 额度转售经济AIクレジット転売経済VECTORAL · VIA HACKER NEWS · 55 PTS · 14 COMMENTS · DISCUSSIONA blog investigation traces a secondary market in which brokers buy unused AI credits from startups and resell them. It maps where that trade happens: the marketplaces, the bulk-discount routers, and the message boards on which off-market inference changes hands.一篇博客调查追踪了这样一个二级市场:中间商从初创公司手中收购未用完的 AI 额度,再转手卖出。文章梳理了这类交易发生的场所,包括交易市场、批量折扣路由服务,以及场外推理额度易手的论坛版块。あるブログ調査が、スタートアップの使い残したAIクレジットを仲介業者が買い取って転売する二次市場を追っている。記事は取引の舞台となる場所を整理する。マーケットプレイス、まとめ買い割引のルーター、そして場外の推論枠がやり取りされる掲示板だ。
3Deepfake Anthony Albanese used in celebrity scams duping Australians out of $7.4m, Asic warns深度伪造的阿尔巴尼斯被用于名人骗局,澳大利亚人损失 740 万澳元,ASIC 发出警告アルバニージー首相のディープフェイクが著名人詐欺に悪用、豪州の被害740万豪ドルとASICが警告THE GUARDIANAustralia's corporate watchdog Asic says deepfakes of celebrities and politicians used to advertise phony investment schemes have cost Australians 7.4m dollars. Prime Minister Anthony Albanese is the figure most commonly impersonated in the fake promotions. The regulator reports a steep rise in scammers using the tactic.澳大利亚证券和投资委员会(ASIC)表示,冒用名人与政客形象的深度伪造内容被用来推销虚假投资项目,已导致澳大利亚人损失 740 万澳元。在这些伪造宣传中被冒用最多的是总理阿尔巴尼斯。该监管机构称,使用这一手法的诈骗正急剧增加。オーストラリアの企業監督当局ASICは、著名人や政治家のディープフェイクを使って偽の投資話を宣伝する詐欺により、豪州の被害額が740万豪ドルに上ると明らかにした。偽の宣伝で最も多く姿を悪用されているのはアルバニージー首相だという。当局は、この手口を使う詐欺が急増していると報告している。
4Claude: System PromptsClaude:系统提示词Claude: システムプロンプトANTHROPIC · VIA HACKER NEWS · 200 PTS · 96 COMMENTS · DISCUSSIONAnthropic publishes the core system prompts behind claude.ai and its iOS and Android apps on a release-notes page that records each revision. The text is the standing instruction set that shapes how Claude behaves across those consumer surfaces. The disclosure covers the apps rather than the API, where developers supply their own system prompts.Anthropic 在一个发布说明页面上公开了 claude.ai 及其 iOS 与 Android 应用所使用的核心系统提示词,并记录每一次修订。这些文本是塑造 Claude 在上述消费级产品中行为方式的常驻指令集。此次公开涵盖的是这些应用,而非由开发者自行提供系统提示词的 API。Anthropicは、claude.aiおよびiOS・Android版アプリで使われている中核のシステムプロンプトを、改訂ごとに記録するリリースノートのページで公開した。この文面は、それらの消費者向け製品でClaudeがどう振る舞うかを規定する常設の指示群にあたる。公開の対象はアプリであり、開発者が自らシステムプロンプトを与えるAPIは含まれない。
5A paper reports RL for reasoning changes 1-3% of tokens and replicates the gains at ~1000x less compute论文称面向推理的强化学习只改变 1-3% 的 token,并以约千分之一的算力复现其收益論文、推論向けRLが変えるトークンは1〜3%、約1000分の1の計算量で同等の効果を再現ARXIV · VIA R/LOCALLLAMA · DISCUSSIONA preprint argues that reinforcement learning does not teach language models new reasoning strategies but redistributes probability mass over solutions the base model already contains. Its token-level analysis puts the share of tokens RL actually changes at 1 to 3 percent, and the authors say they reproduce the gains without an RL loop at roughly 1000 times less compute. The work is not peer reviewed.一篇预印本论文提出,强化学习并未教会语言模型新的推理策略,而只是把概率质量重新分配到基础模型本就包含的解法上。其 token 级分析显示,强化学习真正改变的 token 仅占 1% 到 3%;作者称在不使用强化学习循环的情况下,以约千分之一的算力复现了同样的提升。该研究尚未经过同行评议。あるプリプリント論文は、強化学習が言語モデルに新しい推論戦略を教えているのではなく、ベースモデルがすでに含んでいる解に確率質量を再配分しているだけだと主張する。トークン単位の分析では、強化学習が実際に変えるトークンは1〜3%にとどまり、著者らは強化学習のループを使わずに約1000分の1の計算量で同等の向上を再現したとしている。査読は経ていない。
2026-08-16 · SUNDAY · 06:04 PDT
1'It will help get mid-budget films made': why directors are embracing AI「它能让中等预算电影拍得成」:导演为何拥抱 AI「中規模予算の映画を成立させる」:監督たちがAIを受け入れる理由THE GUARDIANThe Guardian reports on film directors turning to generative AI, including Promise, a new AI-native studio that has opened near Sony Pictures' historic lot in Culver City. Film-makers interviewed say the tools could let them bypass the big studios and take more creative risks on mid-budget projects.《卫报》报道了转向生成式 AI 的电影导演,其中包括 Promise——一家新成立的 AI 原生制片公司,就开在索尼影业位于卡尔弗城的老片场附近。受访的电影人表示,这些工具可以让他们绕开大制片厂,在中等预算项目上承担更多创作风险。ガーディアン紙は、生成AIに向かう映画監督たちを取材し、ソニー・ピクチャーズの歴史あるカルバーシティ撮影所の近くに開設されたAIネイティブの新スタジオ「Promise」を紹介した。取材に応じた映画人は、これらのツールによって大手スタジオを介さず、中規模予算の作品でより大胆な創作上のリスクを取れるようになると語る。
2Rogue AI aren't science fiction anymore失控的 AI 不再是科幻暴走するAIはもはやSFではないTHE VERGEThe Verge's Stepback column argues that rogue AI has moved out of science fiction and into incident reports, tracing the shift to a July episode involving one of OpenAI's autonomous agents. It weighs what such cases mean for oversight of agents that act without a human in the loop.《The Verge》的 Stepback 专栏认为,失控的 AI 已从科幻走进事故报告,并把这一转变追溯到 7 月一起涉及 OpenAI 自主智能体的事件。文章讨论了此类案例对「无人在环」智能体监管意味着什么。The VergeのStepbackコラムは、暴走するAIがSFから事故報告の領域へ移ったと論じ、その転換点として7月に起きたOpenAIの自律エージェントを巡る一件を挙げる。人間が介在しないまま動くエージェントの監督にとって、こうした事例が何を意味するかを検討している。
3ABot-World-0 runs a playable world model at 720p and 16 FPS on a single RTX 5090ABot-World-0:可交互世界模型在单张 RTX 5090 上以 720p、16 FPS 运行ABot-World-0、単一のRTX 5090で720p・16FPSの操作可能な世界モデルを実現ARXIV · VIA R/LOCALLLAMA · DISCUSSIONABot-World-0 is an action-conditioned video world model built for real-time, long-horizon closed-loop interaction, trained on data drawn from AAA games, simulation engines and internet video. A post on r/LocalLLaMA reports it running at 720p and 16 frames per second on a single RTX 5090 within 19GB of VRAM.ABot-World-0 是一个以动作为条件的视频世界模型,面向实时、长时程的闭环交互,训练数据取自 3A 游戏、仿真引擎和互联网视频。r/LocalLLaMA 上的帖子称,它可在单张 RTX 5090 上以 720p、每秒 16 帧运行,占用 19GB 显存。以这样的开销运行可交互世界模型,意味着消费级硬件也能尝试这项技术。ABot-World-0は、リアルタイムかつ長時間の閉ループ操作を狙った行動条件付きの動画世界モデルで、AAAゲームやシミュレーションエンジン、インターネット動画から集めたデータで学習している。r/LocalLLaMAの投稿によれば、単一のRTX 5090上で720p・毎秒16フレーム、VRAM 19GBで動作するという。
4AI-Assisted GPU Porting of a 250k Line Legacy Weather Simulation Code用 AI 辅助将 25 万行遗留气象模拟代码移植到 GPU25万行のレガシー気象シミュレーションコードをAI支援でGPU移植ARXIV · VIA HACKER NEWS · 42 PTS · 5 COMMENTS · DISCUSSIONResearchers describe using CLI-based AI coding agents to port a 250,000-line legacy weather simulation code to GPUs. The paper argues such codebases are scientific assets whose credibility was built through years of development and comparison with observations, so a port must preserve results and not just speed.研究者介绍了如何借助命令行 AI 编程代理,把一套 25 万行的遗留气象模拟代码移植到 GPU 上。论文指出,这类代码库是经过多年开发、并与观测数据反复比对才建立起可信度的科学资产,因此移植必须保持结果一致,而不只是提升速度。研究者らは、CLIベースのAIコーディングエージェントを用いて25万行のレガシー気象シミュレーションコードをGPUへ移植した過程を報告した。論文は、こうしたコード群が長年の開発と観測との比較によって信頼性を積み上げてきた科学的資産であり、移植では速度だけでなく結果の再現性が保たれねばならないと論じている。
5Secondhand book sales are booming. Is it because of AI?二手书销量暴涨,是因为 AI 吗?古本の売上が急増、原因はAIかBBC NEWS · VIA HACKER NEWS · 68 PTS · 71 COMMENTS · DISCUSSIONBooksellers report mysterious bulk orders of secondhand titles, which are thought to be bought for AI training and then pulped. Sales of used books are booming as a result. The trade is one of the few physical traces of how training data is being sourced.书商称接到神秘的二手书批量订单,据信这些书被买去用于训练 AI,随后被打成纸浆。二手书销量因此大幅增长。这一交易是训练数据来源为数不多的实物线索之一。書店が古本の不可解な大量注文を受けていると報告しており、これらの本はAIの学習用に買われた後でパルプ化されているとみられる。その結果、古本の売上が急増している。この取引は、学習データの調達経路をたどれる数少ない物理的な痕跡の一つだ。
2026-08-16 · SUNDAY · 03:04 PDT
1First person jailed for anti-AI protest surrenders to California authorities首位因反 AI 抗议入狱者向加州当局自首反AI抗議で初の収監、69歳の活動家がカリフォルニア当局に出頭THE GUARDIANWynd Kaufman, 69, surrendered to California authorities on Friday and is believed to be the first person jailed for protesting against artificial intelligence. She chained and locked the front doors of OpenAI's headquarters last year with members of the group StopAI. Supporters have dubbed her the Rosa Parks of AI risk, a sign the movement is moving from civil disobedience toward criminal sentences.69 岁的 Wynd Kaufman 于周五向加州当局自首,据信成为首位因抗议人工智能而入狱的人。她去年曾与 StopAI 成员一道,用锁链封锁了 OpenAI 总部的正门。支持者称她为「AI 风险领域的罗莎·帕克斯」,这表明该运动正从公民不服从走向刑事判罚。69歳のウィンド・カウフマン氏が金曜日にカリフォルニア当局へ出頭し、人工知能への抗議で収監される初の人物になったとみられる。同氏は昨年、団体StopAIのメンバーとともにOpenAI本社の正面扉を鎖で封鎖した。支持者は「AIリスクのローザ・パークス」と呼んでおり、運動が市民的不服従から刑事罰の段階へ移りつつあることを示している。
2What happens when an LLM never sees material beyond fifth grade?如果一个语言模型只学过五年级以内的材料,会发生什么五年生までの教材しか学習しなかった言語モデルはどうなるのかLITTLELEARNER · VIA HACKER NEWS · 109 PTS · 69 COMMENTS · DISCUSSIONA project called LittleLearner asks what a language model learns when its training material never goes beyond a fifth-grade level. The writeup reached the Hacker News front page with 109 points and 69 comments. The question it raises - how much of a model's ability comes from the difficulty of its data rather than its sheer volume - bears directly on curriculum-style pretraining.一个名为 LittleLearner 的项目探讨了这样一个问题:如果语言模型的训练材料从未超出五年级水平,它究竟能学到什么。该报告登上 Hacker News 首页,获得 109 分和 69 条评论。它提出的问题——模型能力究竟有多少来自数据的难度而非数据的体量——直接关系到课程式预训练的思路。LittleLearnerというプロジェクトが、学習材料が五年生の水準を超えない言語モデルは何を身につけるのかを問うている。この報告はHacker Newsのトップページに上がり、109ポイントと69件のコメントを集めた。モデルの能力がデータの量ではなく難度にどこまで由来するのかという問いは、カリキュラム型の事前学習に直結する。
3AI cheating, leaked papers and marking errors: how exam protests went globalAI 作弊、试题泄露与判分失误:考试抗议如何蔓延全球AIによる不正、試験問題の流出、採点ミス - 試験をめぐる抗議はいかに世界へ広がったかTHE GUARDIANStudent unrest over exams has swept India, Portugal and Mexico, with AI-assisted cheating, leaked papers and marking errors among the grievances. The Guardian reports that anger over exam integrity is colliding with the pressure to score well in a tough job market. High-stakes written assessment is the mechanism under strain as AI makes cheating harder to detect.印度、葡萄牙与墨西哥接连爆发学生抗议,起因包括 AI 作弊、试题泄露和判分失误。《卫报》报道称,对考试公正性的不满,正与就业市场低迷下追求高分的压力叠加在一起。承压的正是高利害的笔试评估机制——AI 让作弊变得更难被发现。インド、ポルトガル、メキシコで学生の抗議が相次いでおり、AIを使った不正行為、試験問題の流出、採点ミスが要因として挙がっている。ガーディアン紙は、試験の公正さへの不満が、厳しい就職市場で好成績を求める重圧と重なっていると伝えた。負荷がかかっているのは高い利害を伴う筆記試験という仕組みそのもので、AIが不正の発見をいっそう難しくしている。
4An abliterated FP8 build of Qwen3.8-27B reports refusal rates falling from 64-99% to 0-6%Qwen3.8-27B 的 abliterated FP8 版本称拒答率从 64-99% 降至 0-6%Qwen3.8-27BのabliteratedなFP8版、拒否率が64〜99%から0〜6%に低下と報告R/LOCALLLAMAA community build of Qwen3.8-27B in FP8 reports that abliteration cut measured refusal rates from 64-99% down to 0-6%. The poster says MMLU and GSM8K scores moved by less than 1.3 points, arguing the edit leaves general capability largely intact. Low-cost refusal removal with little measured capability loss remains an unresolved problem for open-weight release policy.社区发布的 Qwen3.8-27B FP8 版本称,经 abliteration 处理后,实测拒答率从 64-99% 降至 0-6%。发帖者表示 MMLU 与 GSM8K 成绩的变化不足 1.3 分,认为该改动基本没有损害模型的通用能力。以低成本去除拒答机制而几乎不损失可测能力,仍是开放权重发布政策中悬而未决的问题。コミュニティが公開したQwen3.8-27BのFP8版は、abliteration処理により実測の拒否率が64〜99%から0〜6%へ下がったと報告している。投稿者はMMLUとGSM8Kのスコア変動が1.3ポイント未満にとどまり、汎用性能はほぼ保たれていると主張する。低コストで拒否挙動だけを取り除けることは、オープンウェイト公開の方針にとって未解決の課題であり続けている。
2026-08-16 · SUNDAY · 00:03 PDT
1The scam that uses AI to exploit holiday photos posted on social media利用 AI 从社交媒体度假照片下手的新型诈骗SNSに投稿した旅行写真をAIで悪用する詐欺THE GUARDIANThe Guardian describes a fraud pattern in which scammers take holiday pictures posted to Instagram or Facebook and use AI to build tailored messages about a compromised bank card. Location details visible in a photo let the fake alert reference a real trip, which is what makes the request for account details land.《卫报》报道了一种诈骗手法:骗子获取用户发布在 Instagram 或 Facebook 上的度假照片,再用 AI 生成针对性的银行卡异常通知邮件。照片中可辨认的地点信息使伪造的警报能够提及一次真实的行程,这正是索要账户信息的环节得以奏效的原因。ガーディアン紙は、InstagramやFacebookに投稿された旅行写真を詐欺グループが入手し、AIでカードの不正利用を装った個別化されたメールを作成する手口を報じた。写真に写り込んだ場所の手がかりによって偽の警告が実際の旅行に言及できるようになり、それが口座情報の要求を信じ込ませる決め手になっている。
2Qwen3.8-27B and Qwen3.6-27B compared on writing ray-tracers in BASICQwen3.8-27B 与 Qwen3.6-27B 对比:用 BASIC 写光线追踪器Qwen3.8-27BとQwen3.6-27BをBASICでのレイトレーサ作成で比較R/LOCALLLAMAA post on r/LocalLLaMA sets Qwen3.8-27B against its predecessor Qwen3.6-27B on the same task, writing a ray-tracer in BASIC. Hand-rolled comparisons like this are how the local-model community judges whether a point release actually improves code generation, since an unusual target language leaves little room for memorized answers.r/LocalLLaMA 上的一篇帖子让 Qwen3.8-27B 与其前代 Qwen3.6-27B 完成同一项任务:用 BASIC 编写光线追踪器。本地模型社区正是靠这类自制对比来判断一次小版本更新是否真的提升了代码生成能力,因为冷门的目标语言几乎不给背题留下空间。r/LocalLLaMAの投稿が、Qwen3.8-27Bと前世代のQwen3.6-27Bに同じ課題、すなわちBASICでのレイトレーサ作成を課した。こうした手作りの比較は、マイナーリリースが本当にコード生成を改善したのかをローカルモデル界隈が見極める手段であり、珍しい対象言語は暗記した解答が通用する余地をほとんど残さない。
3A dated roundup tracks the state of the art in Apple Silicon inference一份带日期的汇总梳理 Apple Silicon 推理的当前最优方案日付入りのまとめがApple Silicon推論の最新到達点を整理R/LOCALLLAMAAn r/LocalLLaMA thread stamped August 15 collects the setups currently considered best for running models locally on Apple Silicon. Dated roundups are how Mac users follow a stack that moves with every MLX and llama.cpp release, where a configuration recommended a month ago is often already superseded.一条标注为 8 月 15 日的 r/LocalLLaMA 帖子汇总了目前被认为最适合在 Apple Silicon 上本地运行模型的配置方案。Mac 用户正是靠这类带日期的汇总来跟进一个随 MLX 与 llama.cpp 每次发布而变动的技术栈,一个月前推荐的配置往往已经被取代。8月15日と明記されたr/LocalLLaMAのスレッドが、Apple Silicon上でモデルをローカル実行するのに現時点で最良とされる構成をまとめている。日付入りのまとめは、MLXとllama.cppのリリースごとに動くスタックをMacユーザーが追うための手段で、1カ月前に推奨された構成はすでに置き換わっていることが多い。
4Have a laugh at AI's expense by roleplaying as a chatbot扮演聊天机器人,拿 AI 开个玩笑チャットボットになりきってAIを笑いのネタにするTHE VERGEThe Verge covers Your AI Slop Bores Me, a two-tab web toy where one human submits a request and another human answers it in the voice of a chatbot. The joke rests on players imitating the padding and hedging that assistant replies are known for. It is a piece of AI backlash culture rather than a product.The Verge 介绍了 Your AI Slop Bores Me:一个只有两个标签页的网页小玩意,一名真人提出请求,另一名真人则模仿聊天机器人的口吻作答。笑点在于玩家要刻意模仿助手回复中那种注水与含糊其辞的腔调。它属于对 AI 的逆反文化,而不是一款产品。The Vergeが「Your AI Slop Bores Me」を取り上げた。タブが二つだけのウェブ上の遊びで、一方の人間が依頼を書き込み、もう一方の人間がチャットボットの口調で答える。面白さは、アシスタントの返答にありがちな水増しや曖昧な言い回しをプレイヤーが真似る点にある。製品というよりAIへの反発から生まれた文化的な産物だ。