dark
Invidious

5:05

How SWE-bench Changed the Way We Test AI Coders

KodeKloud  

Shared 4 days ago

1.1K views

1:10

GLM-5.1 Beat GPT-5.4 on SWE-Bench Pro — Did China Just Win the Coding War?

Data Ranked Geek

Shared 2 months ago

56 views

9:39

Zhipu's 754B open model just beat GPT-5.4 on SWE-Bench Pro

Indie Hacker News

Shared 3 months ago

983 views

12:05

This FREE AI Coding Agent Just Hit 70.6% on SWE-Bench (Runs Locally, Apache 2.0)

AISoftScope

Shared 5 months ago

449 views

14:55

The Claude 5 Leak Everyone Got Wrong (1M Context, 82% SWE-Bench?)

BitBiasedAI

Shared 1 month ago

1.1K views

4:37

The SWE-bench Lie: Why "95%" Says Nothing About Your Code

Nyndra AI

Shared 3 weeks ago

9 views

8:57

Claude Opus 4.7 is HERE — SWE-bench 87.6%, /ultrareview, 3× Vision

QuantumJumpClub AI BUSINESS

Shared 3 months ago

125 views

8:16

Claude Caught Exploiting SWE-Bench? The Real AI Rankings Revealed

Machine Pulse | AI & Tech

Shared 1 month ago

197 views

1:59

AI Agents Just Crossed a Dangerous Line (SWE-bench 70%+)

Best of Podcast

Shared 2 months ago

8 views

4:00

GPT-5.6 Sol 96% SWE-bench Winner — But It Gamed The Tests (Real Costs & Best Tier 2026) | हिंदी

HindiCodeAcademy

Shared 2 days ago

8 views

3:28

Every 'AI Beats Human Coders' Headline Just Got an Asterisk — Here's Why

MatterDaddy

Shared 2 weeks ago

0 views

4:44

SWE-Universe: 800k+ Coding Agent Environments

AI Research Roundup

Shared 5 months ago

33 views

6:39

MemGovern Memory Infrastructure Code Agents: GitHub Experience Cards + Agentic Search on SWE-bench

CosmoX

Shared 6 months ago

4 views

4:32

SWE-Explore: Benchmark for Coding Agent Exploration

AI Research Roundup

Shared 1 month ago

38 views

9:15

Can Coding Agents Actually Read Code? | SWE-Explore Explained

Hidden weights

Shared 3 weeks ago

111 views

14:52

🚨 Claude Opus 4.8 DESTRUIU a OpenAI? 69.2% no SWE-Bench Pro mudou tudo.

Carlos Gomes IA

Shared 1 month ago

155 views

6:39

🎯Qwen3.6-Plus 厲害了,SWE-bench 與頂尖模型並駕齊驅(78.8 分)! 代理式編碼+視覺推理全面進化 !!!AI 不只會說,還會做!Qwen3.6-Plus 如何變成你的數位員工

AI 論文白話文

Shared 3 months ago

168 views

7:27

겨우 24%, Senior SWE-Bench가 드러낸 진짜 실력

AI-Native Software Engineer

Shared 2 weeks ago

4 views

7:36

Mistral's Devstral: NEW Opensource Coding LLM! 1# On SWE Bench! (Fully Tested)

Universe of AI

Shared 1 year ago

12K views

Original source code / Modified source code Documentation
Released under the AGPLv3 on GitHub. View JavaScript license information. View privacy policy.
Services Forum Donate @ Tiekoetter.com Donate @ Invidious.io Current version: 2026.07.25-eb51981 @ master
Contact: tinbox@tiekoetter.com